llm-jp-4-vl-9b が HAI Go / HAI Go Plus の対象モデルになりました
追記 2026-09-13: 公開時点では qwen3.8-27b-uncensored / llm-jp-4-vl-9b に短期枠はないと記載していましたが、両モデルにも短期枠(5 時間 / 週)を導入しました。月間利用枠に制限がない点は変わりません。現行の仕様は料金ページとドキュメントをご覧ください。
定額プラン HAI Go / HAI Go Plus の対象モデルに llm-jp-4-vl-9b を追加しました。
2026-09-02 に追加した日本語特化の視覚言語モデルで、これまでは従量(クレジット消費)のみでした。モデル ID・単価・API の使い方はこれまでと変わりません。加入中のお客様は申込や設定の変更なしで、そのまま定額枠の対象になります。
対象モデル
| モデル | 月間利用枠 |
|---|---|
qwen3.8-27b-uncensored |
制限なし(短期枠あり) |
deepseek-v4.1-flash |
あり(短期枠あり) |
gemma-4-31b-it |
あり(短期枠あり) |
llm-jp-4-vl-9b |
制限なし(短期枠あり) |
deepseek-v4-flash |
あり(短期枠あり) |
対象モデルは HAI Go と HAI Go Plus で共通です。HAI Go Plus では、月間利用枠・短期枠のあるモデルはいずれも HAI Go の 2 倍になり、混雑時の同時実行枠も HAI Go より広くなります。
利用枠について
llm-jp-4-vl-9b には、qwen3.8-27b-uncensored と同じく月間利用枠の制限はありません。短期枠(5 時間 / 週)は両モデルにもあります。自社 GPU で運用しているモデルのため、混雑時は順番待ちとなります(stream: true で最大 4 分、stream: false で最大 1 分)。
クレジット残高がある間は、これまでどおり残高から優先して消費されます。残高を使い切ると自動的に定額枠へ切り替わります。
使い方
これまでと同じです。model に llm-jp-4-vl-9b を指定してください。
curl https://hai-api.hcloud.ltd/v1/chat/completions \
-H "Authorization: Bearer hai_..." \
-H "Content-Type: application/json" \
-d '{
"model": "llm-jp-4-vl-9b",
"messages": [{"role":"user","content":"このスライドの要点を箇条書きにしてください"}]
}'
画像は OpenAI 互換の image_url コンテンツで渡します。
curl https://hai-api.hcloud.ltd/v1/chat/completions \
-H "Authorization: Bearer hai_..." \
-H "Content-Type: application/json" \
-d '{
"model": "llm-jp-4-vl-9b",
"messages": [{"role":"user","content":[
{"type":"text","text":"この画像に含まれる文字を全て抽出してください"},
{"type":"image_url","image_url":{"url":"data:image/png;base64,..."}}
]}]
}'
注意点
- コンテキストは 32K トークンです。 入力の実効上限は約 24K トークンなので、長い入力は切り詰めてください
- 従量(クレジット)でのご利用に変更はありません。単価は入力 ¥55 / 出力 ¥125(1M tok・税込表示)のままです
- 混雑時は順番待ちが発生する場合があります