お知らせ

キャッシュ読取単価を導入し、全モデルの単価を見直しました

4 つのモデルにキャッシュ読取単価を追加し、あわせて全モデルの入力/出力単価を見直しました。本記事の公開時点以降のリクエストから新しい単価が適用されます。過去の利用履歴は当時の単価で確定しており、遡って再計算しません。

値上げ対象のモデルでは、同じ残高で消費できるトークン量が減ります。お手元のクレジットはそのまま新単価で消費されます。チャージのやり直しは必要ありません。

キャッシュ読取単価

推論基盤のプレフィックスキャッシュから供給された入力トークンに、通常入力より安い単価を適用します。長いシステムプロンプトを繰り返す用途では安くなることがあります。

キャッシュヒットは保証されません。 同一プロンプトでもヒットしないことがあり、HAI 側でヒットを制御していません。毎回必ず割引される機能ではありません。

単価が設定されていないモデルでも、明細の cache_read_tokens は記録します。その場合の課金は通常の入力単価のままです。

課金は次のとおりです。

(input_tokens − cache_read_tokens) × 入力単価 + cache_read_tokens × キャッシュ読取単価 + output_tokens × 出力単価

新しい単価(1M tok・税込表示)

モデル 入力 キャッシュ読取 出力
kimi-k3 ¥600 → ¥585 ¥85 ¥3,000 → ¥2,910
qwen3.8-2.4t-a95b ¥435 → ¥430 ¥60 ¥1,220 → ¥1,250
kimi-k2.6 ¥165 → ¥160 ¥35 ¥735 → ¥730
qwen3.8-27b ¥90(据え置き) ¥640(据え置き)
gemma-4-31b-it ¥50 → ¥55 ¥115 → ¥125
qwen3.8-27b-uncensored ¥50(据え置き) ¥320(据え置き)
qwen3.6-35b-a3b ¥40 → ¥35 ¥245 → ¥230
deepseek-v4-flash ¥30 → ¥35 ¥10 ¥60 → ¥75

gemma-4-31b-it(入力 +10.0% / 出力 +8.7%)と deepseek-v4-flash(入力 +16.7% / 出力 +25.0%)の値上げは、モデル提供コストの見直しによるものです。qwen3.8-27b-uncensored は据え置きです。

追記 2026-08-21: qwen3.8-27b-uncensored の単価はその後改定しました。 現在は入力 ¥70 / 出力 ¥700(1M tok・税込表示)です(単価改定のお知らせ)。上の表の他のモデルに変更はありません。

適用範囲

単価とモデル一覧は料金ページ、各モデルの説明はモデル、課金の定義はドキュメントに掲載しています。

← 新着情報一覧へ

今日から、baseURL を差し替えるだけ。

コンソールを開く