リリース

qwen3.8-27b-uncensored の推論基盤を増強しました

qwen3.8-27b-uncensored の推論基盤に GPU を追加しました。モデル ID・エンドポイント・単価・コンテキスト長はいずれも変わりません。リクエスト側の変更も不要です。

このモデルは自社設備の GPU だけで提供しているため、設備が埋まっている間は順番待ちになります。今回の増強は、その順番待ちが起きる頻度を下げるためのものです。

変更点

項目 変更前 変更後
同時実行枠 標準 拡大
単価 入力 ¥70 / 出力 ¥700 据え置き
コンテキスト 256K(262,144)tok 据え置き

同時実行枠は前払いチャージ(従量)・HAI Go・HAI Go Plus のいずれでも広がります。プランごとの枠の差はこれまでどおりで、今回その関係は変えていません。

長い入力も対象です

今回追加した GPU は、長い入力のリクエストも受けられる構成にしています。短いプロンプトを繰り返す使い方だけでなく、長い会話履歴やファイル群をコンテキストに載せる使い方でも増強分を使えます。

リクエストの振り分けは基盤側で自動的に行います。リクエスト側で指定する必要はありません。公開しているコンテキスト長は 256K(262,144)トークンのままです。

生成速度そのものは変わりません

今回広げたのは設備の総量です。1 回のリクエストが返ってくるまでの速度を上げる変更ではありません。

これまでどおり、混雑している時間帯は生成速度が落ちます。今回の増強で、その状態になるまでの余裕が広がりました。

変わらないもの

注意点

単価とモデル一覧は料金ページ、モデル ID とセットアップ手順はドキュメントに掲載しています。

← 新着情報一覧へ

今日から、baseURL を差し替えるだけ。

コンソールを開く