Qwen3.8 27B Uncensored

qwen3.8-27b-uncensored
自社DC

27B dense の無検閲派生。拒否応答を返さない

稼働率(72h)

98.61%

TTFT(24h 中央値)

1.87s

E2E レイテンシ(24h 中央値)

22.38s

出力速度(24h 中央値)

47tok/s

仕様

入力単価¥70 / 1M tok
キャッシュ読取単価—
出力単価¥480 / 1M tok
コンテキスト長245,760
最大出力トークン16,384
対応入力テキスト / 画像
精度FP8
重みorcarouter/Qwen3.8-27B-Uncensored-FP8
reasoning_effortnone / minimal / low / medium / high / xhigh
基盤自社DC
直近 72 時間

稼働状況

98.61%

72 時間の稼働率。1 時間ごとに、障害の無かった時間を緑で示します。

72 時間前現在
稼働障害

パフォーマンス

出力速度 - 24h

47tok/s
20:00 JST — 21 tok/s21:00 JST — 64 tok/s22:00 JST — 49 tok/s23:00 JST — 77 tok/s01:00 JST — 9 tok/s02:00 JST — 50 tok/s03:00 JST — 45 tok/s04:00 JST — 40 tok/s05:00 JST — 13 tok/s06:00 JST — 46 tok/s07:00 JST — 6 tok/s08:00 JST — 52 tok/s09:00 JST — 78 tok/s10:00 JST — 79 tok/s11:00 JST — 77 tok/s12:00 JST — 70 tok/s13:00 JST — 44 tok/s14:00 JST — 5 tok/s16:00 JST — 79 tok/s17:00 JST — 88 tok/s19:00 JST — 68 tok/s20:0002:0008:0014:0020:00

TTFT - 24h

1.87s
20:00 JST — 0.07 s21:00 JST — 3.83 s22:00 JST — 3.5 s23:00 JST — 7.71 s01:00 JST — 1.94 s02:00 JST — 0.39 s03:00 JST — 4.56 s04:00 JST — 15.1 s05:00 JST — 3.66 s06:00 JST — 0.6 s07:00 JST — 7.94 s08:00 JST — 6.79 s09:00 JST — 2.77 s10:00 JST — 0.57 s11:00 JST — 1.49 s12:00 JST — 3.52 s13:00 JST — 5.78 s14:00 JST — 3.85 s16:00 JST — 0.37 s17:00 JST — 6.54 s19:00 JST — 3.77 s20:0002:0008:0014:0020:00

E2E レイテンシ - 24h

22.38s
20:00 JST — 31.23 s21:00 JST — 44.02 s22:00 JST — 41.07 s23:00 JST — 29.21 s00:00 JST — 77.18 s01:00 JST — 29.88 s02:00 JST — 1.48 s03:00 JST — 42.94 s04:00 JST — 37.74 s05:00 JST — 29.98 s06:00 JST — 5.52 s07:00 JST — 48.43 s08:00 JST — 33.64 s09:00 JST — 8.04 s10:00 JST — 21.59 s11:00 JST — 48.02 s12:00 JST — 20.9 s13:00 JST — 18.33 s14:00 JST — 14.53 s15:00 JST — 17.64 s16:00 JST — 2.04 s17:00 JST — 58.94 s18:00 JST — 60.04 s19:00 JST — 25.19 s20:0002:0008:0014:0020:00

TTFT と出力速度はストリーミング応答(出力 50 トークン以上)の中央値、E2E レイテンシはすべての成功応答の中央値です。1 時間ごとに集計し、リクエストが無かった時間は線を描きません。稼働率は障害の有無で判定し、リクエストの有無には依りません。

このモデルを使う

from openai import OpenAI

client = OpenAI(
    base_url="https://hai-api.hcloud.ltd/v1",
    api_key="hai_...",
)

resp = client.chat.completions.create(
    model="qwen3.8-27b-uncensored",
    messages=[{"role": "user", "content": "Hello"}],
)
print(resp.choices[0].message.content)
curl https://hai-api.hcloud.ltd/v1/chat/completions \
  -H "Authorization: Bearer hai_..." \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen3.8-27b-uncensored",
    "messages": [{"role":"user","content":"こんにちは"}]
  }'

ほかの言語・エージェントの設定は ドキュメント と セットアップ

今日から、baseURL を差し替えるだけ。

コンソールを開く