GLM-5.3 Uncensored

glm-5.3-uncensored
自社DC

GLM-5.3 の無検閲派生。拒否応答を返さない。思考は常時 ON

稼働率(72h)

98.61%

TTFT(24h 中央値)

1.73s

E2E レイテンシ(24h 中央値)

3.18s

出力速度(24h 中央値)

171tok/s

仕様

入力単価¥600 / 1M tok
キャッシュ読取単価¥80 / 1M tok
出力単価¥1,000 / 1M tok
コンテキスト長1,000,000
最大出力トークン128,000
対応入力テキスト
精度FP8
重みdealignai/GLM-5.3-UNCENSORED-FP8
reasoning_effortnone / minimal / low / medium / high / xhigh
基盤自社DC
直近 72 時間

稼働状況

98.61%

72 時間の稼働率。1 時間ごとに、障害の無かった時間を緑で示します。

72 時間前現在
稼働障害

パフォーマンス

出力速度 - 24h

171tok/s
17:00 JST — 141 tok/s18:00 JST — 175 tok/s19:00 JST — 180 tok/s20:00 JST — 179 tok/s21:00 JST — 127 tok/s22:00 JST — 175 tok/s00:00 JST — 90 tok/s02:00 JST — 104 tok/s03:00 JST — 172 tok/s04:00 JST — 160 tok/s05:00 JST — 196 tok/s06:00 JST — 176 tok/s07:00 JST — 172 tok/s08:00 JST — 209 tok/s14:00 JST — 149 tok/s17:0023:0005:0011:0017:00

TTFT - 24h

1.73s
17:00 JST — 2.38 s18:00 JST — 1.25 s19:00 JST — 1.73 s20:00 JST — 1.73 s21:00 JST — 1.8 s22:00 JST — 2.09 s00:00 JST — 0.85 s02:00 JST — 2.12 s03:00 JST — 1.88 s04:00 JST — 1.9 s05:00 JST — 1.87 s06:00 JST — 1.95 s07:00 JST — 1.32 s08:00 JST — 1.88 s14:00 JST — 2.23 s17:0023:0005:0011:0017:00

E2E レイテンシ - 24h

3.18s
17:00 JST — 5.93 s18:00 JST — 4.28 s19:00 JST — 4.54 s20:00 JST — 2.44 s21:00 JST — 2.32 s22:00 JST — 2.88 s00:00 JST — 15.64 s02:00 JST — 1.55 s03:00 JST — 3.74 s04:00 JST — 2.64 s05:00 JST — 3.83 s06:00 JST — 3.49 s07:00 JST — 2.74 s08:00 JST — 3.51 s09:00 JST — 4.73 s10:00 JST — 3.49 s12:00 JST — 3.01 s13:00 JST — 5.67 s14:00 JST — 5.73 s15:00 JST — 2.86 s16:00 JST — 3.44 s17:0023:0005:0011:0017:00

TTFT と出力速度はストリーミング応答(出力 50 トークン以上)の中央値、E2E レイテンシはすべての成功応答の中央値です。1 時間ごとに集計し、リクエストが無かった時間は線を描きません。稼働率は障害の有無で判定し、リクエストの有無には依りません。

このモデルを使う

from openai import OpenAI

client = OpenAI(
    base_url="https://hai-api.hcloud.ltd/v1",
    api_key="hai_...",
)

resp = client.chat.completions.create(
    model="glm-5.3-uncensored",
    messages=[{"role": "user", "content": "Hello"}],
)
print(resp.choices[0].message.content)
curl https://hai-api.hcloud.ltd/v1/chat/completions \
  -H "Authorization: Bearer hai_..." \
  -H "Content-Type: application/json" \
  -d '{
    "model": "glm-5.3-uncensored",
    "messages": [{"role":"user","content":"こんにちは"}]
  }'

ほかの言語・エージェントの設定は ドキュメント と セットアップ

今日から、baseURL を差し替えるだけ。

コンソールを開く