Cyber Frost 3.8

cyber-frost-3.8
自社DC法人限定

セキュリティ業務向けに調整された 180B MoE。脆弱性検証・マルウェア解析・検知ルール作成で拒否応答を抑える。法人年額契約者限定

稼働率(72h)

98.61%

TTFT(24h 中央値)

—s

E2E レイテンシ(24h 中央値)

—s

出力速度(24h 中央値)

—tok/s

仕様

入力単価¥1,200 / 1M tok
キャッシュ読取単価—
出力単価¥2,000 / 1M tok
コンテキスト長245,760
最大出力トークン16,384
対応入力テキスト
精度Q5
重みpeasantsmith/CYBER-FROST-3.8-PS-GUFF
reasoning_effortlow / medium / high / xhigh
基盤自社DC
ご利用条件法人向け年額前払いコミットのご契約者限定
直近 72 時間

稼働状況

98.61%

72 時間の稼働率。1 時間ごとに、障害の無かった時間を緑で示します。

72 時間前現在
稼働障害

パフォーマンス

出力速度 - 24h

—tok/s
17:0023:0005:0011:0017:00直近 24 時間に十分なリクエストがありません

TTFT - 24h

—s
17:0023:0005:0011:0017:00直近 24 時間に十分なリクエストがありません

E2E レイテンシ - 24h

—s
16:00 JST — 297.52 s17:0023:0005:0011:0017:00

TTFT と出力速度はストリーミング応答(出力 50 トークン以上)の中央値、E2E レイテンシはすべての成功応答の中央値です。1 時間ごとに集計し、リクエストが無かった時間は線を描きません。稼働率は障害の有無で判定し、リクエストの有無には依りません。

このモデルを使う

from openai import OpenAI

client = OpenAI(
    base_url="https://hai-api.hcloud.ltd/v1",
    api_key="hai_...",
)

resp = client.chat.completions.create(
    model="cyber-frost-3.8",
    messages=[{"role": "user", "content": "Hello"}],
)
print(resp.choices[0].message.content)
curl https://hai-api.hcloud.ltd/v1/chat/completions \
  -H "Authorization: Bearer hai_..." \
  -H "Content-Type: application/json" \
  -d '{
    "model": "cyber-frost-3.8",
    "messages": [{"role":"user","content":"こんにちは"}]
  }'

ほかの言語・エージェントの設定は ドキュメント と セットアップ

今日から、baseURL を差し替えるだけ。

コンソールを開く