DeepSeek V4.1 Flash

deepseek-v4.1-flash
自社DC

1M コンテキストのネイティブマルチモーダル。入力の多いエージェント向け

稼働率(72h)

98.61%

TTFT(24h 中央値)

8.77s

E2E レイテンシ(24h 中央値)

28.22s

出力速度(24h 中央値)

47tok/s

仕様

入力単価¥60 / 1M tok
キャッシュ読取単価¥5 / 1M tok
出力単価¥240 / 1M tok
コンテキスト長1,048,576
最大出力トークン384,000
対応入力テキスト / 画像
精度Q8
重みvcruz305/DeepSeek-V4.1-Flash-GGUF
reasoning_effortnone / minimal / low / medium / high / xhigh
基盤自社DC
第三者評価 · Artificial Analysis

Claude・GPT・Gemini との比較

評価DeepSeek V4.1 FlashClaudeGPTGemini
Terminal-Bench v4.0
エージェント的なコーディングとターミナル操作
27556020
SciCode
科学計算のコーディング
52615657
Humanity's Last Exam
推論と知識
39595548
AA-LCR v1.1
長文脈の推論
84838081

出典 Artificial Analysis(2026-09-15 採取)。比較行は Anthropic / OpenAI / Google の最高性能設定。

直近 72 時間

稼働状況

98.61%

72 時間の稼働率。1 時間ごとに、障害の無かった時間を緑で示します。

72 時間前現在
稼働障害

パフォーマンス

出力速度 - 24h

47tok/s
20:00 JST — 33 tok/s22:00 JST — 30 tok/s23:00 JST — 16 tok/s00:00 JST — 41 tok/s01:00 JST — 101 tok/s02:00 JST — 31 tok/s03:00 JST — 168 tok/s05:00 JST — 59 tok/s08:00 JST — 173 tok/s09:00 JST — 95 tok/s11:00 JST — 185 tok/s12:00 JST — 159 tok/s16:00 JST — 83 tok/s17:00 JST — 89 tok/s20:0002:0008:0014:0020:00

TTFT - 24h

8.77s
20:00 JST — 8.73 s22:00 JST — 12.07 s23:00 JST — 19.21 s00:00 JST — 7.51 s01:00 JST — 6.29 s02:00 JST — 4.66 s03:00 JST — 1.35 s05:00 JST — 3.11 s08:00 JST — 1.86 s09:00 JST — 3.53 s11:00 JST — 2.45 s12:00 JST — 1.7 s16:00 JST — 8.75 s17:00 JST — 14.93 s20:0002:0008:0014:0020:00

E2E レイテンシ - 24h

28.22s
20:00 JST — 27.82 s21:00 JST — 60 s22:00 JST — 54 s23:00 JST — 52.01 s00:00 JST — 29.91 s01:00 JST — 16.39 s02:00 JST — 4.8 s03:00 JST — 2.47 s04:00 JST — 1.86 s05:00 JST — 3.2 s06:00 JST — 53.25 s07:00 JST — 32.01 s08:00 JST — 9.15 s09:00 JST — 30.37 s10:00 JST — 287.62 s11:00 JST — 7.39 s12:00 JST — 5.07 s13:00 JST — 9.36 s15:00 JST — 129.62 s16:00 JST — 41.68 s17:00 JST — 52.74 s18:00 JST — 142.95 s19:00 JST — 5.86 s20:0002:0008:0014:0020:00

TTFT と出力速度はストリーミング応答(出力 50 トークン以上)の中央値、E2E レイテンシはすべての成功応答の中央値です。1 時間ごとに集計し、リクエストが無かった時間は線を描きません。稼働率は障害の有無で判定し、リクエストの有無には依りません。

このモデルを使う

from openai import OpenAI

client = OpenAI(
    base_url="https://hai-api.hcloud.ltd/v1",
    api_key="hai_...",
)

resp = client.chat.completions.create(
    model="deepseek-v4.1-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(resp.choices[0].message.content)
curl https://hai-api.hcloud.ltd/v1/chat/completions \
  -H "Authorization: Bearer hai_..." \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4.1-flash",
    "messages": [{"role":"user","content":"こんにちは"}]
  }'

ほかの言語・エージェントの設定は ドキュメント と セットアップ

今日から、baseURL を差し替えるだけ。

コンソールを開く