拒否応答を返さない Qwen3.6 35B-A3B Uncensored を追加しました
qwen3.6-35b-a3b-uncensored を追加しました。HauhauCS が 2026-04-17 に公開した、qwen3.6-35b-a3b と同じベース重み(Qwen3.6-35B-A3B)から拒否応答を取り除いた派生モデルです。単価は入力 ¥60 / 出力 ¥400(1M tok・税込表示)で、ベースの qwen3.6-35b-a3b より 3 割ほど高くなります。
提供できる同時実行数に限りがあるため、ベースより高めの単価に設定しています。コンテキストは 64K トークンで、現在のカタログでは最も短くなります。重みは Apache 2.0 で公開されています。
特徴
ベース重みは Qwen3.6-35B-A3B と同じ
256 エキスパートのうち 8 ルーテッド + 1 共有を起動する、総パラメータ 35B・アクティブ 3B の MoE です。Gated DeltaNet と Gated Attention を 3:1 で積み上げた 40 層構成で、アーキテクチャはベースモデルから変わっていません。学習データや能力に手は入っておらず、変更されているのは拒否応答の挙動だけです。モデルカードは Hugging Face にあります。
拒否応答を返さない
安全ガードレールを外してあるため、通常のモデルが応答を断る依頼にも回答します。作者は 465 件のプロンプトで拒否ゼロと公表していますが、これは作者自身による測定で、第三者の独立評価ではありません。出力の適法性・妥当性の判断は利用者側に委ねられます。用途が利用規約の範囲内であることを確認のうえでご利用ください。
テキスト・画像入力
入力はテキストと画像に対応します。出力はテキストのみです。ベースモデルは動画入力を持ちますが、このモデルでは動画を渡せません。動画が必要な場合は qwen3.6-35b-a3b か gemma-4-31b-it を使ってください。
ベンチマーク(Qwen 公表値)
このモデル自体のベンチマークは公表されていません。以下は Qwen がベースモデルのモデルカードで公表しているスコアで、無検閲化する前・量子化する前のベース重みを Qwen が測定したものです。HAI が提供する派生モデルで同じスコアが出ることを示すものではありません。
| ベンチマーク | Qwen3.6 35B-A3B | Gemma 4 31B |
|---|---|---|
| SWE-bench Verified | 73.4 | 52.0 |
| SWE-bench Pro | 49.5 | 35.7 |
| Terminal-Bench 2.0 | 51.5 | 42.9 |
| Claw-Eval Avg | 68.7 | 48.5 |
| NL2Repo | 29.4 | 15.5 |
| LiveCodeBench v6 | 80.4 | 80.0 |
| GPQA | 86.0 | 84.3 |
| TAU3-Bench | 67.2 | 67.5 |
| VITA-Bench | 35.6 | 43.0 |
コーディングエージェント系では Gemma 4 31B を大きく引き離しています。一方で TAU3-Bench(67.2 対 67.5)と VITA-Bench(35.6 対 43.0)は下回っており、一般エージェント指標では優位ではありません。LiveCodeBench v6 と GPQA の差はごく小さい範囲です。
測定条件は、SWE-bench 系が内部エージェント scaffold(bash + ファイル編集)で temp=1.0 / top_p=0.95、200K コンテキストです。Terminal-Bench 2.0 は Harbor/Terminus-2 harness、3 時間タイムアウト、5 回平均です。比較列の Gemma 4 31B も含め、すべて Qwen 自身による測定であり、第三者の独立評価ではありません。
HAI がこのモデルに割り当てているコンテキストは 64K で、上表の測定条件(200K〜256K)とは異なります。
使い方
model に qwen3.6-35b-a3b-uncensored を指定します。
curl https://hai-api.hcloud.ltd/v1/chat/completions \
-H "Authorization: Bearer hai_..." \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3.6-35b-a3b-uncensored",
"messages": [{"role":"user","content":"この設定ファイルの問題点を挙げてください"}]
}'
思考を止める場合は chat_template_kwargs に enable_thinking: false を渡します。
curl https://hai-api.hcloud.ltd/v1/chat/completions \
-H "Authorization: Bearer hai_..." \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3.6-35b-a3b-uncensored",
"messages": [{"role":"user","content":"2 + 2 は?"}],
"chat_template_kwargs": {"enable_thinking": false}
}'
画像は image_url で渡します。
curl https://hai-api.hcloud.ltd/v1/chat/completions \
-H "Authorization: Bearer hai_..." \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3.6-35b-a3b-uncensored",
"messages": [{
"role": "user",
"content": [
{"type": "image_url", "image_url": {"url": "https://example.com/shot.png"}},
{"type": "text", "text": "この画像に写っているものを説明してください"}
]
}]
}'
注意点
- 本記事の単価は公開当時のものです。 この ID は現在
qwen3.8-27b-uncensoredに読み替わり、単価は入力 ¥70 / 出力 ¥700(1M tok・税込表示)です(追記 2026-08-21。詳細は単価改定のお知らせ) - コンテキストは 64K(65,536)トークンです。 現在のカタログで最も短く、入力と出力の合計がこの範囲に収まる必要があります。長文が必要な場合は
qwen3.6-35b-a3b(256K)か Kimi K3 / DeepSeek V4 Flash(1M)を使ってください(追記 2026-08-22: 読み替え先の現行モデルは 256K に拡大しました。基盤更新のお知らせ) reasoning_effortに"high"は指定できません。 受け付ける値は"xhigh"/"medium"/"low"で、"high"を渡すと400を返します(追記 2026-08-19。詳細はお知らせ。追記 2026-08-22: 現行モデルではこの制限は解消しました)reasoning_effortでは思考を止められません。 このモデルはreasoning_effort: "none"を受け取っても思考します。止めるにはchat_template_kwargsのenable_thinking: falseを指定してください。他モデルとは指定方法が異なります(追記 2026-08-22: 現行モデルではreasoning_effort: "none"でも止められます)- 拒否応答を返しません。 通常のモデルが断る依頼にも回答するため、出力の取り扱いと用途の適法性は利用者の責任になります
- 同時に処理できるリクエスト数に限りがあります。 混雑時は応答開始までの待ち時間が長くなります
- 思考は既定 ON です。思考トークンは出力として課金されます(思考パラメータのお知らせ)
- 動画入力は使えません。出力はテキストのみです