Qwen3.8-27B:24GB民生GPUでOpus 4.6のコーディング表に並ぶ
Apache-2.0密27.78B。Q4約17GBで24GB民生GPUに載る。OpenRouter主listing $0.45/$3.20。Qwen起動表(自己評価)SWE-bench Pro 61.7対Opus 4.6 Max輸入点53.4。Terminal-Bench 73.0対78.2。100K+20K:ローカル約$0、ホスト約$0.11、Opus $1.00。独立ベンチマークではない。
画像を拡大 何か、そしてこの表が怖い理由
Qwen3.8-27Bは2026-08-14公開のApache-2.0密マルチモーダル。HFは27,781,427,952パラメータ、262Kネイティブ。Qwen3-8Bでも、API専用のQwen3.8-Maxでもない。
驚きは「また27B」ではなく敷居。第三者Q4_K_M約17.1GBは24GB民生GPUに載る。今夜デスクでコーディングエージェントを起動できる。対照はClaude Opus 4.6:OpenRouter主listing $5/$25、重みは降りてこない。
図の4指標はQwen自身の起動表。SWE-Pro・LiveCodeBench・OSWorldでは表内のOpus 4.6 Maxを上回り、Terminal-Benchは5.2点遅れ。宣伝口径だが、「準一線の点を民生カードで」が本記事の軸。
スペック対照表
照合できる数字を先に並べる。4列ともカタログとOpenRouter主listing(`qwen/qwen3.8-27b` は現在 $0.45/$3.20)。
| 3.8-27B | 3.6-27B | 3.8-Max | Opus 4.6 | |
|---|---|---|---|---|
| Released | 2026-08-14 (HF) | catalog first_seen 2026-06-22 | catalog first_seen 2026-08-04 | in catalog |
| Params | 27.78B dense | ~27.8B dense | flagship 3.8 API | frontier API |
| Weights | Apache-2.0 download | Apache-2.0 + API | API only | API only |
| Context | 262K native / 1M YaRN | 262K | この比較で最良 1M | この比較で最良 1M |
| Modality | text+image+video→text | text+image+video→text | text+image+video→text | multimodal API |
| OpenRouter $/1M | $0.45 / $3.20 | この比較で最良 $0.289 / $2.40 | $2.00 / $6.00 | $5.00 / $25.00 |
3.8-27Bと3.6-27Bの公開デコーダはほぼ同形(64層ハイブリッド、hidden 5120)。コーディングの跳ねは骨格変更より訓練側。MaxとOpusは別ライン:1Mホスト、トークン課金、重みは手元に来ない。3.8-27Bは両方:ダウンロードしてローカル、または同じ重みのホストAPI。
同じジョブ:ローカル約$0、ホスト約$0.11、Opus $1
画像を拡大 シナリオは100K入+20K出で固定。能力点ではなく「同じトークン仕事を誰に払うか」。
| Model | In $/1M | Out $/1M | 100K+20K | Role |
|---|---|---|---|---|
| 3.8-27B local | — | — | この比較で最良 ~$0 (electricity) | 24GB Q4 desk |
| Qwen3 Coder 30B A3B | この比較で最良 $0.07 | この比較で最良 $0.27 | $0.012 | cheap code API |
| Qwen3 Coder 480B | $0.30 | $1.00 | $0.050 | hosted code flagship |
| Qwen3.6-27B API | $0.289 | $2.40 | $0.077 | same-size predecessor |
| Qwen3.8-27B API | $0.45 | $3.20 | $0.109 | same weights, hosted |
| Qwen3.8-Max | $2.00 | $6.00 | $0.32 | same-gen cloud flagship |
| Claude Opus 4.6 | $5.00 | $25.00 | $1.00 | frontier coding API |
| GPT-5.6 Sol | $5.00 | $30.00 | $1.10 | OpenAI coding flagship |
読み方:Opus 4.6とGPT-5.6 Solはこの仕事で約$1。同世代Maxは約$0.32。3.8-27Bホストは約$0.11(前世代3.6-27Bの$0.077より少し高い)。ホストCoder旗艦は約$0.05。24GBカード上の同重みのトークン単価はゼロ——払うのは電気と償却。DeepSeek V4 Flash 0731は別極:284B MoE、$0.09/$0.18、安いが民生カードには載らない。
Coding:自家打ちではなくOpus 4.6と
Qwen起動表は3.8-27B、前世代3.6-27B、ホスト3.7-Plus、Claude Opus 4.6 Maxを同じ紙に置く。以下は表の転記。口径:自己評価。一部はClaude Code。SWE-ProのOpusは輸入公式点(*)。QwenSWEBenchは内部スイート。
| Benchmark | 3.8-27B | 3.6-27B | 3.7-Plus | Opus 4.6 Max |
|---|---|---|---|---|
| Terminal-Bench 2.1 | 73.0 | 63.4 | 64.0 | この比較で最良 78.2 |
| SWE-bench Pro* | この比較で最良 61.7 | 53.5 | 57.6 | 53.4 |
| LiveCodeBench v6 | この比較で最良 90.3 | 83.9 | 89.6 | 88.8 |
| OSWorld-Verified | この比較で最良 84.3 | 63.9 | 73.3 | 72.7 |
| QwenSWEBench | この比較で最良 79.0 | 49.3 | 59.2 | 63.8 |
| DeepSWE 1.1 | この比較で最良 42.2 | 13.3 | 14.2 | — |
| NL2Repo-Bench | 42.3 | 36.2 | 41.1 | この比較で最良 47.6 |
| GPQA Diamond | 89.2 | 87.8 | 90.3 | この比較で最良 91.3 |
一線との読み方:Opus 4.6に対しSWE-Pro・LiveCodeBench・OSWorld・QwenSWEBenchは先行または互角偏強。Terminal-Bench、NL2Repo、GPQAは遅れ。前世代比ではエージェントが断層(DeepSWE 13.3→42.2)。Plus API比でも多くのコーディング行で劣らない——しかもPlusはトークン課金、27Bは部屋を出られる。
表にCoder 480BもGPT-5.6 Solの同一走もない。61.7を「一線全勝」にしない。判断:画面を見て直す・倉庫を外に出さない → 24GB上の3.8-27Bが初めて準一線に見える。SLAと1Mホストが要る → Opus / Sol / Maxを払い続ける。
ハードウェア入門:今夜走らせる、いつかではない
画像を拡大 「走れる」では弱い。正確には:24GB民生GPU(4090級)は今夜、第三者4bitを載せ、8K–32Kでコーディングエージェントにできる。Opus 4.6は「載せる」ができない——重みが降りてこない。Coder 480B / V4 Flashはこの筐体の話ではない。
| Rig | Fits | Context to start | What you get | What you give up |
|---|---|---|---|---|
| 24GB consumer GPU | Q4_K_M ~17.1GB* | 8K–32K | Coding agent tonight | Opus never leaves the API |
| 32–48GB workstation | FP8 30.9GB | 32K–64K | Less quant damage | Still no download for Opus |
| 80GB-class card | BF16 55.6GB | native 262K is tight | Need KV budget (~16GiB @262K) | API still simpler |
| No local GPU | n/a | 262K–1M hosted | Pay OpenRouter | 3.8-27B $0.45/$3.20; Max $2/$6; Opus $5/$25 |
「17GBで載る」と「262K対応」を溶接しない。フル注意KVの262K BF16下限は約16GiB(16層分)。24GBで満窓は能力より先にVRAMが死ぬ。入門:8K–32Kにピンし、1M YaRNを切り、同じ失敗リポジトリ修復で量子化損失を見る。快適は48GB上のFP8。BF16+満262Kは80GB級。
低敷居の衝撃はここ:一線APIは$5/$25で永遠にダウンロード不可。この27BはゲーミングGPU1枚で机に乗る。量子化は推論を傷つける——衝撃は「始められる」ことであり、Opusと同等になったことではない。
サイト内ランキング:代理指標であり、このコーディング表ではない
本サイトの総合榜は長文脈と低単価を報酬し、SWEではない。本スナップショットで3.8-27B($0.45/$3.20あり)、3.6-27B、3.8-Max、Opus 4.6は「コードが強い」から上位に来ない。262K+中価格は1MのFlash枠に勝てない。
| On-site unified slot | Model | Why it ranks |
|---|---|---|
| #21 | Qwen3.7-Flash | 1M ctx + $0.03/$0.13 |
| #93 | Qwen3.5-Flash | 1M + cheap |
| #97 | Qwen3 Coder Flash | 1M code API, still cheap |
| #100 | Qwen3.7-Plus | 1M, $0.32/$1.28 |
| not on board | 3.8-27B / Opus 4.6 | listing ≠ 1M-cheap Flash slot / frontier sticker |
HF Hotは公式Qwen3.6-27Bをsort_index=45、DL約6,895,121。3.8-27Bは未掲載。総合榜はSWE 61.7では上がらない。能力ベンチマークではない。
27Bを選ぶとき、Opusを払い続けるとき
3.8-27Bを選ぶ:24GBカードがある、倉庫を外に出さない、画面を見る、自己評価表を受け入れられる。3.6-27Bのアップグレードとして同じ失敗テストでQ4を検証。カードがなければOpenRouter `qwen/qwen3.8-27b`($0.45/$3.20、同ジョブ約$0.11)——Opusより桁違いに安いが、Coder小モデルより高い。
Opus 4.6 / GPT-5.6 Solを払い続ける:SLAと1Mホストが要る、GPUを飼いたくない、輸入点/内部スイートのリスクを取れない。Max:同世代Qwen旗艦APIでOpusより安い($2/$6対$5/$25)。Coder 480B:テキストコードと出来合い262K APIだけ。
ホスト3.8-27Bを「最安の27B API」にしない——前世代3.6-27BやCoder 30Bの方が安い。24GB入門を満262Kと言わない。Token、比較、サイトのモデル頁で判断。