Qwen3.8-27B:24GB民生GPUでOpus 4.6のコーディング表に並ぶ

Apache-2.0密27.78B。Q4約17GBで24GB民生GPUに載る。OpenRouter主listing $0.45/$3.20。Qwen起動表(自己評価)SWE-bench Pro 61.7対Opus 4.6 Max輸入点53.4。Terminal-Bench 73.0対78.2。100K+20K:ローカル約$0、ホスト約$0.11、Opus $1.00。独立ベンチマークではない。

Qwen起動表:3.8-27B対3.6-27B、3.7-Plus、Opus 4.6 Max 画像を拡大
自己評価。SWE-ProのOpus欄は輸入公式点であり、同一ハーネスの再走ではない。

何か、そしてこの表が怖い理由

Qwen3.8-27Bは2026-08-14公開のApache-2.0密マルチモーダル。HFは27,781,427,952パラメータ、262Kネイティブ。Qwen3-8Bでも、API専用のQwen3.8-Maxでもない。

驚きは「また27B」ではなく敷居。第三者Q4_K_M約17.1GBは24GB民生GPUに載る。今夜デスクでコーディングエージェントを起動できる。対照はClaude Opus 4.6:OpenRouter主listing $5/$25、重みは降りてこない。

図の4指標はQwen自身の起動表。SWE-Pro・LiveCodeBench・OSWorldでは表内のOpus 4.6 Maxを上回り、Terminal-Benchは5.2点遅れ。宣伝口径だが、「準一線の点を民生カードで」が本記事の軸。

スペック対照表

照合できる数字を先に並べる。4列ともカタログとOpenRouter主listing(`qwen/qwen3.8-27b` は現在 $0.45/$3.20)。

3.8-27B 3.6-27B 3.8-Max Opus 4.6
Released 2026-08-14 (HF) catalog first_seen 2026-06-22 catalog first_seen 2026-08-04 in catalog
Params 27.78B dense ~27.8B dense flagship 3.8 API frontier API
Weights Apache-2.0 download Apache-2.0 + API API only API only
Context 262K native / 1M YaRN 262K この比較で最良 1M この比較で最良 1M
Modality text+image+video→text text+image+video→text text+image+video→text multimodal API
OpenRouter $/1M $0.45 / $3.20 この比較で最良 $0.289 / $2.40 $2.00 / $6.00 $5.00 / $25.00

3.8-27Bと3.6-27Bの公開デコーダはほぼ同形(64層ハイブリッド、hidden 5120)。コーディングの跳ねは骨格変更より訓練側。MaxとOpusは別ライン:1Mホスト、トークン課金、重みは手元に来ない。3.8-27Bは両方:ダウンロードしてローカル、または同じ重みのホストAPI。

同じジョブ:ローカル約$0、ホスト約$0.11、Opus $1

100K入力+20K出力のUSDコスト 画像を拡大
OpenRouter主listing。ローカル3.8-27Bは電気のみ。ホスト同重みは約$0.11。

シナリオは100K入+20K出で固定。能力点ではなく「同じトークン仕事を誰に払うか」。

Model In $/1M Out $/1M 100K+20K Role
3.8-27B local この比較で最良 ~$0 (electricity) 24GB Q4 desk
Qwen3 Coder 30B A3B この比較で最良 $0.07 この比較で最良 $0.27 $0.012 cheap code API
Qwen3 Coder 480B $0.30 $1.00 $0.050 hosted code flagship
Qwen3.6-27B API $0.289 $2.40 $0.077 same-size predecessor
Qwen3.8-27B API $0.45 $3.20 $0.109 same weights, hosted
Qwen3.8-Max $2.00 $6.00 $0.32 same-gen cloud flagship
Claude Opus 4.6 $5.00 $25.00 $1.00 frontier coding API
GPT-5.6 Sol $5.00 $30.00 $1.10 OpenAI coding flagship

読み方:Opus 4.6とGPT-5.6 Solはこの仕事で約$1。同世代Maxは約$0.32。3.8-27Bホストは約$0.11(前世代3.6-27Bの$0.077より少し高い)。ホストCoder旗艦は約$0.05。24GBカード上の同重みのトークン単価はゼロ——払うのは電気と償却。DeepSeek V4 Flash 0731は別極:284B MoE、$0.09/$0.18、安いが民生カードには載らない。

Coding:自家打ちではなくOpus 4.6と

Qwen起動表は3.8-27B、前世代3.6-27B、ホスト3.7-Plus、Claude Opus 4.6 Maxを同じ紙に置く。以下は表の転記。口径:自己評価。一部はClaude Code。SWE-ProのOpusは輸入公式点(*)。QwenSWEBenchは内部スイート。

Benchmark 3.8-27B 3.6-27B 3.7-Plus Opus 4.6 Max
Terminal-Bench 2.1 73.0 63.4 64.0 この比較で最良 78.2
SWE-bench Pro* この比較で最良 61.7 53.5 57.6 53.4
LiveCodeBench v6 この比較で最良 90.3 83.9 89.6 88.8
OSWorld-Verified この比較で最良 84.3 63.9 73.3 72.7
QwenSWEBench この比較で最良 79.0 49.3 59.2 63.8
DeepSWE 1.1 この比較で最良 42.2 13.3 14.2
NL2Repo-Bench 42.3 36.2 41.1 この比較で最良 47.6
GPQA Diamond 89.2 87.8 90.3 この比較で最良 91.3

一線との読み方:Opus 4.6に対しSWE-Pro・LiveCodeBench・OSWorld・QwenSWEBenchは先行または互角偏強。Terminal-Bench、NL2Repo、GPQAは遅れ。前世代比ではエージェントが断層(DeepSWE 13.3→42.2)。Plus API比でも多くのコーディング行で劣らない——しかもPlusはトークン課金、27Bは部屋を出られる。

表にCoder 480BもGPT-5.6 Solの同一走もない。61.7を「一線全勝」にしない。判断:画面を見て直す・倉庫を外に出さない → 24GB上の3.8-27Bが初めて準一線に見える。SLAと1Mホストが要る → Opus / Sol / Maxを払い続ける。

ハードウェア入門:今夜走らせる、いつかではない

重み体積と24GB民生GPUの参照線 画像を拡大
重みのみ。KVは別。Q4はUnsloth第三者。V4 Flash約149GBは公開serving口径。

「走れる」では弱い。正確には:24GB民生GPU(4090級)は今夜、第三者4bitを載せ、8K–32Kでコーディングエージェントにできる。Opus 4.6は「載せる」ができない——重みが降りてこない。Coder 480B / V4 Flashはこの筐体の話ではない。

Rig Fits Context to start What you get What you give up
24GB consumer GPU Q4_K_M ~17.1GB* 8K–32K Coding agent tonight Opus never leaves the API
32–48GB workstation FP8 30.9GB 32K–64K Less quant damage Still no download for Opus
80GB-class card BF16 55.6GB native 262K is tight Need KV budget (~16GiB @262K) API still simpler
No local GPU n/a 262K–1M hosted Pay OpenRouter 3.8-27B $0.45/$3.20; Max $2/$6; Opus $5/$25

「17GBで載る」と「262K対応」を溶接しない。フル注意KVの262K BF16下限は約16GiB(16層分)。24GBで満窓は能力より先にVRAMが死ぬ。入門:8K–32Kにピンし、1M YaRNを切り、同じ失敗リポジトリ修復で量子化損失を見る。快適は48GB上のFP8。BF16+満262Kは80GB級。

低敷居の衝撃はここ:一線APIは$5/$25で永遠にダウンロード不可。この27BはゲーミングGPU1枚で机に乗る。量子化は推論を傷つける——衝撃は「始められる」ことであり、Opusと同等になったことではない。

サイト内ランキング:代理指標であり、このコーディング表ではない

本サイトの総合榜は長文脈と低単価を報酬し、SWEではない。本スナップショットで3.8-27B($0.45/$3.20あり)、3.6-27B、3.8-Max、Opus 4.6は「コードが強い」から上位に来ない。262K+中価格は1MのFlash枠に勝てない。

On-site unified slot Model Why it ranks
#21 Qwen3.7-Flash 1M ctx + $0.03/$0.13
#93 Qwen3.5-Flash 1M + cheap
#97 Qwen3 Coder Flash 1M code API, still cheap
#100 Qwen3.7-Plus 1M, $0.32/$1.28
not on board 3.8-27B / Opus 4.6 listing ≠ 1M-cheap Flash slot / frontier sticker

HF Hotは公式Qwen3.6-27Bをsort_index=45、DL約6,895,121。3.8-27Bは未掲載。総合榜はSWE 61.7では上がらない。能力ベンチマークではない。

27Bを選ぶとき、Opusを払い続けるとき

3.8-27Bを選ぶ:24GBカードがある、倉庫を外に出さない、画面を見る、自己評価表を受け入れられる。3.6-27Bのアップグレードとして同じ失敗テストでQ4を検証。カードがなければOpenRouter `qwen/qwen3.8-27b`($0.45/$3.20、同ジョブ約$0.11)——Opusより桁違いに安いが、Coder小モデルより高い。

Opus 4.6 / GPT-5.6 Solを払い続ける:SLAと1Mホストが要る、GPUを飼いたくない、輸入点/内部スイートのリスクを取れない。Max:同世代Qwen旗艦APIでOpusより安い($2/$6対$5/$25)。Coder 480B:テキストコードと出来合い262K APIだけ。

ホスト3.8-27Bを「最安の27B API」にしない——前世代3.6-27BやCoder 30Bの方が安い。24GB入門を満262Kと言わない。Token、比較、サイトのモデル頁で判断。

インサイト