Qwen3.8-27B : une GPU grand public 24 Go face à la table code d’Opus 4.6
Dense 27.78B Apache-2.0. Q4 ~17 Go tient dans 24 Go grand public. Listing principal OpenRouter $0.45/$3.20. Table Qwen (auto-éval) : SWE-bench Pro 61.7 vs 53.4 importé d’Opus 4.6 Max ; Terminal-Bench 73.0 vs 78.2. 100K+20K : local ~$0, hébergé ~$0.11, Opus $1.00. Pas un benchmark indépendant.
Agrandir l’image Ce que c’est, et pourquoi cette table compte
Qwen3.8-27B : poids denses multimodaux Apache-2.0 du 2026-08-14, 27 781 427 952 paramètres, 262K natif. Ni Qwen3-8B, ni le Qwen3.8-Max API-only.
Le choc est le seuil. Un Q4_K_M tiers (~17,1 Go) tient dans une GPU 24 Go grand public : un agent de code ce soir, sur le bureau. Le comparateur est Claude Opus 4.6 : listing principal OpenRouter $5/$25, pas de poids à télécharger.
Les quatre barres viennent de la table Qwen. 3.8-27B bat Opus 4.6 Max sur SWE-Pro, LiveCodeBench et OSWorld ; perd 5,2 sur Terminal-Bench. C’est du marketing, pas une reproduction indépendante — et c’est quand même la comparaison à ficher.
Tableau de specs
D’abord les chiffres vérifiables. Les quatre colonnes viennent du catalogue et du listing principal OpenRouter (`qwen/qwen3.8-27b` à $0.45/$3.20).
| 3.8-27B | 3.6-27B | 3.8-Max | Opus 4.6 | |
|---|---|---|---|---|
| Released | 2026-08-14 (HF) | catalog first_seen 2026-06-22 | catalog first_seen 2026-08-04 | in catalog |
| Params | 27.78B dense | ~27.8B dense | flagship 3.8 API | frontier API |
| Weights | Apache-2.0 download | Apache-2.0 + API | API only | API only |
| Context | 262K native / 1M YaRN | 262K | Meilleur de cette comparaison 1M | Meilleur de cette comparaison 1M |
| Modality | text+image+video→text | text+image+video→text | text+image+video→text | multimodal API |
| OpenRouter $/1M | $0.45 / $3.20 | Meilleur de cette comparaison $0.289 / $2.40 | $2.00 / $6.00 | $5.00 / $25.00 |
Le décodeur publié de 3.8-27B et 3.6-27B est presque identique (64 couches hybrides, hidden 5120). Le saut coding est de l’entraînement, pas un nouveau squelette. Max et Opus sont une autre ligne : 1M hébergé, facturé au token, vous ne possédez jamais les poids. 3.8-27B a les deux : local téléchargeable ou API hébergée sur les mêmes poids.
Le même job : local ~$0, hébergé ~$0.11, Opus $1
Agrandir l’image Scénario figé 100K+20K. Ce n’est pas de la capacité : c’est à qui vous payez le même travail de tokens.
| Model | In $/1M | Out $/1M | 100K+20K | Role |
|---|---|---|---|---|
| 3.8-27B local | — | — | Meilleur de cette comparaison ~$0 (electricity) | 24GB Q4 desk |
| Qwen3 Coder 30B A3B | Meilleur de cette comparaison $0.07 | Meilleur de cette comparaison $0.27 | $0.012 | cheap code API |
| Qwen3 Coder 480B | $0.30 | $1.00 | $0.050 | hosted code flagship |
| Qwen3.6-27B API | $0.289 | $2.40 | $0.077 | same-size predecessor |
| Qwen3.8-27B API | $0.45 | $3.20 | $0.109 | same weights, hosted |
| Qwen3.8-Max | $2.00 | $6.00 | $0.32 | same-gen cloud flagship |
| Claude Opus 4.6 | $5.00 | $25.00 | $1.00 | frontier coding API |
| GPT-5.6 Sol | $5.00 | $30.00 | $1.10 | OpenAI coding flagship |
Opus 4.6 et GPT-5.6 Sol : ~$1. Max de la même génération : ~$0.32. 3.8-27B hébergé : ~$0.11 (un peu au-dessus du prédécesseur 3.6-27B à $0.077). Coder fleuron hébergé : ~$0.05. Les mêmes poids sur votre GPU 24 Go : sticker token à zéro — vous payez l’électricité et l’amortissement. DeepSeek V4 Flash 0731 est l’autre extrême : MoE 284B à $0.09/$0.18, pas un téléchargement grand public.
Coding : contre Opus 4.6, pas seulement la famille
La table de lancement Qwen aligne 3.8-27B, le prédécesseur 3.6-27B, le Plus hébergé et Claude Opus 4.6 Max. Auto-éval ; plusieurs lignes sous Claude Code ; la case Opus de SWE-Pro est officielle importée (*) ; QwenSWEBench est interne.
| Benchmark | 3.8-27B | 3.6-27B | 3.7-Plus | Opus 4.6 Max |
|---|---|---|---|---|
| Terminal-Bench 2.1 | 73.0 | 63.4 | 64.0 | Meilleur de cette comparaison 78.2 |
| SWE-bench Pro* | Meilleur de cette comparaison 61.7 | 53.5 | 57.6 | 53.4 |
| LiveCodeBench v6 | Meilleur de cette comparaison 90.3 | 83.9 | 89.6 | 88.8 |
| OSWorld-Verified | Meilleur de cette comparaison 84.3 | 63.9 | 73.3 | 72.7 |
| QwenSWEBench | Meilleur de cette comparaison 79.0 | 49.3 | 59.2 | 63.8 |
| DeepSWE 1.1 | Meilleur de cette comparaison 42.2 | 13.3 | 14.2 | — |
| NL2Repo-Bench | 42.3 | 36.2 | 41.1 | Meilleur de cette comparaison 47.6 |
| GPQA Diamond | 89.2 | 87.8 | 90.3 | Meilleur de cette comparaison 91.3 |
Lecture face à la première ligne : vs Opus 4.6, le 27B gagne ou égalise vers le haut sur SWE-Pro, LiveCodeBench, OSWorld et QwenSWEBench ; perd Terminal-Bench, NL2Repo et GPQA. Vs 3.6-27B, l’agent est une rupture (DeepSWE 13.3→42.2). Vs Plus, le dense 27B ne chute pas sur la plupart des lignes code — et Plus se paie au token.
Pas de Coder 480B ni de GPT-5.6 Sol sur le même harness. N’érigez pas 61.7 en victoire universelle. Décidez : UI avec captures et dépôt privé → 3.8-27B sur 24 Go a enfin l’air quasi première ligne. SLA et 1M hébergé → continuez de payer Opus / Sol / Max.
Matériel d’entrée : ce soir, pas « un jour »
Agrandir l’image « Ça tourne » est trop faible. Phrase exacte : une GPU 24 Go grand public (classe 4090) charge un 4bit tiers ce soir et sert d’agent de code à 8K–32K. Opus 4.6 ne se « charge » pas : il ne vous donne pas les poids. Coder 480B / V4 Flash ne rentrent pas dans ce boîtier.
| Rig | Fits | Context to start | What you get | What you give up |
|---|---|---|---|---|
| 24GB consumer GPU | Q4_K_M ~17.1GB* | 8K–32K | Coding agent tonight | Opus never leaves the API |
| 32–48GB workstation | FP8 30.9GB | 32K–64K | Less quant damage | Still no download for Opus |
| 80GB-class card | BF16 55.6GB | native 262K is tight | Need KV budget (~16GiB @262K) | API still simpler |
| No local GPU | n/a | 262K–1M hosted | Pay OpenRouter | 3.8-27B $0.45/$3.20; Max $2/$6; Opus $5/$25 |
Ne soudez pas « tient en 17 Go » avec « supporte 262K ». Le KV pleine attention à 262K BF16 fait ~16 GiB (16 couches seulement). À 24 Go, la fenêtre pleine tue la VRAM avant la capacité. Protocole d’entrée : 8K–32K, pas de YaRN 1M, les mêmes tests de réparation de dépôt. Confort : FP8 sur 48 Go. BF16 à 262K plein : classe 80 Go.
Voilà le seuil bas : l’API première ligne coûte $5/$25 et ne se télécharge jamais. Ce 27B s’assoit sur une GPU de jeu. La quantification blesse le reasoning — le choc est de pouvoir commencer, pas d’égaler Opus.
Classement du site : proxy, pas cette table code
Le classement composite du site récompense le long contexte et le bas prix, pas le SWE. Dans ce snapshot, 3.8-27B (déjà à $0.45/$3.20), 3.6-27B, 3.8-Max et Opus 4.6 ne montent pas parce qu’ils « codent bien » : 262K à prix moyen ne bat pas le slot Flash 1M.
| On-site unified slot | Model | Why it ranks |
|---|---|---|
| #21 | Qwen3.7-Flash | 1M ctx + $0.03/$0.13 |
| #93 | Qwen3.5-Flash | 1M + cheap |
| #97 | Qwen3 Coder Flash | 1M code API, still cheap |
| #100 | Qwen3.7-Plus | 1M, $0.32/$1.28 |
| not on board | 3.8-27B / Opus 4.6 | listing ≠ 1M-cheap Flash slot / frontier sticker |
HF Hot garde Qwen3.6-27B officiel à sort_index=45 (~6 895 121 DL). 3.8-27B n’y est pas. Le composite ne montera pas grâce à un 61.7 SWE. Pas un benchmark de capacité.
Quand choisir le 27B, quand continuer à payer Opus
Choisir 3.8-27B : vous avez une GPU 24 Go, le dépôt ne sort pas, vous devez voir les écrans, vous acceptez la table vendor. Contrastez-le à 3.6-27B sur les mêmes tests ; mesurez le Q4. Sans GPU, OpenRouter `qwen/qwen3.8-27b` ($0.45/$3.20, ~$0.11 le même job) — un ordre de grandeur moins cher qu’Opus, encore plus cher que le petit Coder.
Continuer à payer Opus 4.6 / GPT-5.6 Sol : SLA, 1M hébergé, pas de GPU, pas d’avaler le risque des scores importés. Payer Max : fleuron Qwen de la même génération moins cher qu’Opus ($2/$6 vs $5/$25). Payer Coder 480B : texte seul et API 262K prête.
Pas « le 27B API le moins cher » — le prédécesseur 3.6-27B et Coder 30B sont moins chers. Pas de 24 Go d’entrée = 262K plein. Tranchez avec Token, compare et la page modèle.