Qwen3.8-27B : une GPU grand public 24 Go face à la table code d’Opus 4.6

Dense 27.78B Apache-2.0. Q4 ~17 Go tient dans 24 Go grand public. Listing principal OpenRouter $0.45/$3.20. Table Qwen (auto-éval) : SWE-bench Pro 61.7 vs 53.4 importé d’Opus 4.6 Max ; Terminal-Bench 73.0 vs 78.2. 100K+20K : local ~$0, hébergé ~$0.11, Opus $1.00. Pas un benchmark indépendant.

Table de lancement Qwen : 3.8-27B vs 3.6-27B, 3.7-Plus, Opus 4.6 Max Agrandir l’image
Auto-évaluation. La case Opus de SWE-Pro est un score officiel importé, pas une relance à même harness.

Ce que c’est, et pourquoi cette table compte

Qwen3.8-27B : poids denses multimodaux Apache-2.0 du 2026-08-14, 27 781 427 952 paramètres, 262K natif. Ni Qwen3-8B, ni le Qwen3.8-Max API-only.

Le choc est le seuil. Un Q4_K_M tiers (~17,1 Go) tient dans une GPU 24 Go grand public : un agent de code ce soir, sur le bureau. Le comparateur est Claude Opus 4.6 : listing principal OpenRouter $5/$25, pas de poids à télécharger.

Les quatre barres viennent de la table Qwen. 3.8-27B bat Opus 4.6 Max sur SWE-Pro, LiveCodeBench et OSWorld ; perd 5,2 sur Terminal-Bench. C’est du marketing, pas une reproduction indépendante — et c’est quand même la comparaison à ficher.

Tableau de specs

D’abord les chiffres vérifiables. Les quatre colonnes viennent du catalogue et du listing principal OpenRouter (`qwen/qwen3.8-27b` à $0.45/$3.20).

3.8-27B 3.6-27B 3.8-Max Opus 4.6
Released 2026-08-14 (HF) catalog first_seen 2026-06-22 catalog first_seen 2026-08-04 in catalog
Params 27.78B dense ~27.8B dense flagship 3.8 API frontier API
Weights Apache-2.0 download Apache-2.0 + API API only API only
Context 262K native / 1M YaRN 262K Meilleur de cette comparaison 1M Meilleur de cette comparaison 1M
Modality text+image+video→text text+image+video→text text+image+video→text multimodal API
OpenRouter $/1M $0.45 / $3.20 Meilleur de cette comparaison $0.289 / $2.40 $2.00 / $6.00 $5.00 / $25.00

Le décodeur publié de 3.8-27B et 3.6-27B est presque identique (64 couches hybrides, hidden 5120). Le saut coding est de l’entraînement, pas un nouveau squelette. Max et Opus sont une autre ligne : 1M hébergé, facturé au token, vous ne possédez jamais les poids. 3.8-27B a les deux : local téléchargeable ou API hébergée sur les mêmes poids.

Le même job : local ~$0, hébergé ~$0.11, Opus $1

Coût USD de 100K entrée + 20K sortie Agrandir l’image
Listing principal OpenRouter. Local 3.8-27B : électricité seule ; hébergé mêmes poids ~$0.11.

Scénario figé 100K+20K. Ce n’est pas de la capacité : c’est à qui vous payez le même travail de tokens.

Model In $/1M Out $/1M 100K+20K Role
3.8-27B local Meilleur de cette comparaison ~$0 (electricity) 24GB Q4 desk
Qwen3 Coder 30B A3B Meilleur de cette comparaison $0.07 Meilleur de cette comparaison $0.27 $0.012 cheap code API
Qwen3 Coder 480B $0.30 $1.00 $0.050 hosted code flagship
Qwen3.6-27B API $0.289 $2.40 $0.077 same-size predecessor
Qwen3.8-27B API $0.45 $3.20 $0.109 same weights, hosted
Qwen3.8-Max $2.00 $6.00 $0.32 same-gen cloud flagship
Claude Opus 4.6 $5.00 $25.00 $1.00 frontier coding API
GPT-5.6 Sol $5.00 $30.00 $1.10 OpenAI coding flagship

Opus 4.6 et GPT-5.6 Sol : ~$1. Max de la même génération : ~$0.32. 3.8-27B hébergé : ~$0.11 (un peu au-dessus du prédécesseur 3.6-27B à $0.077). Coder fleuron hébergé : ~$0.05. Les mêmes poids sur votre GPU 24 Go : sticker token à zéro — vous payez l’électricité et l’amortissement. DeepSeek V4 Flash 0731 est l’autre extrême : MoE 284B à $0.09/$0.18, pas un téléchargement grand public.

Coding : contre Opus 4.6, pas seulement la famille

La table de lancement Qwen aligne 3.8-27B, le prédécesseur 3.6-27B, le Plus hébergé et Claude Opus 4.6 Max. Auto-éval ; plusieurs lignes sous Claude Code ; la case Opus de SWE-Pro est officielle importée (*) ; QwenSWEBench est interne.

Benchmark 3.8-27B 3.6-27B 3.7-Plus Opus 4.6 Max
Terminal-Bench 2.1 73.0 63.4 64.0 Meilleur de cette comparaison 78.2
SWE-bench Pro* Meilleur de cette comparaison 61.7 53.5 57.6 53.4
LiveCodeBench v6 Meilleur de cette comparaison 90.3 83.9 89.6 88.8
OSWorld-Verified Meilleur de cette comparaison 84.3 63.9 73.3 72.7
QwenSWEBench Meilleur de cette comparaison 79.0 49.3 59.2 63.8
DeepSWE 1.1 Meilleur de cette comparaison 42.2 13.3 14.2
NL2Repo-Bench 42.3 36.2 41.1 Meilleur de cette comparaison 47.6
GPQA Diamond 89.2 87.8 90.3 Meilleur de cette comparaison 91.3

Lecture face à la première ligne : vs Opus 4.6, le 27B gagne ou égalise vers le haut sur SWE-Pro, LiveCodeBench, OSWorld et QwenSWEBench ; perd Terminal-Bench, NL2Repo et GPQA. Vs 3.6-27B, l’agent est une rupture (DeepSWE 13.3→42.2). Vs Plus, le dense 27B ne chute pas sur la plupart des lignes code — et Plus se paie au token.

Pas de Coder 480B ni de GPT-5.6 Sol sur le même harness. N’érigez pas 61.7 en victoire universelle. Décidez : UI avec captures et dépôt privé → 3.8-27B sur 24 Go a enfin l’air quasi première ligne. SLA et 1M hébergé → continuez de payer Opus / Sol / Max.

Matériel d’entrée : ce soir, pas « un jour »

Empreinte des poids vs la ligne 24 Go grand public Agrandir l’image
Poids seulement. Le KV est à part. Q4 = Unsloth tiers. ~149 Go de V4 Flash = serving public.

« Ça tourne » est trop faible. Phrase exacte : une GPU 24 Go grand public (classe 4090) charge un 4bit tiers ce soir et sert d’agent de code à 8K–32K. Opus 4.6 ne se « charge » pas : il ne vous donne pas les poids. Coder 480B / V4 Flash ne rentrent pas dans ce boîtier.

Rig Fits Context to start What you get What you give up
24GB consumer GPU Q4_K_M ~17.1GB* 8K–32K Coding agent tonight Opus never leaves the API
32–48GB workstation FP8 30.9GB 32K–64K Less quant damage Still no download for Opus
80GB-class card BF16 55.6GB native 262K is tight Need KV budget (~16GiB @262K) API still simpler
No local GPU n/a 262K–1M hosted Pay OpenRouter 3.8-27B $0.45/$3.20; Max $2/$6; Opus $5/$25

Ne soudez pas « tient en 17 Go » avec « supporte 262K ». Le KV pleine attention à 262K BF16 fait ~16 GiB (16 couches seulement). À 24 Go, la fenêtre pleine tue la VRAM avant la capacité. Protocole d’entrée : 8K–32K, pas de YaRN 1M, les mêmes tests de réparation de dépôt. Confort : FP8 sur 48 Go. BF16 à 262K plein : classe 80 Go.

Voilà le seuil bas : l’API première ligne coûte $5/$25 et ne se télécharge jamais. Ce 27B s’assoit sur une GPU de jeu. La quantification blesse le reasoning — le choc est de pouvoir commencer, pas d’égaler Opus.

Classement du site : proxy, pas cette table code

Le classement composite du site récompense le long contexte et le bas prix, pas le SWE. Dans ce snapshot, 3.8-27B (déjà à $0.45/$3.20), 3.6-27B, 3.8-Max et Opus 4.6 ne montent pas parce qu’ils « codent bien » : 262K à prix moyen ne bat pas le slot Flash 1M.

On-site unified slot Model Why it ranks
#21 Qwen3.7-Flash 1M ctx + $0.03/$0.13
#93 Qwen3.5-Flash 1M + cheap
#97 Qwen3 Coder Flash 1M code API, still cheap
#100 Qwen3.7-Plus 1M, $0.32/$1.28
not on board 3.8-27B / Opus 4.6 listing ≠ 1M-cheap Flash slot / frontier sticker

HF Hot garde Qwen3.6-27B officiel à sort_index=45 (~6 895 121 DL). 3.8-27B n’y est pas. Le composite ne montera pas grâce à un 61.7 SWE. Pas un benchmark de capacité.

Quand choisir le 27B, quand continuer à payer Opus

Choisir 3.8-27B : vous avez une GPU 24 Go, le dépôt ne sort pas, vous devez voir les écrans, vous acceptez la table vendor. Contrastez-le à 3.6-27B sur les mêmes tests ; mesurez le Q4. Sans GPU, OpenRouter `qwen/qwen3.8-27b` ($0.45/$3.20, ~$0.11 le même job) — un ordre de grandeur moins cher qu’Opus, encore plus cher que le petit Coder.

Continuer à payer Opus 4.6 / GPT-5.6 Sol : SLA, 1M hébergé, pas de GPU, pas d’avaler le risque des scores importés. Payer Max : fleuron Qwen de la même génération moins cher qu’Opus ($2/$6 vs $5/$25). Payer Coder 480B : texte seul et API 262K prête.

Pas « le 27B API le moins cher » — le prédécesseur 3.6-27B et Coder 30B sont moins chers. Pas de 24 Go d’entrée = 262K plein. Tranchez avec Token, compare et la page modèle.

Insights