Qwen3.8-27B: eine 24GB-Consumer-GPU gegen die Coding-Tabelle von Opus 4.6
Dichtes 27.78B Apache-2.0. Q4 ~17GB passt in 24GB Consumer. OpenRouter-Hauptlisting $0.45/$3.20. Qwen-Starttabelle (Selbsttest): SWE-bench Pro 61.7 vs 53.4 importiert von Opus 4.6 Max; Terminal-Bench 73.0 vs 78.2. 100K+20K: lokal ~$0, gehostet ~$0.11, Opus $1.00. Kein unabhängiger Benchmark.
Bild vergrößern Was es ist — und warum diese Tabelle zählt
Qwen3.8-27B sind dichte multimodale Apache-2.0-Gewichte vom 2026-08-14: 27.781.427.952 Parameter, nativ 262K. Weder Qwen3-8B noch das API-only Qwen3.8-Max.
Der Schock ist die Schwelle. Ein Dritt-Q4_K_M (~17,1GB) passt in eine 24GB-Consumer-GPU: Coding-Agent heute Abend auf dem Schreibtisch. Vergleich: Claude Opus 4.6, OpenRouter-Hauptlisting $5/$25, keine herunterladbaren Gewichte.
Die vier Balken stammen aus Qwens Tabelle. 3.8-27B liegt bei SWE-Pro, LiveCodeBench und OSWorld über Opus 4.6 Max; Terminal-Bench −5,2. Marketing, keine unabhängige Reproduktion — und trotzdem die Gegenüberstellung, die sitzen muss.
Spezifikations-Tabelle
Zuerst die prüfbaren Zahlen. Alle vier Spalten kommen aus Katalog und OpenRouter-Hauptlisting (`qwen/qwen3.8-27b` jetzt $0.45/$3.20).
| 3.8-27B | 3.6-27B | 3.8-Max | Opus 4.6 | |
|---|---|---|---|---|
| Released | 2026-08-14 (HF) | catalog first_seen 2026-06-22 | catalog first_seen 2026-08-04 | in catalog |
| Params | 27.78B dense | ~27.8B dense | flagship 3.8 API | frontier API |
| Weights | Apache-2.0 download | Apache-2.0 + API | API only | API only |
| Context | 262K native / 1M YaRN | 262K | Bestwert in diesem Vergleich 1M | Bestwert in diesem Vergleich 1M |
| Modality | text+image+video→text | text+image+video→text | text+image+video→text | multimodal API |
| OpenRouter $/1M | $0.45 / $3.20 | Bestwert in diesem Vergleich $0.289 / $2.40 | $2.00 / $6.00 | $5.00 / $25.00 |
Der veröffentlichte Decoder von 3.8-27B und 3.6-27B ist fast gleich (64 Hybrid-Schichten, Hidden 5120). Der Coding-Sprung ist Training, kein neues Skelett. Max und Opus sind eine andere Linie: 1M gehostet, Token-Preis, die Gewichte gehören Ihnen nie. 3.8-27B hat beides: lokal herunterladbar oder gehostete API auf denselben Gewichten.
Derselbe Job: lokal ~$0, gehostet ~$0.11, Opus $1
Bild vergrößern Szenario fest 100K+20K. Keine Fähigkeit: wem Sie denselben Token-Job zahlen.
| Model | In $/1M | Out $/1M | 100K+20K | Role |
|---|---|---|---|---|
| 3.8-27B local | — | — | Bestwert in diesem Vergleich ~$0 (electricity) | 24GB Q4 desk |
| Qwen3 Coder 30B A3B | Bestwert in diesem Vergleich $0.07 | Bestwert in diesem Vergleich $0.27 | $0.012 | cheap code API |
| Qwen3 Coder 480B | $0.30 | $1.00 | $0.050 | hosted code flagship |
| Qwen3.6-27B API | $0.289 | $2.40 | $0.077 | same-size predecessor |
| Qwen3.8-27B API | $0.45 | $3.20 | $0.109 | same weights, hosted |
| Qwen3.8-Max | $2.00 | $6.00 | $0.32 | same-gen cloud flagship |
| Claude Opus 4.6 | $5.00 | $25.00 | $1.00 | frontier coding API |
| GPT-5.6 Sol | $5.00 | $30.00 | $1.10 | OpenAI coding flagship |
Opus 4.6 und GPT-5.6 Sol: ~$1. Max derselben Generation: ~$0.32. 3.8-27B gehostet: ~$0.11 (etwas teurer als Vorgänger 3.6-27B mit $0.077). Gehostetes Coder-Flaggschiff: ~$0.05. Dieselben Gewichte auf Ihrer 24GB-Karte: Token-Sticker null — Sie zahlen Strom und Abschreibung. DeepSeek V4 Flash 0731 ist das andere Extrem: 284B-MoE zu $0.09/$0.18, kein Consumer-Download.
Coding: gegen Opus 4.6, nicht nur die Familie
Qwens Starttabelle legt 3.8-27B, Vorgänger 3.6-27B, gehostetes Plus und Claude Opus 4.6 Max auf ein Blatt. Selbsttest; mehrere Zeilen unter Claude Code; Opus-SWE-Pro ist importiert (*); QwenSWEBench intern.
| Benchmark | 3.8-27B | 3.6-27B | 3.7-Plus | Opus 4.6 Max |
|---|---|---|---|---|
| Terminal-Bench 2.1 | 73.0 | 63.4 | 64.0 | Bestwert in diesem Vergleich 78.2 |
| SWE-bench Pro* | Bestwert in diesem Vergleich 61.7 | 53.5 | 57.6 | 53.4 |
| LiveCodeBench v6 | Bestwert in diesem Vergleich 90.3 | 83.9 | 89.6 | 88.8 |
| OSWorld-Verified | Bestwert in diesem Vergleich 84.3 | 63.9 | 73.3 | 72.7 |
| QwenSWEBench | Bestwert in diesem Vergleich 79.0 | 49.3 | 59.2 | 63.8 |
| DeepSWE 1.1 | Bestwert in diesem Vergleich 42.2 | 13.3 | 14.2 | — |
| NL2Repo-Bench | 42.3 | 36.2 | 41.1 | Bestwert in diesem Vergleich 47.6 |
| GPQA Diamond | 89.2 | 87.8 | 90.3 | Bestwert in diesem Vergleich 91.3 |
Lesart gegen die erste Liga: vs Opus 4.6 führt oder liegt das 27B bei SWE-Pro, LiveCodeBench, OSWorld und QwenSWEBench vorn; Terminal-Bench, NL2Repo, GPQA hinten. Vs 3.6-27B ist der Agent ein Bruch (DeepSWE 13.3→42.2). Vs Plus hält das dichte 27B die meisten Code-Zeilen — Plus wird pro Token bezahlt.
Kein Coder 480B, kein GPT-5.6 Sol im selben Harness. Machen Sie aus 61.7 keinen Universal-Sieg. Entscheidung: UI mit Screenshots, privates Repo → 3.8-27B auf 24GB sieht erstmals nach Near-Frontier aus. SLA und 1M gehostet → weiter Opus / Sol / Max zahlen.
Einstiegshardware: heute Abend, nicht irgendwann
Bild vergrößern «Läuft» ist zu weich. Der genaue Satz: eine 24GB-Consumer-GPU (4090-Klasse) lädt heute Abend ein 4bit von Dritten und dient als Coding-Agent bei 8K–32K. Opus 4.6 «lädt» man nicht — Sie bekommen keine Gewichte. Coder 480B / V4 Flash passen nicht in dieses Gehäuse.
| Rig | Fits | Context to start | What you get | What you give up |
|---|---|---|---|---|
| 24GB consumer GPU | Q4_K_M ~17.1GB* | 8K–32K | Coding agent tonight | Opus never leaves the API |
| 32–48GB workstation | FP8 30.9GB | 32K–64K | Less quant damage | Still no download for Opus |
| 80GB-class card | BF16 55.6GB | native 262K is tight | Need KV budget (~16GiB @262K) | API still simpler |
| No local GPU | n/a | 262K–1M hosted | Pay OpenRouter | 3.8-27B $0.45/$3.20; Max $2/$6; Opus $5/$25 |
Schweißen Sie nicht «passt in 17GB» an «unterstützt 262K». Die Full-Attention-KV-Untergrenze bei 262K BF16 ist ~16GiB (nur 16 Schichten). Auf 24GB stirbt zuerst VRAM. Einstieg: 8K–32K, kein 1M-YaRN, dieselben Repo-Fixes. Komfort: FP8 auf 48GB. BF16 bei vollem 262K: 80GB-Klasse.
Das ist die niedrige Schwelle: First-Line-API kostet $5/$25 und wird nie heruntergeladen. Dieses 27B sitzt auf einer Gaming-GPU. Quantisierung verletzt Reasoning — der Schock ist anfangen zu können, nicht Opus zu sein.
Site-Ranking: Proxy, nicht diese Coding-Tabelle
Das Composite der Site belohnt langen Kontext und niedrigen Preis, nicht SWE. In diesem Snapshot steigen 3.8-27B (bereits $0.45/$3.20), 3.6-27B, 3.8-Max und Opus 4.6 nicht, weil sie «gut coden» — 262K zum Mittelpreis schlägt keinen 1M-Flash-Slot.
| On-site unified slot | Model | Why it ranks |
|---|---|---|
| #21 | Qwen3.7-Flash | 1M ctx + $0.03/$0.13 |
| #93 | Qwen3.5-Flash | 1M + cheap |
| #97 | Qwen3 Coder Flash | 1M code API, still cheap |
| #100 | Qwen3.7-Plus | 1M, $0.32/$1.28 |
| not on board | 3.8-27B / Opus 4.6 | listing ≠ 1M-cheap Flash slot / frontier sticker |
HF Hot hält offizielles Qwen3.6-27B bei sort_index=45 (~6.895.121 Downloads). 3.8-27B fehlt. Das Composite steigt nicht wegen SWE 61.7. Kein Fähigkeits-Benchmark.
Wann 27B, wann weiter Opus zahlen
3.8-27B wählen: 24GB-Karte da, Repo bleibt drin, Bildschirme nötig, Vendor-Tabelle akzeptabel. Gegen 3.6-27B auf denselben Tests; Q4 messen. Ohne Karte: OpenRouter `qwen/qwen3.8-27b` ($0.45/$3.20, ~$0.11 derselbe Job) — eine Größenordnung billiger als Opus, teurer als kleines Coder.
Weiter Opus 4.6 / GPT-5.6 Sol zahlen: SLA, 1M gehostet, keine GPU, kein Risiko importierter Scores. Max zahlen: Qwen-Flaggschiff derselben Generation günstiger als Opus ($2/$6 vs $5/$25). Coder 480B: nur Text, fertige 262K-API.
Nicht als «günstigstes 27B-API» — Vorgänger 3.6-27B und Coder 30B sind billiger. 24GB-Einstieg ist nicht volles 262K. Entscheiden mit Token, Compare und der Modellseite.