Qwen3.8-27B: eine 24GB-Consumer-GPU gegen die Coding-Tabelle von Opus 4.6

Dichtes 27.78B Apache-2.0. Q4 ~17GB passt in 24GB Consumer. OpenRouter-Hauptlisting $0.45/$3.20. Qwen-Starttabelle (Selbsttest): SWE-bench Pro 61.7 vs 53.4 importiert von Opus 4.6 Max; Terminal-Bench 73.0 vs 78.2. 100K+20K: lokal ~$0, gehostet ~$0.11, Opus $1.00. Kein unabhängiger Benchmark.

Qwen-Starttabelle: 3.8-27B vs 3.6-27B, 3.7-Plus, Opus 4.6 Max Bild vergrößern
Selbsttest. Die Opus-Zelle bei SWE-Pro ist ein importierter Offizialwert, kein Same-Harness-Rerun.

Was es ist — und warum diese Tabelle zählt

Qwen3.8-27B sind dichte multimodale Apache-2.0-Gewichte vom 2026-08-14: 27.781.427.952 Parameter, nativ 262K. Weder Qwen3-8B noch das API-only Qwen3.8-Max.

Der Schock ist die Schwelle. Ein Dritt-Q4_K_M (~17,1GB) passt in eine 24GB-Consumer-GPU: Coding-Agent heute Abend auf dem Schreibtisch. Vergleich: Claude Opus 4.6, OpenRouter-Hauptlisting $5/$25, keine herunterladbaren Gewichte.

Die vier Balken stammen aus Qwens Tabelle. 3.8-27B liegt bei SWE-Pro, LiveCodeBench und OSWorld über Opus 4.6 Max; Terminal-Bench −5,2. Marketing, keine unabhängige Reproduktion — und trotzdem die Gegenüberstellung, die sitzen muss.

Spezifikations-Tabelle

Zuerst die prüfbaren Zahlen. Alle vier Spalten kommen aus Katalog und OpenRouter-Hauptlisting (`qwen/qwen3.8-27b` jetzt $0.45/$3.20).

3.8-27B 3.6-27B 3.8-Max Opus 4.6
Released 2026-08-14 (HF) catalog first_seen 2026-06-22 catalog first_seen 2026-08-04 in catalog
Params 27.78B dense ~27.8B dense flagship 3.8 API frontier API
Weights Apache-2.0 download Apache-2.0 + API API only API only
Context 262K native / 1M YaRN 262K Bestwert in diesem Vergleich 1M Bestwert in diesem Vergleich 1M
Modality text+image+video→text text+image+video→text text+image+video→text multimodal API
OpenRouter $/1M $0.45 / $3.20 Bestwert in diesem Vergleich $0.289 / $2.40 $2.00 / $6.00 $5.00 / $25.00

Der veröffentlichte Decoder von 3.8-27B und 3.6-27B ist fast gleich (64 Hybrid-Schichten, Hidden 5120). Der Coding-Sprung ist Training, kein neues Skelett. Max und Opus sind eine andere Linie: 1M gehostet, Token-Preis, die Gewichte gehören Ihnen nie. 3.8-27B hat beides: lokal herunterladbar oder gehostete API auf denselben Gewichten.

Derselbe Job: lokal ~$0, gehostet ~$0.11, Opus $1

USD-Kosten für 100K Input + 20K Output Bild vergrößern
OpenRouter-Hauptlisting. Lokal 3.8-27B: nur Strom; gehostet dieselben Gewichte ~$0.11.

Szenario fest 100K+20K. Keine Fähigkeit: wem Sie denselben Token-Job zahlen.

Model In $/1M Out $/1M 100K+20K Role
3.8-27B local Bestwert in diesem Vergleich ~$0 (electricity) 24GB Q4 desk
Qwen3 Coder 30B A3B Bestwert in diesem Vergleich $0.07 Bestwert in diesem Vergleich $0.27 $0.012 cheap code API
Qwen3 Coder 480B $0.30 $1.00 $0.050 hosted code flagship
Qwen3.6-27B API $0.289 $2.40 $0.077 same-size predecessor
Qwen3.8-27B API $0.45 $3.20 $0.109 same weights, hosted
Qwen3.8-Max $2.00 $6.00 $0.32 same-gen cloud flagship
Claude Opus 4.6 $5.00 $25.00 $1.00 frontier coding API
GPT-5.6 Sol $5.00 $30.00 $1.10 OpenAI coding flagship

Opus 4.6 und GPT-5.6 Sol: ~$1. Max derselben Generation: ~$0.32. 3.8-27B gehostet: ~$0.11 (etwas teurer als Vorgänger 3.6-27B mit $0.077). Gehostetes Coder-Flaggschiff: ~$0.05. Dieselben Gewichte auf Ihrer 24GB-Karte: Token-Sticker null — Sie zahlen Strom und Abschreibung. DeepSeek V4 Flash 0731 ist das andere Extrem: 284B-MoE zu $0.09/$0.18, kein Consumer-Download.

Coding: gegen Opus 4.6, nicht nur die Familie

Qwens Starttabelle legt 3.8-27B, Vorgänger 3.6-27B, gehostetes Plus und Claude Opus 4.6 Max auf ein Blatt. Selbsttest; mehrere Zeilen unter Claude Code; Opus-SWE-Pro ist importiert (*); QwenSWEBench intern.

Benchmark 3.8-27B 3.6-27B 3.7-Plus Opus 4.6 Max
Terminal-Bench 2.1 73.0 63.4 64.0 Bestwert in diesem Vergleich 78.2
SWE-bench Pro* Bestwert in diesem Vergleich 61.7 53.5 57.6 53.4
LiveCodeBench v6 Bestwert in diesem Vergleich 90.3 83.9 89.6 88.8
OSWorld-Verified Bestwert in diesem Vergleich 84.3 63.9 73.3 72.7
QwenSWEBench Bestwert in diesem Vergleich 79.0 49.3 59.2 63.8
DeepSWE 1.1 Bestwert in diesem Vergleich 42.2 13.3 14.2
NL2Repo-Bench 42.3 36.2 41.1 Bestwert in diesem Vergleich 47.6
GPQA Diamond 89.2 87.8 90.3 Bestwert in diesem Vergleich 91.3

Lesart gegen die erste Liga: vs Opus 4.6 führt oder liegt das 27B bei SWE-Pro, LiveCodeBench, OSWorld und QwenSWEBench vorn; Terminal-Bench, NL2Repo, GPQA hinten. Vs 3.6-27B ist der Agent ein Bruch (DeepSWE 13.3→42.2). Vs Plus hält das dichte 27B die meisten Code-Zeilen — Plus wird pro Token bezahlt.

Kein Coder 480B, kein GPT-5.6 Sol im selben Harness. Machen Sie aus 61.7 keinen Universal-Sieg. Entscheidung: UI mit Screenshots, privates Repo → 3.8-27B auf 24GB sieht erstmals nach Near-Frontier aus. SLA und 1M gehostet → weiter Opus / Sol / Max zahlen.

Einstiegshardware: heute Abend, nicht irgendwann

Gewichtsfußabdruck vs 24GB-Consumer-Linie Bild vergrößern
Nur Gewichte. KV extra. Q4 ist Unsloth von Dritten. ~149GB bei V4 Flash ist öffentliches Serving.

«Läuft» ist zu weich. Der genaue Satz: eine 24GB-Consumer-GPU (4090-Klasse) lädt heute Abend ein 4bit von Dritten und dient als Coding-Agent bei 8K–32K. Opus 4.6 «lädt» man nicht — Sie bekommen keine Gewichte. Coder 480B / V4 Flash passen nicht in dieses Gehäuse.

Rig Fits Context to start What you get What you give up
24GB consumer GPU Q4_K_M ~17.1GB* 8K–32K Coding agent tonight Opus never leaves the API
32–48GB workstation FP8 30.9GB 32K–64K Less quant damage Still no download for Opus
80GB-class card BF16 55.6GB native 262K is tight Need KV budget (~16GiB @262K) API still simpler
No local GPU n/a 262K–1M hosted Pay OpenRouter 3.8-27B $0.45/$3.20; Max $2/$6; Opus $5/$25

Schweißen Sie nicht «passt in 17GB» an «unterstützt 262K». Die Full-Attention-KV-Untergrenze bei 262K BF16 ist ~16GiB (nur 16 Schichten). Auf 24GB stirbt zuerst VRAM. Einstieg: 8K–32K, kein 1M-YaRN, dieselben Repo-Fixes. Komfort: FP8 auf 48GB. BF16 bei vollem 262K: 80GB-Klasse.

Das ist die niedrige Schwelle: First-Line-API kostet $5/$25 und wird nie heruntergeladen. Dieses 27B sitzt auf einer Gaming-GPU. Quantisierung verletzt Reasoning — der Schock ist anfangen zu können, nicht Opus zu sein.

Site-Ranking: Proxy, nicht diese Coding-Tabelle

Das Composite der Site belohnt langen Kontext und niedrigen Preis, nicht SWE. In diesem Snapshot steigen 3.8-27B (bereits $0.45/$3.20), 3.6-27B, 3.8-Max und Opus 4.6 nicht, weil sie «gut coden» — 262K zum Mittelpreis schlägt keinen 1M-Flash-Slot.

On-site unified slot Model Why it ranks
#21 Qwen3.7-Flash 1M ctx + $0.03/$0.13
#93 Qwen3.5-Flash 1M + cheap
#97 Qwen3 Coder Flash 1M code API, still cheap
#100 Qwen3.7-Plus 1M, $0.32/$1.28
not on board 3.8-27B / Opus 4.6 listing ≠ 1M-cheap Flash slot / frontier sticker

HF Hot hält offizielles Qwen3.6-27B bei sort_index=45 (~6.895.121 Downloads). 3.8-27B fehlt. Das Composite steigt nicht wegen SWE 61.7. Kein Fähigkeits-Benchmark.

Wann 27B, wann weiter Opus zahlen

3.8-27B wählen: 24GB-Karte da, Repo bleibt drin, Bildschirme nötig, Vendor-Tabelle akzeptabel. Gegen 3.6-27B auf denselben Tests; Q4 messen. Ohne Karte: OpenRouter `qwen/qwen3.8-27b` ($0.45/$3.20, ~$0.11 derselbe Job) — eine Größenordnung billiger als Opus, teurer als kleines Coder.

Weiter Opus 4.6 / GPT-5.6 Sol zahlen: SLA, 1M gehostet, keine GPU, kein Risiko importierter Scores. Max zahlen: Qwen-Flaggschiff derselben Generation günstiger als Opus ($2/$6 vs $5/$25). Coder 480B: nur Text, fertige 262K-API.

Nicht als «günstigstes 27B-API» — Vorgänger 3.6-27B und Coder 30B sind billiger. 24GB-Einstieg ist nicht volles 262K. Entscheiden mit Token, Compare und der Modellseite.

Insights