Qwen-Modellserie im Test: Auswahlleitfaden von Qwen2.5 bis Qwen3.7

49 Qwen-SKUs im Katalog: Max, Plus, Flash, Coder und VL. Flaggschiff Qwen3.7 Max kostet $1.25/$3.75; Flash $0.065/$0.26; kostenloser Coder ist #6 auf unified.

Was die Qwen-Serie ist

Qwen (Tongyi Qianwen) ist Alibabas Marke für offene und gehostete Modelle; in unserem Katalog ist vendor_id qwen mit 49 auf OpenRouter gespiegelten SKUs. Kein Einzelmodell, sondern eine szenariobasierte Matrix: Max für schweres Reasoning, Plus/Flash für täglichen Langkontext, Coder für Programmierung und Agenten, VL für Bild-Text-Multimodal. Anders als Anbieter mit ein bis zwei Endpoints bietet Qwen unter einem Vendor einen vollen Preisgradienten von $0 gratis bis $1.25/$3.75 Flaggschiff — zuerst Aufgabentyp, dann konkretes SKU.

Produktlinien-Karte

Nach Generation und Szenario lassen sich die 49 SKUs in sechs Linien gruppieren.

Qwen2.5 (Vorgeneration): Qwen2.5 72B Instruct (131K ctx), Qwen2.5 Coder 32B, Qwen2.5 VL 72B — reife, günstigere Legacy-Workflows.

Qwen3-Basis: 8B/14B/32B/235B MoE; Qwen3 32B bei $0.08/$0.28 ist der Preis-Leistungs-Anker für leichte APIs.

Qwen3.5/3.6/3.7-Iterationen: Qwen3.5-Flash (1M ctx, multimodal), Qwen3.6 Plus/Flash, Qwen3.7 Plus/Max sind der aktuelle Kern; Qwen3.7 Max ist das 1M-Flaggschiff, Qwen3 Max das 262K-Vorgänger-Flaggschiff.

Max/Plus/Flash-Stufen: Max am teuersten ($1.25/$3.75), Plus mittig ($0.32/$1.28), Flash am günstigsten ($0.065/$0.26).

Coder-Linie: Qwen3 Coder 480B MoE (1M ctx, $0.22/$1.80) und gratis qwen3-coder:free ($0, Rang #6); Varianten Coder Flash/Plus/Next.

VL-Multimodal: Qwen3 VL 235B/32B/8B; Qwen3 VL 235B Instruct $0.20/$0.88, 262K ctx, Bild-Eingabe.

Datenblatt und Preise auf einen Blick

Preise des OpenRouter-Haupt-Listings (USD/1M Tokens, Ein/Aus), auf der Token-Seite des Sites prüfbar.

Qwen3.7 Max: 1M ctx, $1.25/$3.75 — teuerstes Flaggschiff.

Qwen3 Max: 262K ctx, $0.78/$3.90 — Vorgänger-Flaggschiff, kürzerer ctx aber teure Ausgabe.

Qwen3.7 Plus: 1M ctx, $0.32/$1.28 — Balance für lange Dokumente und Agenten.

Qwen3.5-Flash: 1M ctx, $0.065/$0.26 — günstigster Preis der Serie, leichte Hochvolumen-Aufgaben.

Qwen3 Coder 480B: 1M ctx, $0.22/$1.80 — MoE-Code-Flaggschiff; gratis qwen3-coder:free ebenfalls 1M ctx, $0/$0.

Qwen3 32B: 131K ctx, $0.08/$0.28 — leichter API-Anker; auch DeepInfra, Groq u.a.

Qwen3 VL 235B Instruct: 262K ctx, $0.20/$0.88 — multimodale Bild-Text-Eingabe.

Mischpreis (100K Ein + 20K Aus): Flash ≈ $0.01, Plus/Coder ≈ $0.06, Max ≈ $0.20 — bis zu 20× Unterschied.

Site-Ranking und Open-Source-Beliebtheit

Auf dem AI Hippo unified-Ranking sind 12 Qwen-SKUs gelistet. Höchster Rang: qwen3-coder:free (#6), gefolgt von qwen3-coder kostenpflichtig (#74), Qwen3.5-Flash (#88), Plus/Flash-Cluster zwischen #90–#98.

Wichtiger Hinweis: Der Composite-Score ist ein Proxy für «Kontextlänge / Preis», der langen Kontext und niedrigen Preis belohnt — kein Fähigkeits-Benchmark wie MMLU oder HumanEval. Hoher Rang bedeutet gutes Spec/Preis-Verhältnis, nicht höchste Fähigkeit.

Open-Source: Auf der Hugging Face-Hotlist hat Qwen3.6-27B ~4,96M Downloads, Qwen3.6-27B-MTP-GGUF ~2,9M, Qwen3.6-35B-A3B-Varianten ~2,51M — Signal für anhaltende Nachfrage bei lokalem Deployment. Gehostete API und lokales GGUF sind getrennte Wege: erstere token-basiert ohne Ops; letztere null Token, aber eigene Hardware nötig.

Obiges sind Spec- und Kostensignale, keine Fähigkeits-Benchmarks.

Kostenpraxis und Auswahl-Matrix

Zwei typische Szenarien mit Dollarkosten (OpenRouter-Haupt-Listing).

Szenario A: 100K Ein + 20K Aus (mittlerer Chat/Dokument) Qwen3.7 Max ≈ $0.20 | Qwen3.7 Plus ≈ $0.06 | Qwen3.5-Flash ≈ $0.01 | Qwen3 Coder ≈ $0.06 | qwen3-coder:free = $0

Szenario B: 500K Ein + 5K Aus (Langkontext/Repo-Scan) Qwen3.7 Max ≈ $0.64 | Qwen3.7 Plus ≈ $0.17 | Qwen3.5-Flash ≈ $0.03 | Qwen3 Coder ≈ $0.12

Auswahl-Matrix: Flaggschiff-Reasoning und komplexe Agenten → Qwen3.7 Max (1M ctx, teuerstes aber längstes Fenster) Tägliche Langdokumente und allgemeine Agenten → Qwen3.7 Plus oder Qwen3.6 Plus (1M ctx, $0.32/$1.28) Leichte Hochvolumen-Aufgaben → Qwen3.5-Flash ($0.065/$0.26, günstigster Preis) Programmierung und Code-Agenten → Qwen3 Coder 480B oder gratis (1M ctx, MoE) Multimodale Bild-Text → Qwen3 VL 235B Instruct ($0.20/$0.88, 262K ctx) Lokales Deployment/null Token → HF Open-Source-Gewichte (Qwen3.6-27B, ~4,96M Downloads)

Obiges ist Spec-/Kostenvergleich, kein Fähigkeits-Benchmark.

Wann welches wählen

Bei der Qwen-Wahl zuerst drei Fragen: wie viel Kontext? welcher Anteil Ausgabe-Tokens? Multimodal oder lokales Deployment zwingend?

Ist die Antwort «1M ctx + maximales Reasoning + kostenunempfindlich», wählen Sie Qwen3.7 Max. Bei «1M ctx + täglicher Agent + kostensensibel» Qwen3.7 Plus oder Flash — Flash kostet 1/20 von Max bei 100K+20K.

Programmierung: prototypen mit gratis qwen3-coder:free (#6 unified, $0), in Produktion auf kostenpflichtigen Coder 480B oder Coder Plus skalieren. Multimodale Bild-Text → VL 235B; Legacy Qwen2.5-Workflows können bei 72B Instruct ($0.36/$0.40, 131K ctx) bleiben.

Qwen nicht wählen wenn: minimale Latenz nötig und 131K von Qwen3 32B reicht nicht — andere Anbieter auf Groq/DeepInfra vergleichen; für Enterprise-Compliance mit offiziellem SLA direkt Alibaba Cloud Model Studio anbinden, nicht nur OpenRouter-Spiegel.

Die Site hat qwen-qwen3-coder-free-review und die Vendor-Seite mit allen 49 SKUs — über Vendor zum konkreten Modell, dann auf compare validieren.

Quellen

Evidence and actions

  • Zeitfenster: catalog snapshot
  • Stichprobengröße: 12
  • Quellentyp: catalog_and_pricing
  • Alle 49 Qwen-SKUs auf /de/model/vendor/qwen/ ansehen
  • Anbieterpreise auf /de/token/ vergleichen
  • Tiefenreview des kostenlosen Coders auf /de/insights/qwen-qwen3-coder-free-review/ lesen

Insights