Analyse approfondie de la série Qwen : guide de choix de Qwen2.5 à Qwen3.7
49 SKUs Qwen au catalogue : Max, Plus, Flash, Coder et VL. Le fleuron Qwen3.7 Max coûte $1.25/$3.75 ; Flash $0.065/$0.26 ; le Coder gratuit est #6 sur unified.
Ce qu’est la série Qwen
Qwen (Tongyi Qianwen) est la marque de modèles ouverts et hébergés d’Alibaba ; dans notre catalogue le vendor_id est qwen avec 49 SKUs reflétés sur OpenRouter. Ce n’est pas un modèle unique mais une matrice par scénario : Max pour le raisonnement difficile, Plus/Flash pour le contexte long quotidien, Coder pour le code et les agents, VL pour le multimodal image-texte. Contrairement aux éditeurs avec un ou deux endpoints, Qwen propose un gradient complet de $0 gratuit à $1.25/$3.75 fleuron sous le même vendor : d’abord le type de tâche, puis le SKU concret.
Carte des gammes produit
Par génération et scénario, les 49 SKUs se regroupent en six lignes.
Qwen2.5 (génération précédente) : Qwen2.5 72B Instruct (131K ctx), Qwen2.5 Coder 32B, Qwen2.5 VL 72B — flux legacy matures et moins chers.
Base Qwen3 : 8B/14B/32B/235B MoE ; Qwen3 32B à $0.08/$0.28 est l’ancre rapport qualité-prix pour APIs légères.
Itérations Qwen3.5/3.6/3.7 : Qwen3.5-Flash (1M ctx, multimodal), Qwen3.6 Plus/Flash, Qwen3.7 Plus/Max forment le cœur actuel ; Qwen3.7 Max est le fleuron 1M, Qwen3 Max l’ancien de 262K.
Niveaux Max/Plus/Flash : Max le plus cher ($1.25/$3.75), Plus intermédiaire ($0.32/$1.28), Flash le moins cher ($0.065/$0.26).
Ligne Coder : Qwen3 Coder 480B MoE (1M ctx, $0.22/$1.80) et gratuit qwen3-coder:free ($0, #6 au classement) ; variantes Coder Flash/Plus/Next.
VL multimodal : Qwen3 VL 235B/32B/8B ; Qwen3 VL 235B Instruct $0.20/$0.88, 262K ctx, accepte l’image.
Fiche technique et tarifs en un coup d’œil
Tarifs du listing principal OpenRouter (USD/1M tokens, entrée/sortie), vérifiables sur la page token du site.
Qwen3.7 Max : 1M ctx, $1.25/$3.75 — fleuron le plus cher.
Qwen3 Max : 262K ctx, $0.78/$3.90 — ancien fleuron, moins de contexte mais sortie chère.
Qwen3.7 Plus : 1M ctx, $0.32/$1.28 — équilibre pour longs documents et agents.
Qwen3.5-Flash : 1M ctx, $0.065/$0.26 — prix le plus bas de la série, tâches légères à fort volume.
Qwen3 Coder 480B : 1M ctx, $0.22/$1.80 — MoE code ; gratuit qwen3-coder:free aussi 1M ctx, $0/$0.
Qwen3 32B : 131K ctx, $0.08/$0.28 — ancre API légère ; aussi DeepInfra, Groq et plus.
Qwen3 VL 235B Instruct : 262K ctx, $0.20/$0.88 — multimodal image-texte.
Prix mixte (100K entrée + 20K sortie) : Flash ≈ $0.01, Plus/Coder ≈ $0.06, Max ≈ $0.20 — écart jusqu’à 20×.
Classement sur le site et popularité open-source
Sur le classement unified d’AI Hippo, 12 SKUs Qwen sont listés. Le plus haut est qwen3-coder:free (#6), suivi du qwen3-coder payant (#74), Qwen3.5-Flash (#88), et le cluster Plus/Flash entre #90–#98.
Avertissement clé : le score composite est un proxy « longueur de contexte / prix », qui récompense long contexte et bas prix — ce n’est pas un benchmark de capacité comme MMLU ou HumanEval. Un rang élevé indique un bon rapport specs/prix, pas la plus grande capacité.
Côté open-source, sur la liste chaude Hugging Face Qwen3.6-27B a ~4,96M téléchargements, Qwen3.6-27B-MTP-GGUF ~2,9M, variantes Qwen3.6-35B-A3B ~2,51M — signal de demande soutenue pour déploiement local. API hébergée et GGUF local sont des routes séparées : la première facture au token sans ops ; la seconde zéro token mais hardware propre requis.
Ce qui précède sont des signaux de specs et coût, pas des tests de capacité.
Coût réel et matrice de choix
Deux scénarios typiques avec coût en dollars (listing principal OpenRouter).
Scénario A : 100K entrée + 20K sortie (chat/document moyen) Qwen3.7 Max ≈ $0.20 | Qwen3.7 Plus ≈ $0.06 | Qwen3.5-Flash ≈ $0.01 | Qwen3 Coder ≈ $0.06 | qwen3-coder:free = $0
Scénario B : 500K entrée + 5K sortie (long contexte/scan de repo) Qwen3.7 Max ≈ $0.64 | Qwen3.7 Plus ≈ $0.17 | Qwen3.5-Flash ≈ $0.03 | Qwen3 Coder ≈ $0.12
Matrice de choix : Raisonnement fleuron et agents complexes → Qwen3.7 Max (1M ctx, plus cher mais fenêtre la plus longue) Documents longs quotidiens et agents généraux → Qwen3.7 Plus ou Qwen3.6 Plus (1M ctx, $0.32/$1.28) Tâches légères à fort volume → Qwen3.5-Flash ($0.065/$0.26, prix le plus bas) Programmation et agents code → Qwen3 Coder 480B ou gratuit (1M ctx, MoE) Multimodal image-texte → Qwen3 VL 235B Instruct ($0.20/$0.88, 262K ctx) Déploiement local/zéro token → poids open-source HF (Qwen3.6-27B, ~4,96M téléchargements)
Ce qui précède est une comparaison specs/coût, pas un benchmark de capacité.
Quand choisir lequel
Pour choisir Qwen, trois questions d’abord : quel contexte ? quelle part de tokens de sortie ? multimodal ou déploiement local obligatoire ?
Si la réponse est « 1M ctx + raisonnement maximal + coût non sensible », choisissez Qwen3.7 Max. Si « 1M ctx + agent quotidien + sensible au coût », Qwen3.7 Plus ou Flash — Flash coûte 1/20 du Max en 100K+20K.
Programmation : prototypez avec qwen3-coder:free gratuit (#6 unified, $0), passez au Coder 480B payant ou Coder Plus en production. Multimodal image-texte → VL 235B ; flux legacy Qwen2.5 peuvent rester sur 72B Instruct ($0.36/$0.40, 131K ctx).
Ne choisissez pas Qwen si : latence minimale requise et 131K de Qwen3 32B insuffisant — comparez d’autres éditeurs sur Groq/DeepInfra ; pour compliance entreprise avec SLA officiel, connectez directement Alibaba Cloud Model Studio, pas seulement le miroir OpenRouter.
Le site a qwen-qwen3-coder-free-review et la page vendor avec les 49 SKUs — entrez par vendor au modèle concret et validez sur compare.
Sources
Evidence and actions
- Fenêtre temporelle: catalog snapshot
- Taille de l’échantillon: 12
- Type de source: catalog_and_pricing
- Parcourez les 49 SKUs Qwen sur /fr/model/vendor/qwen/
- Comparez les fournisseurs sur /fr/token/
- Lisez l'analyse du Coder gratuit sur /fr/insights/qwen-qwen3-coder-free-review/