Análisis profundo de la serie Qwen: guía de selección de Qwen2.5 a Qwen3.7
49 SKUs Qwen en el catálogo: Max, Plus, Flash, Coder y VL. El buque insignia Qwen3.7 Max cuesta $1.25/$3.75; Flash $0.065/$0.26; el Coder gratis está #6 en unified.
Qué es la serie Qwen
Qwen (Tongyi Qianwen) es la marca de modelos abiertos y alojados de Alibaba; en nuestro catálogo el vendor_id es qwen con 49 SKUs reflejados en OpenRouter. No es un modelo único sino una matriz por escenario: Max para razonamiento difícil, Plus/Flash para contexto largo diario, Coder para programación y agentes, VL para multimodal imagen-texto. A diferencia de proveedores con uno o dos endpoints, Qwen ofrece un gradiente completo de $0 gratis a $1.25/$3.75 insignia bajo el mismo vendor: primero el tipo de tarea, luego el SKU concreto.
Mapa de líneas de producto
Por generación y escenario, los 49 SKUs se agrupan en seis líneas.
Qwen2.5 (generación anterior): Qwen2.5 72B Instruct (131K ctx), Qwen2.5 Coder 32B, Qwen2.5 VL 72B — flujos legados maduros y más baratos.
Base Qwen3: 8B/14B/32B/235B MoE; Qwen3 32B a $0.08/$0.28 es el ancla de relación calidad-precio para APIs ligeras.
Iteraciones Qwen3.5/3.6/3.7: Qwen3.5-Flash (1M ctx, multimodal), Qwen3.6 Plus/Flash, Qwen3.7 Plus/Max son el núcleo actual; Qwen3.7 Max es el buque insignia de 1M, Qwen3 Max el anterior de 262K.
Capas Max/Plus/Flash: Max más caro (Qwen3.7 Max $1.25/$3.75), Plus intermedio ($0.32/$1.28), Flash más barato ($0.065/$0.26).
Línea Coder: Qwen3 Coder 480B MoE (1M ctx, $0.22/$1.80) y gratis qwen3-coder:free ($0, #6 en el ranking); variantes Coder Flash/Plus/Next.
VL multimodal: Qwen3 VL 235B/32B/8B; Qwen3 VL 235B Instruct $0.20/$0.88, 262K ctx, acepta imagen.
Ficha técnica y precios de un vistazo
Precios del listing principal de OpenRouter (USD/1M tokens, entrada/salida), verificables en la página token del sitio.
Qwen3.7 Max: 1M ctx, $1.25/$3.75 — buque insignia más caro.
Qwen3 Max: 262K ctx, $0.78/$3.90 — insignia anterior, menos contexto pero salida cara.
Qwen3.7 Plus: 1M ctx, $0.32/$1.28 — equilibrio para documentos largos y agentes.
Qwen3.5-Flash: 1M ctx, $0.065/$0.26 — precio más bajo de la serie, tareas ligeras de alto volumen.
Qwen3 Coder 480B: 1M ctx, $0.22/$1.80 — MoE de código; gratis qwen3-coder:free también 1M ctx, $0/$0.
Qwen3 32B: 131K ctx, $0.08/$0.28 — ancla API ligera; también DeepInfra, Groq y más.
Qwen3 VL 235B Instruct: 262K ctx, $0.20/$0.88 — multimodal imagen-texto.
Precio mixto (100K entrada + 20K salida): Flash ≈ $0.01, Plus/Coder ≈ $0.06, Max ≈ $0.20 — hasta 20× de diferencia.
Posiciones en el ranking del sitio y popularidad open-source
En el ranking unified de AI Hippo, 12 SKUs Qwen están listados. El más alto es qwen3-coder:free (#6), seguido del qwen3-coder de pago (#74), Qwen3.5-Flash (#88), y el cluster Plus/Flash entre #90–#98.
Aviso clave: la puntuación compuesta es un proxy de «longitud de contexto / precio», que premia contexto largo y precio bajo — no es un benchmark de capacidad como MMLU o HumanEval. Un ranking alto indica buena relación especificaciones/precio, no la mayor capacidad.
En open-source, en la lista caliente de Hugging Face Qwen3.6-27B tiene ~4,96M descargas, Qwen3.6-27B-MTP-GGUF ~2,9M, variantes Qwen3.6-35B-A3B ~2,51M — señal de demanda sostenida para despliegue local. API alojada y GGUF local son rutas separadas: la primera cobra por token sin ops; la segunda cero token pero requiere hardware propio.
Lo anterior son señales de especificaciones y coste, no pruebas de capacidad.
Coste real y matriz de selección
Dos escenarios típicos con coste en dólares (listing principal OpenRouter).
Escenario A: 100K entrada + 20K salida (chat/documento medio) Qwen3.7 Max ≈ $0.20 | Qwen3.7 Plus ≈ $0.06 | Qwen3.5-Flash ≈ $0.01 | Qwen3 Coder ≈ $0.06 | qwen3-coder:free = $0
Escenario B: 500K entrada + 5K salida (contexto largo/escaneo de repo) Qwen3.7 Max ≈ $0.64 | Qwen3.7 Plus ≈ $0.17 | Qwen3.5-Flash ≈ $0.03 | Qwen3 Coder ≈ $0.12
Matriz de selección: Razonamiento insignia y agentes complejos → Qwen3.7 Max (1M ctx, más caro pero ventana más larga) Documentos largos diarios y agentes generales → Qwen3.7 Plus o Qwen3.6 Plus (1M ctx, $0.32/$1.28) Tareas ligeras de alto volumen → Qwen3.5-Flash ($0.065/$0.26, precio más bajo) Programación y agentes de código → Qwen3 Coder 480B o gratis (1M ctx, MoE) Multimodal imagen-texto → Qwen3 VL 235B Instruct ($0.20/$0.88, 262K ctx) Despliegue local/cero token → pesos open-source HF (Qwen3.6-27B, ~4,96M descargas)
Lo anterior es comparación de specs y coste, no benchmark de capacidad.
Cuándo elegir cuál
Al elegir Qwen, tres preguntas primero: ¿cuánto contexto necesitas? ¿qué proporción de tokens de salida? ¿multimodal o despliegue local obligatorio?
Si la respuesta es «1M ctx + razonamiento máximo + coste no sensible», elige Qwen3.7 Max. Si «1M ctx + agente diario + sensible al coste», Qwen3.7 Plus o Flash — Flash cuesta 1/20 del Max en 100K+20K.
Programación: prototipa con qwen3-coder:free gratis (#6 unified, $0), escala a Coder 480B de pago o Coder Plus en producción. Multimodal imagen-texto → VL 235B; flujos legacy Qwen2.5 pueden seguir con 72B Instruct ($0.36/$0.40, 131K ctx).
No elijas Qwen si: necesitas latencia mínima y 131K de Qwen3 32B no basta — compara otros vendors en Groq/DeepInfra; para compliance empresarial con SLA oficial, conecta directamente a Alibaba Cloud Model Studio, no solo el espejo OpenRouter.
El sitio tiene qwen-qwen3-coder-free-review y la página vendor con los 49 SKUs — entra por vendor al modelo concreto y valida en compare.
Fuentes
Evidence and actions
- Ventana temporal: catalog snapshot
- Tamaño de muestra: 12
- Tipo de fuente: catalog_and_pricing
- Explora los 49 SKUs Qwen en /es/model/vendor/qwen/
- Compara proveedores en /es/token/
- Lee el análisis del Coder gratis en /es/insights/qwen-qwen3-coder-free-review/