Análisis profundo de la serie Qwen: guía de selección de Qwen2.5 a Qwen3.7

49 SKUs Qwen en el catálogo: Max, Plus, Flash, Coder y VL. El buque insignia Qwen3.7 Max cuesta $1.25/$3.75; Flash $0.065/$0.26; el Coder gratis está #6 en unified.

Qué es la serie Qwen

Qwen (Tongyi Qianwen) es la marca de modelos abiertos y alojados de Alibaba; en nuestro catálogo el vendor_id es qwen con 49 SKUs reflejados en OpenRouter. No es un modelo único sino una matriz por escenario: Max para razonamiento difícil, Plus/Flash para contexto largo diario, Coder para programación y agentes, VL para multimodal imagen-texto. A diferencia de proveedores con uno o dos endpoints, Qwen ofrece un gradiente completo de $0 gratis a $1.25/$3.75 insignia bajo el mismo vendor: primero el tipo de tarea, luego el SKU concreto.

Mapa de líneas de producto

Por generación y escenario, los 49 SKUs se agrupan en seis líneas.

Qwen2.5 (generación anterior): Qwen2.5 72B Instruct (131K ctx), Qwen2.5 Coder 32B, Qwen2.5 VL 72B — flujos legados maduros y más baratos.

Base Qwen3: 8B/14B/32B/235B MoE; Qwen3 32B a $0.08/$0.28 es el ancla de relación calidad-precio para APIs ligeras.

Iteraciones Qwen3.5/3.6/3.7: Qwen3.5-Flash (1M ctx, multimodal), Qwen3.6 Plus/Flash, Qwen3.7 Plus/Max son el núcleo actual; Qwen3.7 Max es el buque insignia de 1M, Qwen3 Max el anterior de 262K.

Capas Max/Plus/Flash: Max más caro (Qwen3.7 Max $1.25/$3.75), Plus intermedio ($0.32/$1.28), Flash más barato ($0.065/$0.26).

Línea Coder: Qwen3 Coder 480B MoE (1M ctx, $0.22/$1.80) y gratis qwen3-coder:free ($0, #6 en el ranking); variantes Coder Flash/Plus/Next.

VL multimodal: Qwen3 VL 235B/32B/8B; Qwen3 VL 235B Instruct $0.20/$0.88, 262K ctx, acepta imagen.

Ficha técnica y precios de un vistazo

Precios del listing principal de OpenRouter (USD/1M tokens, entrada/salida), verificables en la página token del sitio.

Qwen3.7 Max: 1M ctx, $1.25/$3.75 — buque insignia más caro.

Qwen3 Max: 262K ctx, $0.78/$3.90 — insignia anterior, menos contexto pero salida cara.

Qwen3.7 Plus: 1M ctx, $0.32/$1.28 — equilibrio para documentos largos y agentes.

Qwen3.5-Flash: 1M ctx, $0.065/$0.26 — precio más bajo de la serie, tareas ligeras de alto volumen.

Qwen3 Coder 480B: 1M ctx, $0.22/$1.80 — MoE de código; gratis qwen3-coder:free también 1M ctx, $0/$0.

Qwen3 32B: 131K ctx, $0.08/$0.28 — ancla API ligera; también DeepInfra, Groq y más.

Qwen3 VL 235B Instruct: 262K ctx, $0.20/$0.88 — multimodal imagen-texto.

Precio mixto (100K entrada + 20K salida): Flash ≈ $0.01, Plus/Coder ≈ $0.06, Max ≈ $0.20 — hasta 20× de diferencia.

Posiciones en el ranking del sitio y popularidad open-source

En el ranking unified de AI Hippo, 12 SKUs Qwen están listados. El más alto es qwen3-coder:free (#6), seguido del qwen3-coder de pago (#74), Qwen3.5-Flash (#88), y el cluster Plus/Flash entre #90–#98.

Aviso clave: la puntuación compuesta es un proxy de «longitud de contexto / precio», que premia contexto largo y precio bajo — no es un benchmark de capacidad como MMLU o HumanEval. Un ranking alto indica buena relación especificaciones/precio, no la mayor capacidad.

En open-source, en la lista caliente de Hugging Face Qwen3.6-27B tiene ~4,96M descargas, Qwen3.6-27B-MTP-GGUF ~2,9M, variantes Qwen3.6-35B-A3B ~2,51M — señal de demanda sostenida para despliegue local. API alojada y GGUF local son rutas separadas: la primera cobra por token sin ops; la segunda cero token pero requiere hardware propio.

Lo anterior son señales de especificaciones y coste, no pruebas de capacidad.

Coste real y matriz de selección

Dos escenarios típicos con coste en dólares (listing principal OpenRouter).

Escenario A: 100K entrada + 20K salida (chat/documento medio) Qwen3.7 Max ≈ $0.20 | Qwen3.7 Plus ≈ $0.06 | Qwen3.5-Flash ≈ $0.01 | Qwen3 Coder ≈ $0.06 | qwen3-coder:free = $0

Escenario B: 500K entrada + 5K salida (contexto largo/escaneo de repo) Qwen3.7 Max ≈ $0.64 | Qwen3.7 Plus ≈ $0.17 | Qwen3.5-Flash ≈ $0.03 | Qwen3 Coder ≈ $0.12

Matriz de selección: Razonamiento insignia y agentes complejos → Qwen3.7 Max (1M ctx, más caro pero ventana más larga) Documentos largos diarios y agentes generales → Qwen3.7 Plus o Qwen3.6 Plus (1M ctx, $0.32/$1.28) Tareas ligeras de alto volumen → Qwen3.5-Flash ($0.065/$0.26, precio más bajo) Programación y agentes de código → Qwen3 Coder 480B o gratis (1M ctx, MoE) Multimodal imagen-texto → Qwen3 VL 235B Instruct ($0.20/$0.88, 262K ctx) Despliegue local/cero token → pesos open-source HF (Qwen3.6-27B, ~4,96M descargas)

Lo anterior es comparación de specs y coste, no benchmark de capacidad.

Cuándo elegir cuál

Al elegir Qwen, tres preguntas primero: ¿cuánto contexto necesitas? ¿qué proporción de tokens de salida? ¿multimodal o despliegue local obligatorio?

Si la respuesta es «1M ctx + razonamiento máximo + coste no sensible», elige Qwen3.7 Max. Si «1M ctx + agente diario + sensible al coste», Qwen3.7 Plus o Flash — Flash cuesta 1/20 del Max en 100K+20K.

Programación: prototipa con qwen3-coder:free gratis (#6 unified, $0), escala a Coder 480B de pago o Coder Plus en producción. Multimodal imagen-texto → VL 235B; flujos legacy Qwen2.5 pueden seguir con 72B Instruct ($0.36/$0.40, 131K ctx).

No elijas Qwen si: necesitas latencia mínima y 131K de Qwen3 32B no basta — compara otros vendors en Groq/DeepInfra; para compliance empresarial con SLA oficial, conecta directamente a Alibaba Cloud Model Studio, no solo el espejo OpenRouter.

El sitio tiene qwen-qwen3-coder-free-review y la página vendor con los 49 SKUs — entra por vendor al modelo concreto y valida en compare.

Fuentes

Evidence and actions

  • Ventana temporal: catalog snapshot
  • Tamaño de muestra: 12
  • Tipo de fuente: catalog_and_pricing
  • Explora los 49 SKUs Qwen en /es/model/vendor/qwen/
  • Compara proveedores en /es/token/
  • Lee el análisis del Coder gratis en /es/insights/qwen-qwen3-coder-free-review/

Insights