Análise profunda da série Qwen: guia de seleção de Qwen2.5 a Qwen3.7
49 SKUs Qwen no catálogo: Max, Plus, Flash, Coder e VL. O carro-chefe Qwen3.7 Max custa $1.25/$3.75; Flash $0.065/$0.26; o Coder gratuito está #6 no unified.
O que é a série Qwen
Qwen (Tongyi Qianwen) é a marca de modelos abertos e hospedados da Alibaba; no nosso catálogo o vendor_id é qwen com 49 SKUs espelhados no OpenRouter. Não é um modelo único, mas uma matriz por cenário: Max para raciocínio difícil, Plus/Flash para contexto longo diário, Coder para programação e agentes, VL para multimodal imagem-texto. Diferente de fornecedores com um ou dois endpoints, a Qwen oferece gradiente completo de $0 grátis a $1.25/$3.75 carro-chefe no mesmo vendor: primeiro o tipo de tarefa, depois o SKU concreto.
Mapa de linhas de produto
Por geração e cenário, os 49 SKUs agrupam-se em seis linhas.
Qwen2.5 (geração anterior): Qwen2.5 72B Instruct (131K ctx), Qwen2.5 Coder 32B, Qwen2.5 VL 72B — fluxos legados maduros e mais baratos.
Base Qwen3: 8B/14B/32B/235B MoE; Qwen3 32B a $0.08/$0.28 é a âncora de custo-benefício para APIs leves.
Iterações Qwen3.5/3.6/3.7: Qwen3.5-Flash (1M ctx, multimodal), Qwen3.6 Plus/Flash, Qwen3.7 Plus/Max são o núcleo atual; Qwen3.7 Max é o carro-chefe de 1M, Qwen3 Max o anterior de 262K.
Camadas Max/Plus/Flash: Max mais caro ($1.25/$3.75), Plus intermediário ($0.32/$1.28), Flash mais barato ($0.065/$0.26).
Linha Coder: Qwen3 Coder 480B MoE (1M ctx, $0.22/$1.80) e grátis qwen3-coder:free ($0, #6 no ranking); variantes Coder Flash/Plus/Next.
VL multimodal: Qwen3 VL 235B/32B/8B; Qwen3 VL 235B Instruct $0.20/$0.88, 262K ctx, aceita imagem.
Ficha técnica e preços num relance
Preços do listing principal do OpenRouter (USD/1M tokens, entrada/saída), verificáveis na página token do site.
Qwen3.7 Max: 1M ctx, $1.25/$3.75 — carro-chefe mais caro.
Qwen3 Max: 262K ctx, $0.78/$3.90 — carro-chefe anterior, menos contexto mas saída cara.
Qwen3.7 Plus: 1M ctx, $0.32/$1.28 — equilíbrio para documentos longos e agentes.
Qwen3.5-Flash: 1M ctx, $0.065/$0.26 — preço mais baixo da série, tarefas leves de alto volume.
Qwen3 Coder 480B: 1M ctx, $0.22/$1.80 — MoE de código; grátis qwen3-coder:free também 1M ctx, $0/$0.
Qwen3 32B: 131K ctx, $0.08/$0.28 — âncora API leve; também DeepInfra, Groq e mais.
Qwen3 VL 235B Instruct: 262K ctx, $0.20/$0.88 — multimodal imagem-texto.
Preço misto (100K entrada + 20K saída): Flash ≈ $0.01, Plus/Coder ≈ $0.06, Max ≈ $0.20 — até 20× de diferença.
Posições no ranking do site e popularidade open-source
No ranking unified da AI Hippo, 12 SKUs Qwen estão listados. O mais alto é qwen3-coder:free (#6), seguido do qwen3-coder pago (#74), Qwen3.5-Flash (#88), e o cluster Plus/Flash entre #90–#98.
Aviso-chave: a pontuação composta é um proxy de «comprimento de contexto / preço», que premia contexto longo e preço baixo — não é benchmark de capacidade como MMLU ou HumanEval. Ranking alto indica boa relação specs/preço, não maior capacidade.
Em open-source, na lista quente do Hugging Face Qwen3.6-27B tem ~4,96M downloads, Qwen3.6-27B-MTP-GGUF ~2,9M, variantes Qwen3.6-35B-A3B ~2,51M — sinal de demanda sustentada para implantação local. API hospedada e GGUF local são rotas separadas: a primeira cobra por token sem ops; a segunda zero token mas exige hardware próprio.
O acima são sinais de specs e custo, não testes de capacidade.
Custo real e matriz de seleção
Dois cenários típicos com custo em dólares (listing principal OpenRouter).
Cenário A: 100K entrada + 20K saída (chat/documento médio) Qwen3.7 Max ≈ $0.20 | Qwen3.7 Plus ≈ $0.06 | Qwen3.5-Flash ≈ $0.01 | Qwen3 Coder ≈ $0.06 | qwen3-coder:free = $0
Cenário B: 500K entrada + 5K saída (contexto longo/varredura de repo) Qwen3.7 Max ≈ $0.64 | Qwen3.7 Plus ≈ $0.17 | Qwen3.5-Flash ≈ $0.03 | Qwen3 Coder ≈ $0.12
Matriz de seleção: Raciocínio carro-chefe e agentes complexos → Qwen3.7 Max (1M ctx, mais caro mas janela mais longa) Documentos longos diários e agentes gerais → Qwen3.7 Plus ou Qwen3.6 Plus (1M ctx, $0.32/$1.28) Tarefas leves de alto volume → Qwen3.5-Flash ($0.065/$0.26, preço mais baixo) Programação e agentes de código → Qwen3 Coder 480B ou grátis (1M ctx, MoE) Multimodal imagem-texto → Qwen3 VL 235B Instruct ($0.20/$0.88, 262K ctx) Implantação local/zero token → pesos open-source HF (Qwen3.6-27B, ~4,96M downloads)
O acima é comparação de specs e custo, não benchmark de capacidade.
Quando escolher qual
Ao escolher Qwen, três perguntas primeiro: quanto contexto precisa? qual proporção de tokens de saída? multimodal ou implantação local obrigatória?
Se a resposta é «1M ctx + raciocínio máximo + custo não sensível», escolha Qwen3.7 Max. Se «1M ctx + agente diário + sensível ao custo», Qwen3.7 Plus ou Flash — Flash custa 1/20 do Max em 100K+20K.
Programação: prototipe com qwen3-coder:free grátis (#6 unified, $0), escale para Coder 480B pago ou Coder Plus em produção. Multimodal imagem-texto → VL 235B; fluxos legacy Qwen2.5 podem continuar com 72B Instruct ($0.36/$0.40, 131K ctx).
Não escolha Qwen se: precisa latência mínima e 131K do Qwen3 32B não basta — compare outros fornecedores no Groq/DeepInfra; para compliance empresarial com SLA oficial, conecte diretamente ao Alibaba Cloud Model Studio, não só o espelho OpenRouter.
O site tem qwen-qwen3-coder-free-review e a página vendor com os 49 SKUs — entre pelo vendor ao modelo concreto e valide no compare.
Fontes
Evidence and actions
- Janela de tempo: catalog snapshot
- Tamanho da amostra: 12
- Tipo de fonte: catalog_and_pricing
- Explore os 49 SKUs Qwen em /pt/model/vendor/qwen/
- Compare provedores em /pt/token/
- Leia a análise do Coder gratuito em /pt/insights/qwen-qwen3-coder-free-review/