Глубокий обзор серии Qwen: руководство по выбору от Qwen2.5 до Qwen3.7
49 SKU Qwen в каталоге: Max, Plus, Flash, Coder и VL. Флагман Qwen3.7 Max — $1.25/$3.75; Flash — $0.065/$0.26; бесплатный Coder — #6 в unified.
Что такое серия Qwen
Qwen (Tongyi Qianwen) — бренд открытых и хостируемых моделей Alibaba; в нашем каталоге vendor_id qwen, 49 SKU на OpenRouter. Это не одна модель, а матрица по сценариям: Max для сложного рассуждения, Plus/Flash для повседневного длинного контекста, Coder для программирования и агентов, VL для мультимодального ввода изображение-текст. В отличие от вендоров с одним-двумя endpoint, Qwen даёт полный ценовой градиент от $0 бесплатно до $1.25/$3.75 флагмана — сначала тип задачи, затем конкретный SKU.
Карта продуктовых линеек
По поколениям и сценариям 49 SKU группируются в шесть линий.
Qwen2.5 (прошлое поколение): Qwen2.5 72B Instruct (131K ctx), Qwen2.5 Coder 32B, Qwen2.5 VL 72B — зрелые и более дешёвые legacy-потоки.
База Qwen3: 8B/14B/32B/235B MoE; Qwen3 32B за $0.08/$0.28 — якорь цена/качество для лёгких API.
Итерации Qwen3.5/3.6/3.7: Qwen3.5-Flash (1M ctx, мультимодальный), Qwen3.6 Plus/Flash, Qwen3.7 Plus/Max — текущее ядро; Qwen3.7 Max — флагман 1M, Qwen3 Max — предыдущий 262K.
Уровни Max/Plus/Flash: Max дороже всего ($1.25/$3.75), Plus посередине ($0.32/$1.28), Flash дешевле всего ($0.065/$0.26).
Линия Coder: Qwen3 Coder 480B MoE (1M ctx, $0.22/$1.80) и бесплатный qwen3-coder:free ($0, #6 в рейтинге); варианты Coder Flash/Plus/Next.
VL мультимодальный: Qwen3 VL 235B/32B/8B; Qwen3 VL 235B Instruct $0.20/$0.88, 262K ctx, принимает изображения.
Характеристики и цены кратко
Цены основного листинга OpenRouter (USD/1M tokens, ввод/вывод), проверяемые на странице token сайта.
Qwen3.7 Max: 1M ctx, $1.25/$3.75 — самый дорогой флагман.
Qwen3 Max: 262K ctx, $0.78/$3.90 — предыдущий флагман, меньше контекста, но дорогой вывод.
Qwen3.7 Plus: 1M ctx, $0.32/$1.28 — баланс для длинных документов и агентов.
Qwen3.5-Flash: 1M ctx, $0.065/$0.26 — самая низкая цена серии, лёгкие высокочастотные задачи.
Qwen3 Coder 480B: 1M ctx, $0.22/$1.80 — MoE для кода; бесплатный qwen3-coder:free тоже 1M ctx, $0/$0.
Qwen3 32B: 131K ctx, $0.08/$0.28 — якорь лёгкого API; также DeepInfra, Groq и др.
Qwen3 VL 235B Instruct: 262K ctx, $0.20/$0.88 — мультимодальный ввод изображение-текст.
Смешанная цена (100K ввод + 20K вывод): Flash ≈ $0.01, Plus/Coder ≈ $0.06, Max ≈ $0.20 — разница до 20×.
Рейтинг на сайте и популярность open-source
В unified-рейтинге AI Hippo 12 SKU Qwen в списке. Высший — qwen3-coder:free (#6), далее платный qwen3-coder (#74), Qwen3.5-Flash (#88), кластер Plus/Flash между #90–#98.
Важная оговорка: композитный балл — прокси «длина контекста / цена», поощряющий длинный контекст и низкую цену — это не benchmark способностей вроде MMLU или HumanEval. Высокий ранг означает хорошее соотношение спецификаций/цены, а не максимальные способности.
Open-source: в горячем списке Hugging Face Qwen3.6-27B ~4,96M загрузок, Qwen3.6-27B-MTP-GGUF ~2,9M, варианты Qwen3.6-35B-A3B ~2,51M — сигнал устойчивого спроса на локальное развёртывание. Хостируемый API и локальный GGUF — разные пути: первый — оплата за токены без ops; второй — нулевые токены, но нужно своё железо.
Выше — сигналы спецификаций и стоимости, а не тесты способностей.
Расчёт стоимости и матрица выбора
Два типичных сценария с расчётом в долларах (основной листинг OpenRouter).
Сценарий A: 100K ввод + 20K вывод (средний чат/документ) Qwen3.7 Max ≈ $0.20 | Qwen3.7 Plus ≈ $0.06 | Qwen3.5-Flash ≈ $0.01 | Qwen3 Coder ≈ $0.06 | qwen3-coder:free = $0
Сценарий B: 500K ввод + 5K вывод (длинный контекст/сканирование репо) Qwen3.7 Max ≈ $0.64 | Qwen3.7 Plus ≈ $0.17 | Qwen3.5-Flash ≈ $0.03 | Qwen3 Coder ≈ $0.12
Матрица выбора: Флагманское рассуждение и сложные агенты → Qwen3.7 Max (1M ctx, дороже всего, но самое длинное окно) Повседневные длинные документы и общие агенты → Qwen3.7 Plus или Qwen3.6 Plus (1M ctx, $0.32/$1.28) Лёгкие высокочастотные задачи → Qwen3.5-Flash ($0.065/$0.26, самая низкая цена) Программирование и code-агенты → Qwen3 Coder 480B или бесплатный (1M ctx, MoE) Мультимодальный ввод изображение-текст → Qwen3 VL 235B Instruct ($0.20/$0.88, 262K ctx) Локальное развёртывание/нулевые токены → open-source веса HF (Qwen3.6-27B, ~4,96M загрузок)
Выше — сравнение спецификаций и стоимости, а не benchmark способностей.
Когда что выбирать
При выборе Qwen сначала три вопроса: сколько контекста нужно? какая доля выходных токенов? обязательны мультимодальность или локальное развёртывание?
Если ответ «1M ctx + максимальное рассуждение + цена не критична» — Qwen3.7 Max. Если «1M ctx + повседневный агент + чувствительность к цене» — Qwen3.7 Plus или Flash — Flash стоит 1/20 от Max при 100K+20K.
Программирование: прототип на бесплатном qwen3-coder:free (#6 unified, $0), в проде — платный Coder 480B или Coder Plus. Мультимодальный ввод изображение-текст → VL 235B; legacy Qwen2.5 можно оставить на 72B Instruct ($0.36/$0.40, 131K ctx).
Не выбирайте Qwen если: нужна минимальная задержка и 131K Qwen3 32B недостаточно — сравните других вендоров на Groq/DeepInfra; для enterprise-compliance с официальным SLA подключайтесь напрямую к Alibaba Cloud Model Studio, а не только к зеркалу OpenRouter.
На сайте есть qwen-qwen3-coder-free-review и vendor-страница со всеми 49 SKU — зайдите через vendor к конкретной модели и проверьте на compare.