Qwen 模型系列深度测评:从 Qwen2.5 到 Qwen3.7 的选型指南
目录中 49 个 Qwen SKU 横跨 Max、Plus、Flash、Coder 与 VL 五条线——旗舰 Qwen3.7 Max 输入/输出 $1.25/$3.75,Flash 仅 $0.065/$0.26,Coder 免费版 unified 榜 #6。
Qwen 系列是什么
Qwen(通义千问)是阿里巴巴旗下的开源与托管大模型品牌,在本站目录中 vendor_id 为 qwen,当前镜像 49 个 OpenRouter SKU。它们不是单一模型,而是一套按场景分层的产品矩阵:旗舰 Max 负责高难度推理,Plus/Flash 覆盖日常长上下文任务,Coder 专注编程与 agent 工作流,VL 系列处理图文多模态输入。与只发布一两个 API 端点的厂商不同,Qwen 在同一 vendor 下同时提供从 $0 免费档到 $1.25/$3.75 旗舰档的完整价格梯度——选型时先确定任务类型,再在该类型内比较具体 SKU。
产品线地图
按代际与场景,49 个 SKU 可归纳为六条主线。
Qwen2.5(上一代主力):Qwen2.5 72B Instruct(131K ctx)、Qwen2.5 Coder 32B、Qwen2.5 VL 72B——适合需要成熟稳定、价格更低的遗留工作流。
Qwen3 基座:8B/14B/32B/235B MoE 等密度档,其中 Qwen3 32B 输入/输出仅 $0.08/$0.28,是轻量 API 的性价比锚点。
Qwen3.5/3.6/3.7 迭代:Qwen3.5-Flash(1M ctx、多模态)、Qwen3.6 Plus/Flash、Qwen3.7 Plus/Max 构成当前主力;Qwen3.7 Max 是 1M 上下文旗舰,Qwen3 Max 为 262K 上一代旗舰。
Max/Plus/Flash 分层:Max 最贵(Qwen3.7 Max $1.25/$3.75),Plus 居中(Qwen3.7 Plus $0.32/$1.28),Flash 最便宜(Qwen3.5-Flash $0.065/$0.26)。
Coder 线:Qwen3 Coder 480B MoE(1M ctx,$0.22/$1.80)与免费版 qwen3-coder:free($0,榜 #6);另有 Coder Flash/Plus/Next 等变体。
VL 多模态:Qwen3 VL 235B/32B/8B 等,Qwen3 VL 235B Instruct 输入/输出 $0.20/$0.88、262K 上下文,接受图像输入。
规格与定价速览(参数党)
以下均为 OpenRouter 主 listing 单价(USD/1M tokens,输入/输出),可直接在站内 token 页核验。
Qwen3.7 Max:1M 上下文,$1.25/$3.75——当前最贵旗舰。
Qwen3 Max:262K 上下文,$0.78/$3.90——上一代旗舰,上下文更短但输出价仍高。
Qwen3.7 Plus:1M 上下文,$0.32/$1.28——日常长文档与 agent 的均衡档。
Qwen3.5-Flash:1M 上下文,$0.065/$0.26——系列最低单价,适合高并发轻量任务。
Qwen3 Coder 480B:1M 上下文,$0.22/$1.80——MoE 代码旗舰;免费版 qwen3-coder:free 同为 1M ctx、$0/$0。
Qwen3 32B:131K 上下文,$0.08/$0.28——轻量 API 锚点;另有 DeepInfra、Groq 等多 provider 报价。
Qwen3 VL 235B Instruct:262K 上下文,$0.20/$0.88——多模态图文输入。
混合价参考(100K 输入 + 20K 输出):Flash ≈ $0.01,Plus/Coder ≈ $0.06,Max ≈ $0.20——价差可达 20 倍。
站内榜位与开源热度
在 AI Hippo unified 综合榜上,Qwen 共有 12 个 SKU 入榜。最高的是 qwen3-coder:free(#6),其次是付费版 qwen3-coder(#74),Qwen3.5-Flash(#88),Plus/Flash 集群集中在 #90–#98。
重要口径:该综合分是「上下文长度 / 价格」的代理指标,奖励长上下文与低单价——不是 MMLU、HumanEval 等能力 benchmark。榜位高说明「规格/价格比」优,不等于能力最强。
开源侧,Hugging Face 热榜上 Qwen3.6-27B 下载量约 496 万,Qwen3.6-27B-MTP-GGUF 约 290 万,Qwen3.6-35B-A3B 变体约 251 万——说明 Qwen 开源权重在本地部署社区有持续需求。托管 API 与本地 GGUF 是两条独立路线:前者按 token 计费、免运维;后者零 token 费、需自备算力。
以上为规格与成本信号,非能力基准测试。
成本实测与选型矩阵
用两个典型场景测算美元成本(OpenRouter 主 listing 单价)。
场景 A:100K 输入 + 20K 输出(中等对话/文档摘要) Qwen3.7 Max ≈ $0.20 | Qwen3.7 Plus ≈ $0.06 | Qwen3.5-Flash ≈ $0.01 | Qwen3 Coder ≈ $0.06 | qwen3-coder:free = $0
场景 B:500K 输入 + 5K 输出(长上下文检索/整仓代码扫描) Qwen3.7 Max ≈ $0.64 | Qwen3.7 Plus ≈ $0.17 | Qwen3.5-Flash ≈ $0.03 | Qwen3 Coder ≈ $0.12
选型矩阵: 旗舰推理与复杂 agent → Qwen3.7 Max(1M ctx,最贵但窗口最长) 日常长文档与通用 agent → Qwen3.7 Plus 或 Qwen3.6 Plus(1M ctx,$0.32/$1.28 档) 高并发轻量任务 → Qwen3.5-Flash($0.065/$0.26,系列最低单价) 编程与代码 agent → Qwen3 Coder 480B 或免费版(1M ctx,MoE 架构) 图文多模态 → Qwen3 VL 235B Instruct($0.20/$0.88,262K ctx) 本地部署/零 token 费 → HF 开源权重(如 Qwen3.6-27B,~496 万下载)
以上为规格与成本对比,非能力基准测试。
何时选哪一款
选 Qwen 时,先问三个问题:需要多长的上下文?输出 token 占比多高?是否必须多模态或本地部署?
如果答案是「1M 上下文 + 最高质量推理 + 成本不敏感」,选 Qwen3.7 Max。如果「1M 上下文 + 日常 agent + 成本敏感」,Qwen3.7 Plus 或 Flash 更合适——Flash 在 100K+20K 场景下成本仅为 Max 的 1/20。
编程场景:先用免费的 qwen3-coder:free(unified 榜 #6、$0)做原型验证,生产环境再升级到付费 Coder 480B 或 Coder Plus。多模态图文任务选 VL 235B;遗留 Qwen2.5 工作流可继续用 72B Instruct($0.36/$0.40,131K ctx)避免迁移成本。
不选 Qwen 的情况:需要最短延迟且 Qwen3 32B 的 131K 窗口不够时,应对比 Groq/DeepInfra 上的其他 vendor;需要官方 SLA 的企业合规场景,应直接对接阿里云 Model Studio 而非仅依赖 OpenRouter 镜像。
站内已有 qwen-qwen3-coder-free-review 单模型深度评测,vendor 页列出全部 49 SKU——建议从 vendor 页进入具体模型,再用 compare 页并排验证。
来源
证据与行动建议
- 时间窗口: catalog snapshot
- 观测数量: 12
- 来源类型: catalog_and_pricing
- 在 /zh/model/vendor/qwen/ 浏览全部 49 个 Qwen SKU
- 用 /zh/token/ 对比多家 provider 报价
- 阅读 /zh/insights/qwen-qwen3-coder-free-review/ 了解免费 Coder 深度评测