Qwen モデルシリーズ徹底レビュー:Qwen2.5 から Qwen3.7 までの選び方

カタログに49のQwen SKUがMax・Plus・Flash・Coder・VLの5ライン。旗艦Qwen3.7 Maxは入出力$1.25/$3.75、Flashは$0.065/$0.26、無料Coderはunified榜#6。

Qwen シリーズとは

Qwen(通義千問)はAlibaba傘下のオープン&ホスト型LLMブランドで、当サイトのカタログでは vendor_id が qwen、現在49のOpenRouter SKUがミラーされています。単一モデルではなく、シナリオ別の製品マトリクスです:Maxが高難度推論、Plus/Flashが日常の長コンテキスト、Coderがプログラミングとエージェント、VLが画像テキストのマルチモーダル。APIエンドポイントが1〜2個のベンダーと異なり、Qwenは$0無料から$1.25/$3.75旗艦まで同一vendor内に価格梯度を持ちます。まずタスク種別を決め、その中でSKUを比較してください。

製品ラインマップ

世代とシナリオ別に、49 SKUは6本の主軸に整理できます。

Qwen2.5(前世代):Qwen2.5 72B Instruct(131K ctx)、Qwen2.5 Coder 32B、Qwen2.5 VL 72B——成熟・低価格のレガシーワークフロー向け。

Qwen3 ベース:8B/14B/32B/235B MoE など。Qwen3 32B は入出力 $0.08/$0.28 で軽量APIのコスパ基準。

Qwen3.5/3.6/3.7:Qwen3.5-Flash(1M ctx・マルチモーダル)、Qwen3.6 Plus/Flash、Qwen3.7 Plus/Max が現行主力。Qwen3.7 Max は1M旗艦、Qwen3 Max は262Kの前世代旗艦。

Max/Plus/Flash:Max が最高(Qwen3.7 Max $1.25/$3.75)、Plus 中位(Qwen3.7 Plus $0.32/$1.28)、Flash 最安(Qwen3.5-Flash $0.065/$0.26)。

Coder:Qwen3 Coder 480B MoE(1M ctx、$0.22/$1.80)と無料版 qwen3-coder:free($0、榜#6)。Coder Flash/Plus/Next もあり。

VL マルチモーダル:Qwen3 VL 235B/32B/8B など。Qwen3 VL 235B Instruct は $0.20/$0.88、262K ctx、画像入力対応。

スペックと価格早見(スペック派向け)

以下はOpenRouter主listing単価(USD/1M tokens、入/出)で、サイトのtokenページで検証できます。

Qwen3.7 Max:1M ctx、$1.25/$3.75——現行最高価格旗艦。

Qwen3 Max:262K ctx、$0.78/$3.90——前世代旗艦、ctx短めだが出力単価は高い。

Qwen3.7 Plus:1M ctx、$0.32/$1.28——日常長文書とエージェントのバランス档。

Qwen3.5-Flash:1M ctx、$0.065/$0.26——シリーズ最安、高並列軽量タスク向け。

Qwen3 Coder 480B:1M ctx、$0.22/$1.80——MoEコード旗艦;無料版 qwen3-coder:free も1M ctx、$0/$0。

Qwen3 32B:131K ctx、$0.08/$0.28——軽量API基準;DeepInfra、Groqなど複数プロバイダーあり。

Qwen3 VL 235B Instruct:262K ctx、$0.20/$0.88——マルチモーダル画像入力。

混合価参考(100K入+20K出):Flash ≈ $0.01、Plus/Coder ≈ $0.06、Max ≈ $0.20——最大20倍差。

サイト内ランキングとオープンソースの人気

AI Hippo unified総合榜では、Qwenは12 SKUが入榜。最高は qwen3-coder:free(#6)、次に有料 qwen3-coder(#74)、Qwen3.5-Flash(#88)、Plus/Flashクラスターは#90–#98。

重要:この総合スコアは「コンテキスト長/価格」の代理指標で、長ctxと低単価を報酬——MMLUやHumanEval等の能力ベンチマークではありません。高ランクは「スペック/価格比」が良いことを示し、能力最強を意味しません。

オープンソース側では、HFホットリストで Qwen3.6-27B のDL約496万、Qwen3.6-27B-MTP-GGUF 約290万、Qwen3.6-35B-A3B 派生約251万——ローカル展開コミュニティでの継続需要を示します。ホストAPIとローカルGGUFは別ルート:前者はトークン課金・運用不要、後者はトークンゼロ・自前算力必要。

以上はスペックとコスト信号であり、能力ベンチマークではありません。

コスト実測と選定マトリクス

2つの典型シナリオでドルコストを算出(OpenRouter主listing単価)。

シナリオA:100K入力+20K出力(中程度の対話/要約) Qwen3.7 Max ≈ $0.20 | Qwen3.7 Plus ≈ $0.06 | Qwen3.5-Flash ≈ $0.01 | Qwen3 Coder ≈ $0.06 | qwen3-coder:free = $0

シナリオB:500K入力+5K出力(長ctx検索/リポジトリスキャン) Qwen3.7 Max ≈ $0.64 | Qwen3.7 Plus ≈ $0.17 | Qwen3.5-Flash ≈ $0.03 | Qwen3 Coder ≈ $0.12

選定マトリクス: 旗艦推論・複雑エージェント → Qwen3.7 Max(1M ctx、最高価だが最長窓) 日常長文書・汎用エージェント → Qwen3.7 Plus または Qwen3.6 Plus(1M ctx、$0.32/$1.28档) 高並列軽量タスク → Qwen3.5-Flash($0.065/$0.26、最安単価) プログラミング・コードエージェント → Qwen3 Coder 480B または無料版(1M ctx、MoE) 画像テキストマルチモーダル → Qwen3 VL 235B Instruct($0.20/$0.88、262K ctx) ローカル展開/トークンゼロ → HFオープンウェイト(Qwen3.6-27B、DL約496万)

以上はスペックとコスト比較であり、能力ベンチマークではありません。

どれを選ぶべきか

Qwenを選ぶ際、3つの質問から:必要なコンテキスト長は?出力トークン比率は?マルチモーダルやローカル展開は必須か?

「1M ctx + 最高品質推論 + コスト非敏感」なら Qwen3.7 Max。「1M ctx + 日常エージェント + コスト敏感」なら Qwen3.7 Plus か Flash——Flashは100K+20KでMaxの1/20。

プログラミング:まず無料 qwen3-coder:free(unified榜#6、$0)でプロトタイプ、本番は有料Coder 480BかCoder Plusへ。マルチモーダルはVL 235B。レガシーQwen2.5は72B Instruct($0.36/$0.40、131K ctx)で移行コスト回避。

Qwenを選ばない場合:最短レイテンシが必要でQwen3 32Bの131K窓が足りないなら、Groq/DeepInfraの他ベンダーと比較。公式SLAのエンタープライズコンプライアンスなら、OpenRouterミラーのみでなくAlibaba Cloud Model Studio直接接続を。

サイトには qwen-qwen3-coder-free-review の単体詳細レビューと、49 SKUを一覧するvendorページがあります——vendorから個別モデルへ進み、compareで並べて検証してください。

出典

Evidence and actions

  • 期間: catalog snapshot
  • 観測数: 12
  • ソース種別: catalog_and_pricing
  • /ja/model/vendor/qwen/ で49のQwen SKUを確認
  • /ja/token/ でプロバイダー価格を比較
  • /ja/insights/qwen-qwen3-coder-free-review/ で無料Coderの詳細レビューを読む

インサイト