Qwen3.8-27B:一张 24GB 消费卡,对上 Opus 4.6 的编码表
Apache-2.0 稠密 27.78B,Q4 约 17GB,能进 24GB 消费卡。OpenRouter 主 listing $0.45/$3.20。Qwen 启动表(厂商自评)SWE-bench Pro 61.7,对 Opus 4.6 Max 导入分 53.4;Terminal-Bench 73.0 对 78.2。同任务 100K+20K:本地约 $0,托管约 $0.11,Opus $1.00。非独立基准测试。
点击放大图片 它是什么,以及为什么这张表吓人
Qwen3.8-27B 是 2026-08-14 放出的 Apache-2.0 稠密多模态权重:HF 精确 27,781,427,952 参数,文本/图像/视频进、文本出,原生 262K。它不是 Qwen3-8B,也不是只能走 API 的 Qwen3.8-Max。
震撼不在「又一个 27B」,而在门槛。第三方 Q4_K_M 约 17.1GB,加视觉投影仍能塞进一张 24GB 消费卡——今晚就能在书桌上跑编码智能体。对照对象是 Claude Opus 4.6:本站 OpenRouter 主 listing $5/$25,权重不可下载。
上图四条是 Qwen 自己的启动表。3.8-27B 在 SWE-Pro、LiveCodeBench、OSWorld 上高于表内的 Opus 4.6 Max;Terminal-Bench 落后 5.2 分。这是宣传口径,不是独立复现——但「准一线分数、消费卡可跑」是这篇文章要钉死的对照。
规格对照表
数字能对上的,先摊在桌上。四列均来自站内目录与 OpenRouter 主 listing(`qwen/qwen3.8-27b` 现为 $0.45/$3.20)。
| 3.8-27B | 3.6-27B | 3.8-Max | Opus 4.6 | |
|---|---|---|---|---|
| Released | 2026-08-14 (HF) | catalog first_seen 2026-06-22 | catalog first_seen 2026-08-04 | in catalog |
| Params | 27.78B dense | ~27.8B dense | flagship 3.8 API | frontier API |
| Weights | Apache-2.0 download | Apache-2.0 + API | API only | API only |
| Context | 262K native / 1M YaRN | 262K | 本组最优 1M | 本组最优 1M |
| Modality | text+image+video→text | text+image+video→text | text+image+video→text | multimodal API |
| OpenRouter $/1M | $0.45 / $3.20 | 本组最优 $0.289 / $2.40 | $2.00 / $6.00 | $5.00 / $25.00 |
3.8-27B 与 3.6-27B 公布的解码器几乎同形(64 层混合注意力,hidden 5120)。编码跃迁更像训练/后训练,不是换骨架。Max 与 Opus 是另一条产品线:1M 托管、按 token 付钱、你永远不拥有权重。3.8-27B 两边都有:可下载跑本地,也可走同一套权重的托管 API。
同一份活:本地约 $0,托管约 $0.11,Opus $1
点击放大图片 场景固定为 100K 输入 + 20K 输出,用站内 OpenRouter 主 listing 复算。这不是能力分,是「同一份 token 活你付给谁」。
| Model | In $/1M | Out $/1M | 100K+20K | Role |
|---|---|---|---|---|
| 3.8-27B local | — | — | 本组最优 ~$0 (electricity) | 24GB Q4 desk |
| Qwen3 Coder 30B A3B | 本组最优 $0.07 | 本组最优 $0.27 | $0.012 | cheap code API |
| Qwen3 Coder 480B | $0.30 | $1.00 | $0.050 | hosted code flagship |
| Qwen3.6-27B API | $0.289 | $2.40 | $0.077 | same-size predecessor |
| Qwen3.8-27B API | $0.45 | $3.20 | $0.109 | same weights, hosted |
| Qwen3.8-Max | $2.00 | $6.00 | $0.32 | same-gen cloud flagship |
| Claude Opus 4.6 | $5.00 | $25.00 | $1.00 | frontier coding API |
| GPT-5.6 Sol | $5.00 | $30.00 | $1.10 | OpenAI coding flagship |
读法:Opus 4.6 与 GPT-5.6 Sol 做这份活约 $1;同代 Max 约 $0.32;3.8-27B 托管约 $0.11(比前代 3.6-27B 的 $0.077 略贵);托管 Coder 旗舰约 $0.05。同一套权重若跑在你自己的 24GB 卡上,token 标价是零——你付的是电和折旧。DeepSeek V4 Flash 0731 是另一极端:284B MoE、OpenRouter $0.09/$0.18,便宜但不是消费卡能下载的体积。
Coding:对 Opus 4.6,而不是只打自家
Qwen 启动表把 3.8-27B、前代 3.6-27B、托管 3.7-Plus、以及 Claude Opus 4.6 Max 放在同一张纸上。下面整表照录。口径:厂商自评;若干行用 Claude Code;SWE-bench Pro 的 Opus 格是导入官方分(表上打 *),不是同 harness 重跑;QwenSWEBench / CoWorkBench 是内部套件。
| Benchmark | 3.8-27B | 3.6-27B | 3.7-Plus | Opus 4.6 Max |
|---|---|---|---|---|
| Terminal-Bench 2.1 | 73.0 | 63.4 | 64.0 | 本组最优 78.2 |
| SWE-bench Pro* | 本组最优 61.7 | 53.5 | 57.6 | 53.4 |
| LiveCodeBench v6 | 本组最优 90.3 | 83.9 | 89.6 | 88.8 |
| OSWorld-Verified | 本组最优 84.3 | 63.9 | 73.3 | 72.7 |
| QwenSWEBench | 本组最优 79.0 | 49.3 | 59.2 | 63.8 |
| DeepSWE 1.1 | 本组最优 42.2 | 13.3 | 14.2 | — |
| NL2Repo-Bench | 42.3 | 36.2 | 41.1 | 本组最优 47.6 |
| GPQA Diamond | 89.2 | 87.8 | 90.3 | 本组最优 91.3 |
对照一线该怎么读:相对 Opus 4.6,这颗 27B 在 SWE-Pro、LiveCodeBench、OSWorld、QwenSWEBench 上领先或持平偏强;Terminal-Bench 与 NL2Repo、GPQA 仍落后。相对前代 3.6-27B,编码智能体是一次断层(DeepSWE 13.3→42.2,QwenSWEBench 49.3→79.0)。相对 Plus API,稠密 27B 在多数编码行不落下风——而且 Plus 要按 token 付钱,27B 可以离开机房。
表里没有 Coder 480B,也没有 GPT-5.6 Sol 的同台分。不要把 61.7 说成「已经赢了所有一线」。能下的判断是:要截图修 UI、私有仓库不出网、接受厂商表口径 → 24GB 上的 3.8-27B 第一次看起来像准一线;要 SLA、1M 托管、不愿养卡 → 继续付 Opus / Sol / Max。
硬件入门:今晚就能跑,不是「总有一天」
点击放大图片 把门槛说成「能跑」太轻。准确的句子是:一张 24GB 消费卡(4090 这一档)今晚能载入第三方 4bit,并在 8K–32K 上下文里当编码智能体用。Opus 4.6 做不到「载入」——它没有给你权重。Coder 480B / V4 Flash 不是这个机箱的故事。
| Rig | Fits | Context to start | What you get | What you give up |
|---|---|---|---|---|
| 24GB consumer GPU | Q4_K_M ~17.1GB* | 8K–32K | Coding agent tonight | Opus never leaves the API |
| 32–48GB workstation | FP8 30.9GB | 32K–64K | Less quant damage | Still no download for Opus |
| 80GB-class card | BF16 55.6GB | native 262K is tight | Need KV budget (~16GiB @262K) | API still simpler |
| No local GPU | n/a | 262K–1M hosted | Pay OpenRouter | 3.8-27B $0.45/$3.20; Max $2/$6; Opus $5/$25 |
不要把两句话焊在一起:「17GB 能载入」和「支持 262K」。全注意力 KV 在 262K BF16 的下限约 16GiB,只算 16 层全注意力。24GB 卡跑满窗口会先爆显存,不是先爆能力。入门协议:钉 8K–32K,关掉 1M YaRN,用同一组失败的仓库修复任务验收量化损失。舒适档是 48GB 上的 FP8;原生 BF16 + 满 262K 按 80GB 级规划。
这才是低门槛的震撼:一线 API 要 $5/$25 且永不下载;这颗 27B 用一张游戏卡就能上桌。量化会伤推理、视觉和工具格式——震撼的是能开始,不是已经等于 Opus。
站内榜:代理指标,不是这张编码表
本站统一综合榜奖励长上下文与低单价,不是 SWE。本快照里 3.8-27B(已有 $0.45/$3.20)、3.6-27B、3.8-Max、Opus 4.6 都未因「编码强」而出现在该公式的顶部——262K + 中等价位打不过 1M 的 Flash 槽位。
| On-site unified slot | Model | Why it ranks |
|---|---|---|
| #21 | Qwen3.7-Flash | 1M ctx + $0.03/$0.13 |
| #93 | Qwen3.5-Flash | 1M + cheap |
| #97 | Qwen3 Coder Flash | 1M code API, still cheap |
| #100 | Qwen3.7-Plus | 1M, $0.32/$1.28 |
| not on board | 3.8-27B / Opus 4.6 | listing ≠ 1M-cheap Flash slot / frontier sticker |
HF Hot 仍把官方 Qwen3.6-27B 放在 sort_index=45,下载约 6,895,121。3.8-27B 尚未进入该热榜快照。综合榜不会因为 SWE 61.7 而上升。以上不是能力基准测试。
何时选 27B,何时继续付 Opus
选 3.8-27B:有一张 24GB 卡、仓库不能出网、要看截图/终端、能接受厂商表而不是独立榜。把它当 3.6-27B 的编码升级,用同一组失败测试验收 Q4。没有卡时,可走 OpenRouter `qwen/qwen3.8-27b`($0.45/$3.20,同任务约 $0.11)——比 Opus 便宜一个数量级,但仍贵过 Coder 小模型。
继续付 Opus 4.6 / GPT-5.6 Sol:要 SLA、1M 托管、不愿养 GPU、不能吃「导入分 / 内部套件」的口径风险。付 Max:要同代 Qwen 旗舰 API,单价低于 Opus($2/$6 对 $5/$25)。付 Coder 480B:只要文本代码、要现成 262K API,不必下载 27B。
别把托管 3.8-27B 说成「最便宜的 27B API」——同尺寸前代 3.6-27B 与 Coder 30B 更便宜。别把 24GB 入门说成满 262K。用 Token 页、对比页、站内模型页做定量取舍。