Qwen3.8-27B:一张 24GB 消费卡,对上 Opus 4.6 的编码表

Apache-2.0 稠密 27.78B,Q4 约 17GB,能进 24GB 消费卡。OpenRouter 主 listing $0.45/$3.20。Qwen 启动表(厂商自评)SWE-bench Pro 61.7,对 Opus 4.6 Max 导入分 53.4;Terminal-Bench 73.0 对 78.2。同任务 100K+20K:本地约 $0,托管约 $0.11,Opus $1.00。非独立基准测试。

Qwen 启动表:3.8-27B 对 3.6-27B、3.7-Plus、Opus 4.6 Max 点击放大图片
厂商自评。SWE-Pro 的 Opus 格是导入官方分,不是同 harness 重跑。

它是什么,以及为什么这张表吓人

Qwen3.8-27B 是 2026-08-14 放出的 Apache-2.0 稠密多模态权重:HF 精确 27,781,427,952 参数,文本/图像/视频进、文本出,原生 262K。它不是 Qwen3-8B,也不是只能走 API 的 Qwen3.8-Max。

震撼不在「又一个 27B」,而在门槛。第三方 Q4_K_M 约 17.1GB,加视觉投影仍能塞进一张 24GB 消费卡——今晚就能在书桌上跑编码智能体。对照对象是 Claude Opus 4.6:本站 OpenRouter 主 listing $5/$25,权重不可下载。

上图四条是 Qwen 自己的启动表。3.8-27B 在 SWE-Pro、LiveCodeBench、OSWorld 上高于表内的 Opus 4.6 Max;Terminal-Bench 落后 5.2 分。这是宣传口径,不是独立复现——但「准一线分数、消费卡可跑」是这篇文章要钉死的对照。

规格对照表

数字能对上的,先摊在桌上。四列均来自站内目录与 OpenRouter 主 listing(`qwen/qwen3.8-27b` 现为 $0.45/$3.20)。

3.8-27B 3.6-27B 3.8-Max Opus 4.6
Released 2026-08-14 (HF) catalog first_seen 2026-06-22 catalog first_seen 2026-08-04 in catalog
Params 27.78B dense ~27.8B dense flagship 3.8 API frontier API
Weights Apache-2.0 download Apache-2.0 + API API only API only
Context 262K native / 1M YaRN 262K 本组最优 1M 本组最优 1M
Modality text+image+video→text text+image+video→text text+image+video→text multimodal API
OpenRouter $/1M $0.45 / $3.20 本组最优 $0.289 / $2.40 $2.00 / $6.00 $5.00 / $25.00

3.8-27B 与 3.6-27B 公布的解码器几乎同形(64 层混合注意力,hidden 5120)。编码跃迁更像训练/后训练,不是换骨架。Max 与 Opus 是另一条产品线:1M 托管、按 token 付钱、你永远不拥有权重。3.8-27B 两边都有:可下载跑本地,也可走同一套权重的托管 API。

同一份活:本地约 $0,托管约 $0.11,Opus $1

100K 输入 + 20K 输出的美元成本 点击放大图片
OpenRouter 主 listing。本地 3.8-27B 只算电;托管同权重约 $0.11。

场景固定为 100K 输入 + 20K 输出,用站内 OpenRouter 主 listing 复算。这不是能力分,是「同一份 token 活你付给谁」。

Model In $/1M Out $/1M 100K+20K Role
3.8-27B local 本组最优 ~$0 (electricity) 24GB Q4 desk
Qwen3 Coder 30B A3B 本组最优 $0.07 本组最优 $0.27 $0.012 cheap code API
Qwen3 Coder 480B $0.30 $1.00 $0.050 hosted code flagship
Qwen3.6-27B API $0.289 $2.40 $0.077 same-size predecessor
Qwen3.8-27B API $0.45 $3.20 $0.109 same weights, hosted
Qwen3.8-Max $2.00 $6.00 $0.32 same-gen cloud flagship
Claude Opus 4.6 $5.00 $25.00 $1.00 frontier coding API
GPT-5.6 Sol $5.00 $30.00 $1.10 OpenAI coding flagship

读法:Opus 4.6 与 GPT-5.6 Sol 做这份活约 $1;同代 Max 约 $0.32;3.8-27B 托管约 $0.11(比前代 3.6-27B 的 $0.077 略贵);托管 Coder 旗舰约 $0.05。同一套权重若跑在你自己的 24GB 卡上,token 标价是零——你付的是电和折旧。DeepSeek V4 Flash 0731 是另一极端:284B MoE、OpenRouter $0.09/$0.18,便宜但不是消费卡能下载的体积。

Coding:对 Opus 4.6,而不是只打自家

Qwen 启动表把 3.8-27B、前代 3.6-27B、托管 3.7-Plus、以及 Claude Opus 4.6 Max 放在同一张纸上。下面整表照录。口径:厂商自评;若干行用 Claude Code;SWE-bench Pro 的 Opus 格是导入官方分(表上打 *),不是同 harness 重跑;QwenSWEBench / CoWorkBench 是内部套件。

Benchmark 3.8-27B 3.6-27B 3.7-Plus Opus 4.6 Max
Terminal-Bench 2.1 73.0 63.4 64.0 本组最优 78.2
SWE-bench Pro* 本组最优 61.7 53.5 57.6 53.4
LiveCodeBench v6 本组最优 90.3 83.9 89.6 88.8
OSWorld-Verified 本组最优 84.3 63.9 73.3 72.7
QwenSWEBench 本组最优 79.0 49.3 59.2 63.8
DeepSWE 1.1 本组最优 42.2 13.3 14.2
NL2Repo-Bench 42.3 36.2 41.1 本组最优 47.6
GPQA Diamond 89.2 87.8 90.3 本组最优 91.3

对照一线该怎么读:相对 Opus 4.6,这颗 27B 在 SWE-Pro、LiveCodeBench、OSWorld、QwenSWEBench 上领先或持平偏强;Terminal-Bench 与 NL2Repo、GPQA 仍落后。相对前代 3.6-27B,编码智能体是一次断层(DeepSWE 13.3→42.2,QwenSWEBench 49.3→79.0)。相对 Plus API,稠密 27B 在多数编码行不落下风——而且 Plus 要按 token 付钱,27B 可以离开机房。

表里没有 Coder 480B,也没有 GPT-5.6 Sol 的同台分。不要把 61.7 说成「已经赢了所有一线」。能下的判断是:要截图修 UI、私有仓库不出网、接受厂商表口径 → 24GB 上的 3.8-27B 第一次看起来像准一线;要 SLA、1M 托管、不愿养卡 → 继续付 Opus / Sol / Max。

硬件入门:今晚就能跑,不是「总有一天」

权重体积对 24GB 消费卡参考线 点击放大图片
只算权重。KV 另算。Q4 是 Unsloth 第三方,非官方。V4 Flash 约 149GB 为公开 serving 口径。

把门槛说成「能跑」太轻。准确的句子是:一张 24GB 消费卡(4090 这一档)今晚能载入第三方 4bit,并在 8K–32K 上下文里当编码智能体用。Opus 4.6 做不到「载入」——它没有给你权重。Coder 480B / V4 Flash 不是这个机箱的故事。

Rig Fits Context to start What you get What you give up
24GB consumer GPU Q4_K_M ~17.1GB* 8K–32K Coding agent tonight Opus never leaves the API
32–48GB workstation FP8 30.9GB 32K–64K Less quant damage Still no download for Opus
80GB-class card BF16 55.6GB native 262K is tight Need KV budget (~16GiB @262K) API still simpler
No local GPU n/a 262K–1M hosted Pay OpenRouter 3.8-27B $0.45/$3.20; Max $2/$6; Opus $5/$25

不要把两句话焊在一起:「17GB 能载入」和「支持 262K」。全注意力 KV 在 262K BF16 的下限约 16GiB,只算 16 层全注意力。24GB 卡跑满窗口会先爆显存,不是先爆能力。入门协议:钉 8K–32K,关掉 1M YaRN,用同一组失败的仓库修复任务验收量化损失。舒适档是 48GB 上的 FP8;原生 BF16 + 满 262K 按 80GB 级规划。

这才是低门槛的震撼:一线 API 要 $5/$25 且永不下载;这颗 27B 用一张游戏卡就能上桌。量化会伤推理、视觉和工具格式——震撼的是能开始,不是已经等于 Opus。

站内榜:代理指标,不是这张编码表

本站统一综合榜奖励长上下文与低单价,不是 SWE。本快照里 3.8-27B(已有 $0.45/$3.20)、3.6-27B、3.8-Max、Opus 4.6 都未因「编码强」而出现在该公式的顶部——262K + 中等价位打不过 1M 的 Flash 槽位。

On-site unified slot Model Why it ranks
#21 Qwen3.7-Flash 1M ctx + $0.03/$0.13
#93 Qwen3.5-Flash 1M + cheap
#97 Qwen3 Coder Flash 1M code API, still cheap
#100 Qwen3.7-Plus 1M, $0.32/$1.28
not on board 3.8-27B / Opus 4.6 listing ≠ 1M-cheap Flash slot / frontier sticker

HF Hot 仍把官方 Qwen3.6-27B 放在 sort_index=45,下载约 6,895,121。3.8-27B 尚未进入该热榜快照。综合榜不会因为 SWE 61.7 而上升。以上不是能力基准测试。

何时选 27B,何时继续付 Opus

选 3.8-27B:有一张 24GB 卡、仓库不能出网、要看截图/终端、能接受厂商表而不是独立榜。把它当 3.6-27B 的编码升级,用同一组失败测试验收 Q4。没有卡时,可走 OpenRouter `qwen/qwen3.8-27b`($0.45/$3.20,同任务约 $0.11)——比 Opus 便宜一个数量级,但仍贵过 Coder 小模型。

继续付 Opus 4.6 / GPT-5.6 Sol:要 SLA、1M 托管、不愿养 GPU、不能吃「导入分 / 内部套件」的口径风险。付 Max:要同代 Qwen 旗舰 API,单价低于 Opus($2/$6 对 $5/$25)。付 Coder 480B:只要文本代码、要现成 262K API,不必下载 27B。

别把托管 3.8-27B 说成「最便宜的 27B API」——同尺寸前代 3.6-27B 与 Coder 30B 更便宜。别把 24GB 入门说成满 262K。用 Token 页、对比页、站内模型页做定量取舍。

洞察