Qwen3.8-27B: потребительская 24ГБ-карта против coding-таблицы Opus 4.6

Плотный 27.78B Apache-2.0. Q4 ~17ГБ влезает в 24ГБ consumer. OpenRouter primary $0.45/$3.20. Таблица Qwen (самооценка): SWE-bench Pro 61.7 против импорта Opus 4.6 Max 53.4; Terminal-Bench 73.0 против 78.2. 100K+20K: локально ~$0, хост ~$0.11, Opus $1.00. Не независимый бенчмарк.

Стартовая таблица Qwen: 3.8-27B против 3.6-27B, 3.7-Plus, Opus 4.6 Max Увеличить изображение
Самооценка. Ячейка Opus в SWE-Pro — импортированный официальный балл, не повтор на том же harness.

Что это и почему эта таблица важна

Qwen3.8-27B — плотные мультимодальные веса Apache-2.0 от 2026-08-14: 27 781 427 952 параметров, нативно 262K. Это не Qwen3-8B и не API-only Qwen3.8-Max.

Удар — порог входа. Сторонний Q4_K_M (~17,1ГБ) влезает в 24ГБ consumer GPU: coding-агент сегодня вечером на столе. Сравнение — Claude Opus 4.6: OpenRouter primary $5/$25, веса не скачать.

Четыре столбика — из таблицы Qwen. 3.8-27B выше Opus 4.6 Max на SWE-Pro, LiveCodeBench и OSWorld; Terminal-Bench −5,2. Это маркетинг, не независимая воспроизводимость — и всё равно то сравнение, которое нужно зафиксировать.

Таблица спецификаций

Сначала проверяемые цифры. Все четыре колонки — каталог и OpenRouter primary (`qwen/qwen3.8-27b` сейчас $0.45/$3.20).

3.8-27B 3.6-27B 3.8-Max Opus 4.6
Released 2026-08-14 (HF) catalog first_seen 2026-06-22 catalog first_seen 2026-08-04 in catalog
Params 27.78B dense ~27.8B dense flagship 3.8 API frontier API
Weights Apache-2.0 download Apache-2.0 + API API only API only
Context 262K native / 1M YaRN 262K Лучшее в этом сравнении 1M Лучшее в этом сравнении 1M
Modality text+image+video→text text+image+video→text text+image+video→text multimodal API
OpenRouter $/1M $0.45 / $3.20 Лучшее в этом сравнении $0.289 / $2.40 $2.00 / $6.00 $5.00 / $25.00

Опубликованный декодер 3.8-27B и 3.6-27B почти тот же (64 гибридных слоя, hidden 5120). Скачок в коде — обучение, не новый скелет. Max и Opus — другая линия: хостовый 1M, оплата за токен, веса вам не принадлежат. У 3.8-27B оба пути: локальная загрузка или хостовый API на тех же весах.

Та же работа: локально ~$0, хост ~$0.11, Opus $1

Стоимость 100K ввод + 20K вывод в USD Увеличить изображение
OpenRouter primary. Локальный 3.8-27B — электричество; хост тех же весов ~$0.11.

Сценарий фиксирован: 100K+20K. Это не способность: кому вы платите за ту же token-работу.

Model In $/1M Out $/1M 100K+20K Role
3.8-27B local Лучшее в этом сравнении ~$0 (electricity) 24GB Q4 desk
Qwen3 Coder 30B A3B Лучшее в этом сравнении $0.07 Лучшее в этом сравнении $0.27 $0.012 cheap code API
Qwen3 Coder 480B $0.30 $1.00 $0.050 hosted code flagship
Qwen3.6-27B API $0.289 $2.40 $0.077 same-size predecessor
Qwen3.8-27B API $0.45 $3.20 $0.109 same weights, hosted
Qwen3.8-Max $2.00 $6.00 $0.32 same-gen cloud flagship
Claude Opus 4.6 $5.00 $25.00 $1.00 frontier coding API
GPT-5.6 Sol $5.00 $30.00 $1.10 OpenAI coding flagship

Opus 4.6 и GPT-5.6 Sol: ~$1. Max того же поколения: ~$0.32. Хост 3.8-27B: ~$0.11 (чуть дороже предшественника 3.6-27B за $0.077). Хостовый Coder-флагман: ~$0.05. Те же веса на вашей 24ГБ-карте: token-стикер ноль — вы платите за электричество и амортизацию. DeepSeek V4 Flash 0731 — другой полюс: MoE 284B по $0.09/$0.18, не consumer-download.

Coding: против Opus 4.6, не только против семьи

Стартовая таблица Qwen ставит 3.8-27B, предшественника 3.6-27B, хостовый Plus и Claude Opus 4.6 Max на один лист. Самооценка; часть строк — Claude Code; ячейка Opus в SWE-Pro импортирована (*); QwenSWEBench внутренний.

Benchmark 3.8-27B 3.6-27B 3.7-Plus Opus 4.6 Max
Terminal-Bench 2.1 73.0 63.4 64.0 Лучшее в этом сравнении 78.2
SWE-bench Pro* Лучшее в этом сравнении 61.7 53.5 57.6 53.4
LiveCodeBench v6 Лучшее в этом сравнении 90.3 83.9 89.6 88.8
OSWorld-Verified Лучшее в этом сравнении 84.3 63.9 73.3 72.7
QwenSWEBench Лучшее в этом сравнении 79.0 49.3 59.2 63.8
DeepSWE 1.1 Лучшее в этом сравнении 42.2 13.3 14.2
NL2Repo-Bench 42.3 36.2 41.1 Лучшее в этом сравнении 47.6
GPQA Diamond 89.2 87.8 90.3 Лучшее в этом сравнении 91.3

Чтение против первой линии: против Opus 4.6 27B ведёт или выше на SWE-Pro, LiveCodeBench, OSWorld и QwenSWEBench; отстаёт на Terminal-Bench, NL2Repo и GPQA. Против 3.6-27B агент — разрыв (DeepSWE 13.3→42.2). Против Plus плотный 27B не проваливается на большинстве code-строк — Plus оплачивается за токен.

В таблице нет Coder 480B и нет GPT-5.6 Sol на том же harness. Не делайте из 61.7 победу над всей границей. Решение: UI по скриншотам и частный репозиторий → 3.8-27B на 24ГБ впервые выглядит как near-frontier. SLA и хостовый 1M → продолжайте платить Opus / Sol / Max.

Железо для старта: сегодня вечером, не «когда-нибудь»

След весов против линии 24ГБ consumer Увеличить изображение
Только веса. KV отдельно. Q4 — сторонний Unsloth. ~149ГБ у V4 Flash — публичный serving.

«Запускается» — слабо. Точная фраза: 24ГБ consumer GPU (класс 4090) сегодня вечером загрузит сторонний 4bit и станет coding-агентом на 8K–32K. Opus 4.6 нельзя «загрузить» — вам не отдают веса. Coder 480B / V4 Flash в этот корпус не лезут.

Rig Fits Context to start What you get What you give up
24GB consumer GPU Q4_K_M ~17.1GB* 8K–32K Coding agent tonight Opus never leaves the API
32–48GB workstation FP8 30.9GB 32K–64K Less quant damage Still no download for Opus
80GB-class card BF16 55.6GB native 262K is tight Need KV budget (~16GiB @262K) API still simpler
No local GPU n/a 262K–1M hosted Pay OpenRouter 3.8-27B $0.45/$3.20; Max $2/$6; Opus $5/$25

Не сваривайте «влезает в 17ГБ» с «поддерживает 262K». Нижняя оценка full-attention KV на 262K BF16 — ~16ГиБ (только 16 слоёв). На 24ГБ сначала умирает VRAM. Старт: 8K–32K, без 1M YaRN, те же починки репозитория. Комфорт: FP8 на 48ГБ. BF16 на полном 262K — класс 80ГБ.

В этом низкий порог: first-line API стоит $5/$25 и никогда не скачивается. Этот 27B садится на игровой GPU. Квантизация бьёт reasoning — шок в том, что можно начать, а не в том, что это уже Opus.

Рейтинг сайта: прокси, не эта coding-таблица

Сводный рейтинг сайта награждает длинный контекст и низкую цену, не SWE. В этом снапшоте 3.8-27B (уже $0.45/$3.20), 3.6-27B, 3.8-Max и Opus 4.6 не поднимаются за «умение кодить»: 262K по средней цене не бьёт 1M Flash-слот.

On-site unified slot Model Why it ranks
#21 Qwen3.7-Flash 1M ctx + $0.03/$0.13
#93 Qwen3.5-Flash 1M + cheap
#97 Qwen3 Coder Flash 1M code API, still cheap
#100 Qwen3.7-Plus 1M, $0.32/$1.28
not on board 3.8-27B / Opus 4.6 listing ≠ 1M-cheap Flash slot / frontier sticker

HF Hot держит официальный Qwen3.6-27B на sort_index=45 (~6 895 121 загрузок). 3.8-27B нет. Сводный рейтинг не вырастет из-за SWE 61.7. Это не бенчмарк способностей.

Когда выбирать 27B, когда продолжать платить Opus

Выбирать 3.8-27B: есть 24ГБ-карта, репозиторий не выходит, нужны экраны, таблица вендора приемлема. Сверяйте с 3.6-27B на тех же тестах; меряйте Q4. Без карты — OpenRouter `qwen/qwen3.8-27b` ($0.45/$3.20, ~$0.11 та же работа) — на порядок дешевле Opus, но дороже маленького Coder.

Платить Opus 4.6 / GPT-5.6 Sol: SLA, хостовый 1M, без GPU, без риска импортированных баллов. Платить Max: Qwen-флагман того же поколения дешевле Opus ($2/$6 против $5/$25). Coder 480B: только текст и готовый 262K API.

Не берите как «самый дешёвый 27B API» — предшественник 3.6-27B и Coder 30B дешевле. Старт на 24ГБ — не полный 262K. Решайте по Token, compare и странице модели.

Инсайты