Qwen3.8-27B: потребительская 24ГБ-карта против coding-таблицы Opus 4.6
Плотный 27.78B Apache-2.0. Q4 ~17ГБ влезает в 24ГБ consumer. OpenRouter primary $0.45/$3.20. Таблица Qwen (самооценка): SWE-bench Pro 61.7 против импорта Opus 4.6 Max 53.4; Terminal-Bench 73.0 против 78.2. 100K+20K: локально ~$0, хост ~$0.11, Opus $1.00. Не независимый бенчмарк.
Увеличить изображение Что это и почему эта таблица важна
Qwen3.8-27B — плотные мультимодальные веса Apache-2.0 от 2026-08-14: 27 781 427 952 параметров, нативно 262K. Это не Qwen3-8B и не API-only Qwen3.8-Max.
Удар — порог входа. Сторонний Q4_K_M (~17,1ГБ) влезает в 24ГБ consumer GPU: coding-агент сегодня вечером на столе. Сравнение — Claude Opus 4.6: OpenRouter primary $5/$25, веса не скачать.
Четыре столбика — из таблицы Qwen. 3.8-27B выше Opus 4.6 Max на SWE-Pro, LiveCodeBench и OSWorld; Terminal-Bench −5,2. Это маркетинг, не независимая воспроизводимость — и всё равно то сравнение, которое нужно зафиксировать.
Таблица спецификаций
Сначала проверяемые цифры. Все четыре колонки — каталог и OpenRouter primary (`qwen/qwen3.8-27b` сейчас $0.45/$3.20).
| 3.8-27B | 3.6-27B | 3.8-Max | Opus 4.6 | |
|---|---|---|---|---|
| Released | 2026-08-14 (HF) | catalog first_seen 2026-06-22 | catalog first_seen 2026-08-04 | in catalog |
| Params | 27.78B dense | ~27.8B dense | flagship 3.8 API | frontier API |
| Weights | Apache-2.0 download | Apache-2.0 + API | API only | API only |
| Context | 262K native / 1M YaRN | 262K | Лучшее в этом сравнении 1M | Лучшее в этом сравнении 1M |
| Modality | text+image+video→text | text+image+video→text | text+image+video→text | multimodal API |
| OpenRouter $/1M | $0.45 / $3.20 | Лучшее в этом сравнении $0.289 / $2.40 | $2.00 / $6.00 | $5.00 / $25.00 |
Опубликованный декодер 3.8-27B и 3.6-27B почти тот же (64 гибридных слоя, hidden 5120). Скачок в коде — обучение, не новый скелет. Max и Opus — другая линия: хостовый 1M, оплата за токен, веса вам не принадлежат. У 3.8-27B оба пути: локальная загрузка или хостовый API на тех же весах.
Та же работа: локально ~$0, хост ~$0.11, Opus $1
Увеличить изображение Сценарий фиксирован: 100K+20K. Это не способность: кому вы платите за ту же token-работу.
| Model | In $/1M | Out $/1M | 100K+20K | Role |
|---|---|---|---|---|
| 3.8-27B local | — | — | Лучшее в этом сравнении ~$0 (electricity) | 24GB Q4 desk |
| Qwen3 Coder 30B A3B | Лучшее в этом сравнении $0.07 | Лучшее в этом сравнении $0.27 | $0.012 | cheap code API |
| Qwen3 Coder 480B | $0.30 | $1.00 | $0.050 | hosted code flagship |
| Qwen3.6-27B API | $0.289 | $2.40 | $0.077 | same-size predecessor |
| Qwen3.8-27B API | $0.45 | $3.20 | $0.109 | same weights, hosted |
| Qwen3.8-Max | $2.00 | $6.00 | $0.32 | same-gen cloud flagship |
| Claude Opus 4.6 | $5.00 | $25.00 | $1.00 | frontier coding API |
| GPT-5.6 Sol | $5.00 | $30.00 | $1.10 | OpenAI coding flagship |
Opus 4.6 и GPT-5.6 Sol: ~$1. Max того же поколения: ~$0.32. Хост 3.8-27B: ~$0.11 (чуть дороже предшественника 3.6-27B за $0.077). Хостовый Coder-флагман: ~$0.05. Те же веса на вашей 24ГБ-карте: token-стикер ноль — вы платите за электричество и амортизацию. DeepSeek V4 Flash 0731 — другой полюс: MoE 284B по $0.09/$0.18, не consumer-download.
Coding: против Opus 4.6, не только против семьи
Стартовая таблица Qwen ставит 3.8-27B, предшественника 3.6-27B, хостовый Plus и Claude Opus 4.6 Max на один лист. Самооценка; часть строк — Claude Code; ячейка Opus в SWE-Pro импортирована (*); QwenSWEBench внутренний.
| Benchmark | 3.8-27B | 3.6-27B | 3.7-Plus | Opus 4.6 Max |
|---|---|---|---|---|
| Terminal-Bench 2.1 | 73.0 | 63.4 | 64.0 | Лучшее в этом сравнении 78.2 |
| SWE-bench Pro* | Лучшее в этом сравнении 61.7 | 53.5 | 57.6 | 53.4 |
| LiveCodeBench v6 | Лучшее в этом сравнении 90.3 | 83.9 | 89.6 | 88.8 |
| OSWorld-Verified | Лучшее в этом сравнении 84.3 | 63.9 | 73.3 | 72.7 |
| QwenSWEBench | Лучшее в этом сравнении 79.0 | 49.3 | 59.2 | 63.8 |
| DeepSWE 1.1 | Лучшее в этом сравнении 42.2 | 13.3 | 14.2 | — |
| NL2Repo-Bench | 42.3 | 36.2 | 41.1 | Лучшее в этом сравнении 47.6 |
| GPQA Diamond | 89.2 | 87.8 | 90.3 | Лучшее в этом сравнении 91.3 |
Чтение против первой линии: против Opus 4.6 27B ведёт или выше на SWE-Pro, LiveCodeBench, OSWorld и QwenSWEBench; отстаёт на Terminal-Bench, NL2Repo и GPQA. Против 3.6-27B агент — разрыв (DeepSWE 13.3→42.2). Против Plus плотный 27B не проваливается на большинстве code-строк — Plus оплачивается за токен.
В таблице нет Coder 480B и нет GPT-5.6 Sol на том же harness. Не делайте из 61.7 победу над всей границей. Решение: UI по скриншотам и частный репозиторий → 3.8-27B на 24ГБ впервые выглядит как near-frontier. SLA и хостовый 1M → продолжайте платить Opus / Sol / Max.
Железо для старта: сегодня вечером, не «когда-нибудь»
Увеличить изображение «Запускается» — слабо. Точная фраза: 24ГБ consumer GPU (класс 4090) сегодня вечером загрузит сторонний 4bit и станет coding-агентом на 8K–32K. Opus 4.6 нельзя «загрузить» — вам не отдают веса. Coder 480B / V4 Flash в этот корпус не лезут.
| Rig | Fits | Context to start | What you get | What you give up |
|---|---|---|---|---|
| 24GB consumer GPU | Q4_K_M ~17.1GB* | 8K–32K | Coding agent tonight | Opus never leaves the API |
| 32–48GB workstation | FP8 30.9GB | 32K–64K | Less quant damage | Still no download for Opus |
| 80GB-class card | BF16 55.6GB | native 262K is tight | Need KV budget (~16GiB @262K) | API still simpler |
| No local GPU | n/a | 262K–1M hosted | Pay OpenRouter | 3.8-27B $0.45/$3.20; Max $2/$6; Opus $5/$25 |
Не сваривайте «влезает в 17ГБ» с «поддерживает 262K». Нижняя оценка full-attention KV на 262K BF16 — ~16ГиБ (только 16 слоёв). На 24ГБ сначала умирает VRAM. Старт: 8K–32K, без 1M YaRN, те же починки репозитория. Комфорт: FP8 на 48ГБ. BF16 на полном 262K — класс 80ГБ.
В этом низкий порог: first-line API стоит $5/$25 и никогда не скачивается. Этот 27B садится на игровой GPU. Квантизация бьёт reasoning — шок в том, что можно начать, а не в том, что это уже Opus.
Рейтинг сайта: прокси, не эта coding-таблица
Сводный рейтинг сайта награждает длинный контекст и низкую цену, не SWE. В этом снапшоте 3.8-27B (уже $0.45/$3.20), 3.6-27B, 3.8-Max и Opus 4.6 не поднимаются за «умение кодить»: 262K по средней цене не бьёт 1M Flash-слот.
| On-site unified slot | Model | Why it ranks |
|---|---|---|
| #21 | Qwen3.7-Flash | 1M ctx + $0.03/$0.13 |
| #93 | Qwen3.5-Flash | 1M + cheap |
| #97 | Qwen3 Coder Flash | 1M code API, still cheap |
| #100 | Qwen3.7-Plus | 1M, $0.32/$1.28 |
| not on board | 3.8-27B / Opus 4.6 | listing ≠ 1M-cheap Flash slot / frontier sticker |
HF Hot держит официальный Qwen3.6-27B на sort_index=45 (~6 895 121 загрузок). 3.8-27B нет. Сводный рейтинг не вырастет из-за SWE 61.7. Это не бенчмарк способностей.
Когда выбирать 27B, когда продолжать платить Opus
Выбирать 3.8-27B: есть 24ГБ-карта, репозиторий не выходит, нужны экраны, таблица вендора приемлема. Сверяйте с 3.6-27B на тех же тестах; меряйте Q4. Без карты — OpenRouter `qwen/qwen3.8-27b` ($0.45/$3.20, ~$0.11 та же работа) — на порядок дешевле Opus, но дороже маленького Coder.
Платить Opus 4.6 / GPT-5.6 Sol: SLA, хостовый 1M, без GPU, без риска импортированных баллов. Платить Max: Qwen-флагман того же поколения дешевле Opus ($2/$6 против $5/$25). Coder 480B: только текст и готовый 262K API.
Не берите как «самый дешёвый 27B API» — предшественник 3.6-27B и Coder 30B дешевле. Старт на 24ГБ — не полный 262K. Решайте по Token, compare и странице модели.