Qwen3.8-27B: una GPU de 24GB de consumo frente a la tabla de código de Opus 4.6
Denso 27.78B Apache-2.0. Q4 ~17GB cabe en 24GB de consumo. Listing principal OpenRouter $0.45/$3.20. Tabla Qwen (autoevaluación): SWE-bench Pro 61.7 vs 53.4 importado de Opus 4.6 Max; Terminal-Bench 73.0 vs 78.2. 100K+20K: local ~$0, hosted ~$0.11, Opus $1.00. No es un benchmark independiente.
Ampliar imagen Qué es, y por qué esta tabla importa
Qwen3.8-27B son pesos densos multimodales Apache-2.0 del 2026-08-14: 27.781.427.952 parámetros, contexto nativo 262K. No es Qwen3-8B ni el API-only Qwen3.8-Max.
El golpe es el umbral. Un Q4_K_M de terceros (~17,1GB) cabe en una GPU de 24GB de consumo: un agente de código esta noche, en el escritorio. El comparador es Claude Opus 4.6: listing principal OpenRouter $5/$25, sin pesos descargables.
Las cuatro barras salen de la tabla de Qwen. 3.8-27B supera a Opus 4.6 Max en SWE-Pro, LiveCodeBench y OSWorld; pierde 5,2 en Terminal-Bench. Es marketing, no una reproducción independiente — y sigue siendo la comparación que hay que clavar.
Tabla de especificaciones
Primero los números verificables. Las cuatro columnas salen del catálogo y del listing principal de OpenRouter (`qwen/qwen3.8-27b` ahora a $0.45/$3.20).
| 3.8-27B | 3.6-27B | 3.8-Max | Opus 4.6 | |
|---|---|---|---|---|
| Released | 2026-08-14 (HF) | catalog first_seen 2026-06-22 | catalog first_seen 2026-08-04 | in catalog |
| Params | 27.78B dense | ~27.8B dense | flagship 3.8 API | frontier API |
| Weights | Apache-2.0 download | Apache-2.0 + API | API only | API only |
| Context | 262K native / 1M YaRN | 262K | Mejor de esta comparación 1M | Mejor de esta comparación 1M |
| Modality | text+image+video→text | text+image+video→text | text+image+video→text | multimodal API |
| OpenRouter $/1M | $0.45 / $3.20 | Mejor de esta comparación $0.289 / $2.40 | $2.00 / $6.00 | $5.00 / $25.00 |
El decodificador publicado de 3.8-27B y 3.6-27B es casi el mismo (64 capas híbridas, hidden 5120). El salto de código es entrenamiento, no un esqueleto nuevo. Max y Opus son otra línea: 1M alojado, pago por token, nunca te quedas con los pesos. 3.8-27B tiene ambos: descarga local o API alojada con los mismos pesos.
El mismo trabajo: local ~$0, hosted ~$0.11, Opus $1
Ampliar imagen Escenario fijo 100K+20K. No es capacidad: es a quién le pagas el mismo trabajo de tokens.
| Model | In $/1M | Out $/1M | 100K+20K | Role |
|---|---|---|---|---|
| 3.8-27B local | — | — | Mejor de esta comparación ~$0 (electricity) | 24GB Q4 desk |
| Qwen3 Coder 30B A3B | Mejor de esta comparación $0.07 | Mejor de esta comparación $0.27 | $0.012 | cheap code API |
| Qwen3 Coder 480B | $0.30 | $1.00 | $0.050 | hosted code flagship |
| Qwen3.6-27B API | $0.289 | $2.40 | $0.077 | same-size predecessor |
| Qwen3.8-27B API | $0.45 | $3.20 | $0.109 | same weights, hosted |
| Qwen3.8-Max | $2.00 | $6.00 | $0.32 | same-gen cloud flagship |
| Claude Opus 4.6 | $5.00 | $25.00 | $1.00 | frontier coding API |
| GPT-5.6 Sol | $5.00 | $30.00 | $1.10 | OpenAI coding flagship |
Opus 4.6 y GPT-5.6 Sol: ~$1. Max de la misma generación: ~$0.32. 3.8-27B hosted: ~$0.11 (un poco más que el predecesor 3.6-27B a $0.077). Coder flagship alojado: ~$0.05. Los mismos pesos en tu GPU de 24GB: sticker de token cero — pagas luz y amortización. DeepSeek V4 Flash 0731 es el otro extremo: MoE 284B a $0.09/$0.18, barato, no cabe en una GPU de consumo.
Coding: contra Opus 4.6, no solo contra la familia
La tabla de lanzamiento de Qwen pone 3.8-27B, el predecesor 3.6-27B, el Plus alojado y Claude Opus 4.6 Max en la misma hoja. Autoevaluación; varias filas con Claude Code; la celda Opus de SWE-Pro es oficial importada (*); QwenSWEBench es interno.
| Benchmark | 3.8-27B | 3.6-27B | 3.7-Plus | Opus 4.6 Max |
|---|---|---|---|---|
| Terminal-Bench 2.1 | 73.0 | 63.4 | 64.0 | Mejor de esta comparación 78.2 |
| SWE-bench Pro* | Mejor de esta comparación 61.7 | 53.5 | 57.6 | 53.4 |
| LiveCodeBench v6 | Mejor de esta comparación 90.3 | 83.9 | 89.6 | 88.8 |
| OSWorld-Verified | Mejor de esta comparación 84.3 | 63.9 | 73.3 | 72.7 |
| QwenSWEBench | Mejor de esta comparación 79.0 | 49.3 | 59.2 | 63.8 |
| DeepSWE 1.1 | Mejor de esta comparación 42.2 | 13.3 | 14.2 | — |
| NL2Repo-Bench | 42.3 | 36.2 | 41.1 | Mejor de esta comparación 47.6 |
| GPQA Diamond | 89.2 | 87.8 | 90.3 | Mejor de esta comparación 91.3 |
Lectura frente a primera línea: vs Opus 4.6, el 27B gana o empata al alza en SWE-Pro, LiveCodeBench, OSWorld y QwenSWEBench; pierde Terminal-Bench, NL2Repo y GPQA. Vs 3.6-27B el salto de agente es un corte (DeepSWE 13.3→42.2). Vs Plus, el denso 27B no se cae en la mayoría de filas de código — y Plus se paga por token.
No está Coder 480B ni GPT-5.6 Sol en el mismo harness. No convierta 61.7 en «ganó a toda la frontera». Decida: UI con capturas y repo privado → 3.8-27B en 24GB por fin parece casi primera línea. SLA y 1M alojado → siga pagando Opus / Sol / Max.
Hardware de entrada: esta noche, no «algún día»
Ampliar imagen «Puede correr» se queda corto. La frase exacta: una GPU de 24GB de consumo (clase 4090) puede cargar un 4bit de terceros esta noche y servir de agente de código a 8K–32K. Opus 4.6 no se «carga»: no te da los pesos. Coder 480B / V4 Flash no caben en esa caja.
| Rig | Fits | Context to start | What you get | What you give up |
|---|---|---|---|---|
| 24GB consumer GPU | Q4_K_M ~17.1GB* | 8K–32K | Coding agent tonight | Opus never leaves the API |
| 32–48GB workstation | FP8 30.9GB | 32K–64K | Less quant damage | Still no download for Opus |
| 80GB-class card | BF16 55.6GB | native 262K is tight | Need KV budget (~16GiB @262K) | API still simpler |
| No local GPU | n/a | 262K–1M hosted | Pay OpenRouter | 3.8-27B $0.45/$3.20; Max $2/$6; Opus $5/$25 |
No suelde «cabe en 17GB» con «soporta 262K». El KV de atención plena a 262K BF16 baja ~16GiB (solo 16 capas). A 24GB, la ventana llena mata VRAM antes que la capacidad. Protocolo de entrada: 8K–32K, sin YaRN 1M, mismos tests de reparación de repo. Cómodo: FP8 en 48GB. BF16 a 262K lleno: clase 80GB.
Eso es el umbral bajo: el API de primera línea cuesta $5/$25 y nunca se descarga. Este 27B se sienta en una GPU de juegos. La cuantización hiere el reasoning — el golpe es poder empezar, no igualar a Opus.
Ranking del sitio: proxy, no esta tabla de código
El ranking compuesto del sitio premia contexto largo y precio bajo, no SWE. En este snapshot 3.8-27B (ya con $0.45/$3.20), 3.6-27B, 3.8-Max y Opus 4.6 no suben por «codificar bien»: 262K a precio medio no gana al slot Flash de 1M.
| On-site unified slot | Model | Why it ranks |
|---|---|---|
| #21 | Qwen3.7-Flash | 1M ctx + $0.03/$0.13 |
| #93 | Qwen3.5-Flash | 1M + cheap |
| #97 | Qwen3 Coder Flash | 1M code API, still cheap |
| #100 | Qwen3.7-Plus | 1M, $0.32/$1.28 |
| not on board | 3.8-27B / Opus 4.6 | listing ≠ 1M-cheap Flash slot / frontier sticker |
HF Hot sigue con Qwen3.6-27B oficial en sort_index=45 (~6.895.121 descargas). 3.8-27B no está. El compuesto no subirá por un 61.7 de SWE. No es un benchmark de capacidad.
Cuándo elegir el 27B y cuándo seguir pagando Opus
Elija 3.8-27B: tiene una GPU de 24GB, el repo no sale, necesita ver pantallas, acepta la tabla del vendor. Contrástelo con 3.6-27B en los mismos tests; mida el Q4. Sin GPU, use OpenRouter `qwen/qwen3.8-27b` ($0.45/$3.20, ~$0.11 el mismo job) — un orden de magnitud más barato que Opus, aún más caro que Coder pequeño.
Siga pagando Opus 4.6 / GPT-5.6 Sol: SLA, 1M alojado, sin GPU, sin tragar el riesgo de puntuaciones importadas. Pague Max: flagship Qwen de la misma generación más barato que Opus ($2/$6 vs $5/$25). Pague Coder 480B: solo texto y API 262K lista.
No lo tome como «el 27B API más barato» — el predecesor 3.6-27B y Coder 30B son más baratos. No convierta el arranque de 24GB en 262K lleno. Decida con Token, compare y la página del modelo.