Qwen3.8-27B: una GPU de 24GB de consumo frente a la tabla de código de Opus 4.6

Denso 27.78B Apache-2.0. Q4 ~17GB cabe en 24GB de consumo. Listing principal OpenRouter $0.45/$3.20. Tabla Qwen (autoevaluación): SWE-bench Pro 61.7 vs 53.4 importado de Opus 4.6 Max; Terminal-Bench 73.0 vs 78.2. 100K+20K: local ~$0, hosted ~$0.11, Opus $1.00. No es un benchmark independiente.

Tabla de lanzamiento Qwen: 3.8-27B vs 3.6-27B, 3.7-Plus, Opus 4.6 Max Ampliar imagen
Autoevaluación del vendor. La celda Opus de SWE-Pro es una puntuación oficial importada, no una repetición con el mismo harness.

Qué es, y por qué esta tabla importa

Qwen3.8-27B son pesos densos multimodales Apache-2.0 del 2026-08-14: 27.781.427.952 parámetros, contexto nativo 262K. No es Qwen3-8B ni el API-only Qwen3.8-Max.

El golpe es el umbral. Un Q4_K_M de terceros (~17,1GB) cabe en una GPU de 24GB de consumo: un agente de código esta noche, en el escritorio. El comparador es Claude Opus 4.6: listing principal OpenRouter $5/$25, sin pesos descargables.

Las cuatro barras salen de la tabla de Qwen. 3.8-27B supera a Opus 4.6 Max en SWE-Pro, LiveCodeBench y OSWorld; pierde 5,2 en Terminal-Bench. Es marketing, no una reproducción independiente — y sigue siendo la comparación que hay que clavar.

Tabla de especificaciones

Primero los números verificables. Las cuatro columnas salen del catálogo y del listing principal de OpenRouter (`qwen/qwen3.8-27b` ahora a $0.45/$3.20).

3.8-27B 3.6-27B 3.8-Max Opus 4.6
Released 2026-08-14 (HF) catalog first_seen 2026-06-22 catalog first_seen 2026-08-04 in catalog
Params 27.78B dense ~27.8B dense flagship 3.8 API frontier API
Weights Apache-2.0 download Apache-2.0 + API API only API only
Context 262K native / 1M YaRN 262K Mejor de esta comparación 1M Mejor de esta comparación 1M
Modality text+image+video→text text+image+video→text text+image+video→text multimodal API
OpenRouter $/1M $0.45 / $3.20 Mejor de esta comparación $0.289 / $2.40 $2.00 / $6.00 $5.00 / $25.00

El decodificador publicado de 3.8-27B y 3.6-27B es casi el mismo (64 capas híbridas, hidden 5120). El salto de código es entrenamiento, no un esqueleto nuevo. Max y Opus son otra línea: 1M alojado, pago por token, nunca te quedas con los pesos. 3.8-27B tiene ambos: descarga local o API alojada con los mismos pesos.

El mismo trabajo: local ~$0, hosted ~$0.11, Opus $1

Coste en USD de 100K entrada + 20K salida Ampliar imagen
Listing principal OpenRouter. Local 3.8-27B: solo electricidad; hosted mismos pesos ~$0.11.

Escenario fijo 100K+20K. No es capacidad: es a quién le pagas el mismo trabajo de tokens.

Model In $/1M Out $/1M 100K+20K Role
3.8-27B local Mejor de esta comparación ~$0 (electricity) 24GB Q4 desk
Qwen3 Coder 30B A3B Mejor de esta comparación $0.07 Mejor de esta comparación $0.27 $0.012 cheap code API
Qwen3 Coder 480B $0.30 $1.00 $0.050 hosted code flagship
Qwen3.6-27B API $0.289 $2.40 $0.077 same-size predecessor
Qwen3.8-27B API $0.45 $3.20 $0.109 same weights, hosted
Qwen3.8-Max $2.00 $6.00 $0.32 same-gen cloud flagship
Claude Opus 4.6 $5.00 $25.00 $1.00 frontier coding API
GPT-5.6 Sol $5.00 $30.00 $1.10 OpenAI coding flagship

Opus 4.6 y GPT-5.6 Sol: ~$1. Max de la misma generación: ~$0.32. 3.8-27B hosted: ~$0.11 (un poco más que el predecesor 3.6-27B a $0.077). Coder flagship alojado: ~$0.05. Los mismos pesos en tu GPU de 24GB: sticker de token cero — pagas luz y amortización. DeepSeek V4 Flash 0731 es el otro extremo: MoE 284B a $0.09/$0.18, barato, no cabe en una GPU de consumo.

Coding: contra Opus 4.6, no solo contra la familia

La tabla de lanzamiento de Qwen pone 3.8-27B, el predecesor 3.6-27B, el Plus alojado y Claude Opus 4.6 Max en la misma hoja. Autoevaluación; varias filas con Claude Code; la celda Opus de SWE-Pro es oficial importada (*); QwenSWEBench es interno.

Benchmark 3.8-27B 3.6-27B 3.7-Plus Opus 4.6 Max
Terminal-Bench 2.1 73.0 63.4 64.0 Mejor de esta comparación 78.2
SWE-bench Pro* Mejor de esta comparación 61.7 53.5 57.6 53.4
LiveCodeBench v6 Mejor de esta comparación 90.3 83.9 89.6 88.8
OSWorld-Verified Mejor de esta comparación 84.3 63.9 73.3 72.7
QwenSWEBench Mejor de esta comparación 79.0 49.3 59.2 63.8
DeepSWE 1.1 Mejor de esta comparación 42.2 13.3 14.2
NL2Repo-Bench 42.3 36.2 41.1 Mejor de esta comparación 47.6
GPQA Diamond 89.2 87.8 90.3 Mejor de esta comparación 91.3

Lectura frente a primera línea: vs Opus 4.6, el 27B gana o empata al alza en SWE-Pro, LiveCodeBench, OSWorld y QwenSWEBench; pierde Terminal-Bench, NL2Repo y GPQA. Vs 3.6-27B el salto de agente es un corte (DeepSWE 13.3→42.2). Vs Plus, el denso 27B no se cae en la mayoría de filas de código — y Plus se paga por token.

No está Coder 480B ni GPT-5.6 Sol en el mismo harness. No convierta 61.7 en «ganó a toda la frontera». Decida: UI con capturas y repo privado → 3.8-27B en 24GB por fin parece casi primera línea. SLA y 1M alojado → siga pagando Opus / Sol / Max.

Hardware de entrada: esta noche, no «algún día»

Huella de pesos vs la línea de 24GB de consumo Ampliar imagen
Solo pesos. El KV es aparte. Q4 es Unsloth de terceros. ~149GB de V4 Flash es el serving público.

«Puede correr» se queda corto. La frase exacta: una GPU de 24GB de consumo (clase 4090) puede cargar un 4bit de terceros esta noche y servir de agente de código a 8K–32K. Opus 4.6 no se «carga»: no te da los pesos. Coder 480B / V4 Flash no caben en esa caja.

Rig Fits Context to start What you get What you give up
24GB consumer GPU Q4_K_M ~17.1GB* 8K–32K Coding agent tonight Opus never leaves the API
32–48GB workstation FP8 30.9GB 32K–64K Less quant damage Still no download for Opus
80GB-class card BF16 55.6GB native 262K is tight Need KV budget (~16GiB @262K) API still simpler
No local GPU n/a 262K–1M hosted Pay OpenRouter 3.8-27B $0.45/$3.20; Max $2/$6; Opus $5/$25

No suelde «cabe en 17GB» con «soporta 262K». El KV de atención plena a 262K BF16 baja ~16GiB (solo 16 capas). A 24GB, la ventana llena mata VRAM antes que la capacidad. Protocolo de entrada: 8K–32K, sin YaRN 1M, mismos tests de reparación de repo. Cómodo: FP8 en 48GB. BF16 a 262K lleno: clase 80GB.

Eso es el umbral bajo: el API de primera línea cuesta $5/$25 y nunca se descarga. Este 27B se sienta en una GPU de juegos. La cuantización hiere el reasoning — el golpe es poder empezar, no igualar a Opus.

Ranking del sitio: proxy, no esta tabla de código

El ranking compuesto del sitio premia contexto largo y precio bajo, no SWE. En este snapshot 3.8-27B (ya con $0.45/$3.20), 3.6-27B, 3.8-Max y Opus 4.6 no suben por «codificar bien»: 262K a precio medio no gana al slot Flash de 1M.

On-site unified slot Model Why it ranks
#21 Qwen3.7-Flash 1M ctx + $0.03/$0.13
#93 Qwen3.5-Flash 1M + cheap
#97 Qwen3 Coder Flash 1M code API, still cheap
#100 Qwen3.7-Plus 1M, $0.32/$1.28
not on board 3.8-27B / Opus 4.6 listing ≠ 1M-cheap Flash slot / frontier sticker

HF Hot sigue con Qwen3.6-27B oficial en sort_index=45 (~6.895.121 descargas). 3.8-27B no está. El compuesto no subirá por un 61.7 de SWE. No es un benchmark de capacidad.

Cuándo elegir el 27B y cuándo seguir pagando Opus

Elija 3.8-27B: tiene una GPU de 24GB, el repo no sale, necesita ver pantallas, acepta la tabla del vendor. Contrástelo con 3.6-27B en los mismos tests; mida el Q4. Sin GPU, use OpenRouter `qwen/qwen3.8-27b` ($0.45/$3.20, ~$0.11 el mismo job) — un orden de magnitud más barato que Opus, aún más caro que Coder pequeño.

Siga pagando Opus 4.6 / GPT-5.6 Sol: SLA, 1M alojado, sin GPU, sin tragar el riesgo de puntuaciones importadas. Pague Max: flagship Qwen de la misma generación más barato que Opus ($2/$6 vs $5/$25). Pague Coder 480B: solo texto y API 262K lista.

No lo tome como «el 27B API más barato» — el predecesor 3.6-27B y Coder 30B son más baratos. No convierta el arranque de 24GB en 262K lleno. Decida con Token, compare y la página del modelo.

Insights