Glosario

Las definiciones siguientes son términos de trabajo para este sitio; la redacción autoritativa está en documentación académica o de proveedores.

Term-linked models

Linked models from this week: SpaceXAI: Grok 4.20 Multi-Agent, DeepSeek V4 Flash Latest, Meta: Llama 4 Scout

Open model board

LLM

Gran modelo de lenguaje: normalmente LM auto-regresivo o de prefijo entrenado a gran escala para chat, código, razonamiento y uso de herramientas; el comportamiento depende del tamaño y del post-entrenamiento.

Agent

Sistema que observa el estado, planifica pasos y llama herramientas para alcanzar objetivos (mono o multi-agente); se evalúa por tasa de éxito, pasos y coste.

Toolchain

Software y proceso de extremo a extremo que cubre datos, entrenamiento, evaluación, despliegue y observabilidad; aquí se enfatiza repetibilidad y entrega.

Benchmark

Conjunto de tareas y métricas estandarizadas para comparar modelos o sistemas; el desvío de versión y la contaminación afectan la comparabilidad.

SSG

Generación de sitios estáticos: compilar plantillas y datos en archivos en tiempo de build; sin renderizado por petición en servidor.

RAG

Generación aumentada por recuperación: recuperar documentos o fragmentos antes de responder; la calidad depende de la recuperación y del troceado.

Fine-tuning

Seguir entrenando un modelo base con un conjunto menor para adaptar tareas, estilo o seguridad; vigilar olvido catastrófico y sesgo.

Alignment

Técnicas para alinear el comportamiento del modelo con la intención humana y restricciones de seguridad (RLHF, DPO, filtros, etc.).

Quantization

Reducir la precisión numérica de pesos o activaciones para acelerar inferencia y ahorrar memoria; verificar compensaciones a nivel de tarea.

Inference serving

Exponer modelos como APIs en línea o trabajos por lotes; optimizar caudal, latencia, empaquetado y uso de hardware.

Stars / Forks (GitHub)

Las estrellas indican interés o respaldo; los forks copias para modificar: ambos son sensibles al marketing; combinar con commits e issues.

Composite score

Escalar que combina métricas ponderadas: útil como panorama; lee siempre sub-puntuaciones y definiciones de tareas.

Vendor (desarrollador del modelo)

Organización o marca detrás de una familia de modelos (p. ej. Anthropic, Meta). Aquí el primer segmento de un id estilo OpenRouter es vendor_id.

Proveedor de servicios (host de API)

Plataforma que sirve inferencia por API: agregadores como OpenRouter o nubes como Azure OpenAI y AWS Bedrock. Las cotizaciones pueden llevar service_provider_id.

GGUF

Formato de pesos cuantizados para llama.cpp (Q4/Q8). El tamaño del archivo es un suelo práctico de VRAM, no una puntuación SWE.

VRAM

Memoria de vídeo GPU (o memoria unificada de Apple como el mismo presupuesto). Deben caber pesos más KV; los TFLOPS no sustituyen.

KV cache

Caché de claves/valores que crece con el contexto. Que quepan los pesos no implica que quepa una ventana de 128K–262K.