Glosario
Las definiciones siguientes son términos de trabajo para este sitio; la redacción autoritativa está en documentación académica o de proveedores.
Term-linked models
Linked models from this week: SpaceXAI: Grok 4.20 Multi-Agent, DeepSeek V4 Flash Latest, Meta: Llama 4 Scout
LLM
Gran modelo de lenguaje: normalmente LM auto-regresivo o de prefijo entrenado a gran escala para chat, código, razonamiento y uso de herramientas; el comportamiento depende del tamaño y del post-entrenamiento.
Agent
Sistema que observa el estado, planifica pasos y llama herramientas para alcanzar objetivos (mono o multi-agente); se evalúa por tasa de éxito, pasos y coste.
Toolchain
Software y proceso de extremo a extremo que cubre datos, entrenamiento, evaluación, despliegue y observabilidad; aquí se enfatiza repetibilidad y entrega.
Benchmark
Conjunto de tareas y métricas estandarizadas para comparar modelos o sistemas; el desvío de versión y la contaminación afectan la comparabilidad.
SSG
Generación de sitios estáticos: compilar plantillas y datos en archivos en tiempo de build; sin renderizado por petición en servidor.
RAG
Generación aumentada por recuperación: recuperar documentos o fragmentos antes de responder; la calidad depende de la recuperación y del troceado.
Fine-tuning
Seguir entrenando un modelo base con un conjunto menor para adaptar tareas, estilo o seguridad; vigilar olvido catastrófico y sesgo.
Alignment
Técnicas para alinear el comportamiento del modelo con la intención humana y restricciones de seguridad (RLHF, DPO, filtros, etc.).
Quantization
Reducir la precisión numérica de pesos o activaciones para acelerar inferencia y ahorrar memoria; verificar compensaciones a nivel de tarea.
Inference serving
Exponer modelos como APIs en línea o trabajos por lotes; optimizar caudal, latencia, empaquetado y uso de hardware.
Stars / Forks (GitHub)
Las estrellas indican interés o respaldo; los forks copias para modificar: ambos son sensibles al marketing; combinar con commits e issues.
Composite score
Escalar que combina métricas ponderadas: útil como panorama; lee siempre sub-puntuaciones y definiciones de tareas.
Vendor (desarrollador del modelo)
Organización o marca detrás de una familia de modelos (p. ej. Anthropic, Meta). Aquí el primer segmento de un id estilo OpenRouter es vendor_id.
Proveedor de servicios (host de API)
Plataforma que sirve inferencia por API: agregadores como OpenRouter o nubes como Azure OpenAI y AWS Bedrock. Las cotizaciones pueden llevar service_provider_id.
GGUF
Formato de pesos cuantizados para llama.cpp (Q4/Q8). El tamaño del archivo es un suelo práctico de VRAM, no una puntuación SWE.
VRAM
Memoria de vídeo GPU (o memoria unificada de Apple como el mismo presupuesto). Deben caber pesos más KV; los TFLOPS no sustituyen.
KV cache
Caché de claves/valores que crece con el contexto. Que quepan los pesos no implica que quepa una ventana de 128K–262K.