Claude Fable 5.1 y Mythos 5.1: más capaces y, sobre todo, más baratos
Anthropic lanzó Fable 5.1 y Mythos 5.1: mejor coding agéntico, el doble en Terminal-Bench-Science y lecturas de caché un 75% más baratas. Qué cambia y qué recordar al integrarlo.
Lanzamientos, benchmarks y tutoriales prácticos sobre los modelos que están cambiando cómo construimos software. Sin hype, sin humo.
Destacado
Anthropic lanzó Fable 5.1 y Mythos 5.1: mejor coding agéntico, el doble en Terminal-Bench-Science y lecturas de caché un 75% más baratas. Qué cambia y qué recordar al integrarlo.
Recientes
xAI soltó Grok 4.6 casi sin campaña, con mejoras en tareas largas, agentes y programación, y un precio mucho más agresivo que otros modelos de primera línea. Qué cambia y qué falta por confirmar.
El Model Context Protocol se volvió el estándar para conectar herramientas a los LLMs. Montar un servidor propio es sorprendentemente sencillo. Qué expone y cómo diseñarlo.
Con modelos base tan capaces, el fine-tuning dejó de ser el primer recurso. Cuándo un buen prompt basta, cuándo RAG es la respuesta y cuándo entrenar de verdad compensa.
La latencia percibida importa más que la real. Streaming de tokens, estados intermedios y tool-use visible: cómo hacer que esperar no duela en el frontend.
Un modelo se evalúa por respuesta. Un agente se evalúa por trayectoria: los pasos, las herramientas, el estado final. Cómo montar evals para sistemas que actúan.
La visión en los LLMs pasó de juguete a herramienta de trabajo. Casos reales donde pasar imágenes a un modelo resuelve problemas que el texto solo no podía.
Cada lanzamiento importante, con lo que realmente importa para un desarrollador: qué cambió, qué puedes usar hoy y qué todavía no vale la pena.