ErickPolancoDev

// BLOG · NOTAS DESDE PRODUCCIÓN

Claude Fable 5.1 y Mythos 5.1: qué cambia con el nuevo modelo de Anthropic

Claude Fable 5.1 y Mythos 5.1 que cambia con el nuevo modelo de Anthropic

Anthropic lanzó hoy Claude Fable 5.1 y Claude Mythos 5.1, la actualización que reemplaza a Fable 5 y Mythos 5 apenas tres meses después de su debut en junio. La cifra que más se repite en el anuncio es dramática: más del doble de acierto en pruebas de razonamiento científico. La que de verdad importa para el bolsillo es otra: las relecturas de contexto en caché cuestan ahora un cuarto de lo que costaban.

Si usas Claude a diario, sea para programar, investigar o revisar documentos, hay varias cosas que te van a tocar directamente. Aquí va todo lo que cambia, con las cifras verificadas y sin relleno.

Qué son Claude Fable 5.1 y Claude Mythos 5.1

No son dos modelos distintos. Anthropic entrenó un único modelo y lo entrega bajo dos nombres según el nivel de salvaguardas que trae activado. Claude Fable 5.1 es la versión pública, disponible para cualquier cliente de la API, de la nube o de claude.ai. Claude Mythos 5.1 comparte exactamente las mismas capacidades, pero con protecciones reducidas y acceso restringido a organizaciones verificadas.

Ambos comparten ventana de contexto de 1 millón de tokens, el máximo por defecto, no un límite aparte que hay que activar, y hasta 128.000 tokens de salida por respuesta. El pensamiento adaptativo va siempre encendido: ya no se puede apagar el razonamiento ni fijarle un presupuesto manual de tokens como en modelos anteriores.

Por qué existe un modelo restringido

La razón es de doble uso. Las mismas capacidades que ayudan a un equipo de ciberseguridad a encontrar una vulnerabilidad antes que un atacante, o a un laboratorio a diseñar una proteína terapéutica, sirven también para lo contrario. Anthropic decidió no regalarle esa potencia a cualquiera.

El ejemplo que usan ellos mismos para justificarlo es diseño de proteínas: Mythos 5.1 logró afinidades de unión hasta 10 veces superiores a las de sus competidores en tres objetivos distintos, con una tasa de éxito cercana al 50%, frente al 10-15% que es habitual en el campo. Por eso Mythos 5.1 solo llega a organizaciones verificadas dentro de Project Glasswing, a través de un programa para ciberseguridad defensiva y otro para ciencias de la vida, y por ahora limitado a Estados Unidos.

Los números: qué tan grande es el salto

Anthropic publicó comparaciones directas contra Fable 5 en cuatro pruebas. Esta es la tabla, sin adornos:

PruebaFable 5Fable 5.1Diferencia
Terminal-Bench-Science 0.124,7%52,6%+113%
Terminal-Bench 4.0 (agéntico)42,0%55,8%+33%
CursorBench 3.2.070,5%73,4%+4,1 pts
Humanity’s Last Exam (sin herramientas)57,8%60,9%+5,1 pts

El salto en Terminal-Bench-Science llama la atención porque más que duplica el resultado anterior, pero es una prueba de nicho, pensada para tareas científicas de laboratorio. Para el trabajo del día a día de un equipo de desarrollo, el dato con más peso real es el de Terminal-Bench 4.0: un tercio más de tareas agénticas resueltas de punta a punta, sin intervención humana en el medio.

Anthropic agrupa las mejoras en seis áreas concretas:

  • Codificación agéntica en sesiones largas. Refactors grandes, migraciones, debugging y revisión de código en corridas que se extienden por horas.
  • Documentos, hojas de cálculo y presentaciones. Lleva un análisis desde la primera pregunta hasta un documento terminado, una hoja con fórmulas vivas o una presentación armada desde cero.
  • Investigación y búsqueda de varios pasos. Mejor precisión en tareas de investigación profunda que siguen pistas nuevas a medida que las encuentra.
  • Visión. Lee gráficos densos, estados financieros y tablas incrustadas en PDFs, con herramientas de recorte y zoom sobre los gráficos.
  • Contexto largo. Razona y conecta información a lo largo de toda la ventana de 1 millón de tokens, no solo al principio o al final.
  • Uso de computadora. Opera navegador y aplicaciones de escritorio con más consistencia, y se recupera mejor cuando un paso falla a mitad de camino.

El rendimiento multilingüe se mantiene igual que en Fable 5, sin mejoras ni retrocesos reportados.

Para quien programa con la API: qué se rompe y qué es nuevo

Esta parte es la que más le importa a un equipo técnico. Migrar de claude-fable-5 a claude-fable-5-1 es cambiar un string, pero antes de hacerlo en producción hay tres cosas que rompen código existente.

Tres cambios que rompen código existente

  1. El uso forzado de herramientas ya no existe. Un tool_choice de tipo tool o any devuelve un error 400. Si tu integración dependía de obligar una llamada a herramienta, la alternativa es dejar tool_choice en auto y usar strict tool use, o moverte a structured outputs.
  2. Los bloques de razonamiento quedan atados al modelo que los generó. Fable 5.1 puede leer el pensamiento de un modelo anterior, pero ningún modelo anterior puede leer el suyo. Si tu aplicación cambia de modelo a mitad de una conversación, ese tramo de razonamiento se pierde en el camino.
  3. Editar un turno anterior invalida los bloques de pensamiento que vienen después. El historial de la conversación ahora se trata como algo de solo agregar texto, nunca de reescribir. Para avisos puntuales existen los mensajes de sistema con alcance de un solo turno, que se explican abajo.

Cinco funciones nuevas (algunas todavía en beta)

  • Esfuerzo por mensaje (beta). Se puede subir o bajar el nivel de razonamiento a mitad de conversación sin romper el caché del prompt: más esfuerzo para el paso difícil, menos para los de trámite.
  • Mensajes de sistema de un solo turno (beta). Un recordatorio que aplica solo al turno actual y deja de leerse en el siguiente, sin tener que inyectar y luego borrar texto del historial.
  • Actualizaciones de progreso entre herramientas (beta). Con display: "updates" el modelo puede mostrar qué está haciendo mientras trabaja, en vez de dejar al usuario mirando una pantalla en blanco durante minutos.
  • Caché más barato. Las relecturas cuestan ahora 0,025 veces el precio de entrada base, contra 0,1 en el resto de los modelos de Claude. Es la mejora con más impacto directo en la factura mensual.
  • Procedencia del contenido. Todo el texto que genera lleva una marca de agua estadística de Anthropic, y las imágenes o videos que produce a través de la herramienta de ejecución de código llevan credenciales C2PA firmadas.

Hay también cambios de comportamiento que no rompen nada pero sí se notan: el modelo agrupa menos llamadas a herramientas en paralelo por defecto, escribe menos texto de progreso durante corridas largas, y cuando edita un archivo de texto tiende a reescribirlo completo en vez de hacer un cambio puntual. Ninguno baja la calidad de la respuesta, pero si tu producto depende de esa narración intermedia o de ediciones quirúrgicas, conviene ajustar el prompt.

Precios y disponibilidad

El precio por token es idéntico al de Fable 5. Lo único que cambia es la lectura de caché, y cambia bastante:

ConceptoPrecio
Entrada base$10 / millón de tokens
Escritura en caché (5 minutos)$12,50 / millón de tokens
Escritura en caché (1 hora)$20 / millón de tokens
Lectura de caché$0,25 / millón de tokens
Salida$50 / millón de tokens
Procesamiento por lotes$5 entrada / $25 salida, por millón

Ese recorte del 75% en lectura de caché es el motivo por el que Anthropic estima un ahorro del 25% en cargas de trabajo típicas, y de hasta 45% en trabajo agéntico, donde el mismo contexto se relee cientos de veces en una sola sesión larga.

Fable 5.1 ya está disponible para todos los clientes en la API de Claude como claude-fable-5-1, en Amazon Bedrock, en Claude Platform on AWS, en Google Cloud y en Microsoft Foundry sobre infraestructura de Anthropic. La retención de datos es de 30 días, y no hay opción de retención cero salvo autorización expresa de Anthropic, igual que con Fable 5. Mythos 5.1 sigue reservado a organizaciones verificadas dentro de Project Glasswing.

Si tu stack es Laravel, hay una forma directa de llegar a Fable 5.1 sin armar la integracion a mano: el SDK de IA que Laravel 13 estabilizo en marzo ya soporta Anthropic de fabrica, con agentes, herramientas y salida estructurada incluidos. Lo revisamos con codigo real en Laravel 13 y su SDK de IA nativo.

Lo que dicen las empresas que ya lo probaron

Anthropic compartió comentarios de varios clientes que probaron el modelo antes del lanzamiento. Jane Street reporta que resuelve más problemas de código que Fable 5 u Opus 5 sin perder legibilidad en tareas de varios pasos. Cognition, la empresa detrás del agente de programación Devin, dice que iguala o supera a Fable 5 a un costo por tarea más bajo, ayudado por el nuevo precio de caché. El equipo de investigación de Rakuten encontró brechas que otros tres modelos de punta pasaron por alto, y propuso hipótesis que ninguno de esos otros modelos había planteado. MongoDB construyó un prototipo complejo en tres días, corriendo sin supervisión y con verificación automática de cada paso.

El patrón se repite en los cuatro casos: aguanta más tiempo trabajando solo, sin necesitar que alguien revise cada paso a mitad de camino.

Qué significa esto si no programas

Si solo usas la app o la web de Claude, la respuesta corta de Anthropic es que sigas usando Claude Opus 5 para la mayoría de tus tareas diarias, tal como lo explicamos cuando Opus 5 salió en julio. Fable 5.1 está pensado para lo que exige razonamiento pesado y sesiones largas sin que nadie esté mirando: una migración completa de base de datos, una investigación de mercado que cruza decenas de fuentes, o un análisis financiero sobre un PDF de 200 páginas.

Para equipos de desarrollo, el salto en codificación agéntica es justo el terreno donde ya veníamos hablando de los beneficios de Claude Code: menos supervisión por tarea, sesiones más largas sin perder el hilo. Y si todavía estás decidiendo entre proveedores, dejamos actualizada la comparación en Claude vs ChatGPT vs Gemini.

Preguntas frecuentes

¿Cuál es la diferencia entre Claude Fable 5.1 y Claude Mythos 5.1?

Comparten el mismo modelo y las mismas capacidades. Lo único que cambia son las salvaguardas: Fable 5.1 está disponible para cualquier cliente de la API, la nube o claude.ai, mientras que Mythos 5.1 trae protecciones reducidas y solo se entrega a organizaciones verificadas dentro de Project Glasswing, pensado para ciberseguridad defensiva e investigación en ciencias de la vida.

¿Cuánto cuesta usar Claude Fable 5.1?

Lo mismo que Fable 5: $10 por millón de tokens de entrada y $50 por millón de salida. Lo que baja es el costo de releer contexto guardado en caché, que pasa de $1 a $0,25 por millón de tokens, un recorte del 75% que beneficia sobre todo a los agentes que trabajan sesiones largas sobre el mismo contexto.

¿Necesito cambiar mi código si ya uso Fable 5?

Basta con cambiar el identificador del modelo, de claude-fable-5 a claude-fable-5-1. Pero si tu integración fuerza el uso de una herramienta con tool_choice, construye a mano el arreglo de mensajes, o reescribe el system prompt entre solicitudes, hay tres cambios que rompen código y conviene revisar antes de migrar en producción.

¿Cuándo conviene usar Fable 5.1 en vez de Claude Opus 5?

Anthropic sigue recomendando empezar por Opus 5 para la mayoría de las cargas de trabajo. Fable 5.1 tiene sentido cuando la tarea exige razonamiento pesado en sesiones largas sin supervisión constante, como refactors grandes, investigación de varios pasos o migraciones, o cuando tus propias pruebas muestran que Opus 5 se queda corto incluso con el esfuerzo al máximo.

¿Tienes un proyecto en mente?

Construyo agentes de IA, automatizaciones y aplicativos web que aguantan producción.

Scroll to Top