Anthropic lanzó Claude Fable 5.1 como su modelo de disponibilidad general para trabajo de código, investigación en varios pasos y tareas largas con herramientas.
La tarifa base se mantiene en US$10 por millón de tokens de entrada y US$50 por millón de salida, pero la lectura de caché baja a US$0,25 por millón de tokens, un recorte de 75% frente a Claude Fable 5.
La rebaja no cambia todos los costos del mismo modo. Anthropic la vincula solo al contenido que ya fue almacenado y luego se reutiliza desde caché, por lo que el ahorro depende de cuánto contexto repetido tenga cada flujo.
La empresa estima una baja cercana a 25% en cargas típicas y de hasta alrededor de 45% en cargas muy agentivas, cifras que no equivalen a una garantía para cualquier uso.
Claude Mythos 5.1 comparte el mismo modelo subyacente, pero no entra a disponibilidad general. Anthropic lo mantiene por invitación dentro de Project Glasswing para organizaciones evaluadas en ciberseguridad y ciencias de la vida, mientras Fable 5.1 incorpora salvaguardas adicionales para abrir el acceso a más clientes.
La nueva versión también llega con cambios prácticos para desarrolladores. Anthropic publicó una guía de migración que confirma tres incompatibilidades con Claude Fable 5: forzar una herramienta ahora devuelve error, los modelos anteriores no pueden leer sus bloques de pensamiento y editar turnos previos invalida esos bloques. El contexto máximo sigue en 1 millón de tokens y la salida máxima en 128.000 tokens.
Claude Fable 5.1 mantiene el precio base y abarata la reutilización de contexto
El recorte de precio apunta a una parte muy concreta del uso: las lecturas de caché. En la práctica, esto favorece tareas donde una aplicación vuelve a usar instrucciones largas, archivos, antecedentes o historiales sin tener que recomputarlos completos en cada turno.
Para equipos que trabajan con agentes, repositorios amplios o documentos pesados, esa parte del gasto puede ser relevante cuando el mismo contexto se repite muchas veces.
Anthropic presenta Claude Fable 5.1 como su modelo general más capaz y lo distribuye en la Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry y Claude Platform on AWS. En la comparación oficial de la empresa con otras familias de Claude, Fable 5.1 conserva una latencia más lenta que Opus 5 y Sonnet 5, pero apunta a trabajos de mayor duración y más pasos.

La versión 5.1 suma esfuerzo por mensaje en beta, mensajes de sistema por turno, actualizaciones legibles entre llamadas a herramientas y procedencia de contenido. Frente a Claude Fable 5, el cambio visible está en el costo de reutilización y en la migración de integraciones existentes.
Anthropic también indica que Fable 5.1 puede derivar automáticamente ciertas consultas de ciberseguridad y biología a modelos menos sensibles. La empresa afirma que en biología sus salvaguardas intervienen 85% menos veces sobre pedidos benignos que en el lanzamiento de Fable 5, pero mantiene bloqueos para pruebas de penetración, generación de exploits y escaneo de vulnerabilidades basado en binarios.
Qué cambia entre Fable y Mythos y qué deben revisar los desarrolladores
La separación entre ambas versiones sigue siendo central. Claude Mythos 5.1 queda reservado a un grupo reducido de organizaciones verificadas, con acceso orientado a trabajos donde Anthropic considera que el riesgo exige más control. Claude Fable 5.1 usa el mismo modelo base, pero añade capas de seguridad para ciberseguridad y biología que limitan o redirigen parte de esas tareas.
La guía de migración de Anthropic detalla que ya no se puede imponer una llamada de herramienta con las opciones que antes obligaban al modelo a usar una herramienta específica. Desde ahora, el camino sugerido es dejar la selección en automático y reforzar la instrucción o el esquema de salida. Para equipos con productos ya desplegados, ese cambio exige revisar flujos antes de cambiar el identificador del modelo.
Otro ajuste afecta la continuidad de conversaciones largas. Claude Fable 5.1 puede leer bloques de pensamiento generados por modelos anteriores, pero esos modelos anteriores no pueden leer los suyos.
Además, si una aplicación edita mensajes previos, recompone el historial o altera partes anteriores de la conversación, esos bloques pueden quedar invalidados. Es un detalle técnico, pero tiene efecto directo en sistemas que compactan contexto o reescriben mensajes para ahorrar tokens.

