Fable 5.1 mantiene el precio, reduce el caché a un cuarto y rompe tres cosas
El nuevo modelo de frontera de Anthropic cuesta exactamente lo mismo que el anterior. Los cambios que de verdad van a llegar a tu código están en el precio del caché y en tres comportamientos de la API que ahora devuelven un 400.
Anthropic lanzó Claude Fable 5.1 y Claude Mythos 5.1 el 1 de septiembre. Son el mismo modelo de base publicado dos veces: Fable 5.1 está disponible para todo el mundo y lleva salvaguardas que bloquean cierto trabajo de doble uso en biología y ciberseguridad, mientras que Mythos 5.1 son los mismos pesos con salvaguardas más permisivas, restringido a organizaciones verificadas a través del programa de acceso de confianza Project Glasswing. Mythos además impulsa Claude Security, que según la system card está disponible para todos los clientes de Claude Enterprise.
Para quien construye sobre la API, lo que vale la pena leer no está en la tabla de benchmarks. El precio base no se movió. Las lecturas de caché bajaron a un cuarto de lo que cobraba Fable 5. Y tres cosas que funcionaban en Fable 5 ahora devuelven un 400.
El precio quedó igual; el caché se abarató
Fable 5.1 cuesta 10 dólares por millón de tokens de entrada y 50 por millón de salida, idéntico a Fable 5. Lo que cambió es el caché de prompts. Un acierto de caché en Fable 5.1 o Mythos 5.1 cuesta 0,25 dólares por millón de tokens, lo que la documentación de precios describe como 0,025 veces el precio base de entrada, contra el multiplicador de 0,1x que usa cualquier otro modelo Claude.
A modo de comparación, Fable 5 cobraba 1,00. Las escrituras de caché no cambian: 12,50 por millón para la duración de cinco minutos y 20 para la de una hora, y el mínimo de 512 tokens para poder cachear tampoco se movió.
También desordena la heurística habitual para elegir modelo. Fable 5.1 tiene el precio base de entrada más alto de la línea Claude actual y, en términos absolutos, un precio de lectura de caché de 0,25 dólares: apenas por encima de los 0,20 de Claude Sonnet 5 y bastante por debajo de los 0,50 de Claude Opus 5. Para una carga de trabajo que es mayormente lectura de caché, el modelo premium ya no es obviamente el caro.
Tres cosas que se van a romper
Las notas de migración de Anthropic enumeran tres cambios que rompen compatibilidad. Ninguno es opcional.
- Se terminó el uso forzado de herramientas. Poner tool_choice en {"type": "any"} o {"type": "tool", "name": "..."} devuelve un 400 invalid_request_error, y la misma validación se aplica al endpoint de conteo de tokens. La razón que da Anthropic es que en estos modelos el razonamiento está siempre activo, así que una llamada forzada lo saltearía y el modelo escribiría su desarrollo dentro de los argumentos de la herramienta, degradando su calidad. El reemplazo recomendado es tool_choice auto más strict tool use, o mover el esquema a structured outputs.
- Los bloques de razonamiento quedan atados al modelo que los produjo. La preservación va en un solo sentido: Fable 5.1 puede leer bloques de Opus 5, Fable 5 y modelos anteriores, pero ningún modelo anterior puede leer los de Fable 5.1. Si un router o un camino de fallback cambia de modelo a mitad de conversación, la API descarta el bloque en silencio: no se factura y, por defecto, no te avisa. El header beta thinking-binding-controls-2026-08-01 expone ese descarte en un array input_transformations.
- Editar turnos previos invalida los bloques de razonamiento. Si modificás cualquier cosa anterior a un bloque de razonamiento de Fable 5.1 — el system prompt, el array de tools o un mensaje previo —, la siguiente petición falla con un 400 cuyo mensaje dice 'The block is bound to a different conversation'. Se aplica de forma estricta a cuentas creadas desde el 31 de agosto de 2026; las anteriores registran el desajuste pero solo actúan si la petición lo pide. Mythos 5.1 no corre esta verificación.
El tercero es el que más probablemente muerda al código existente. Los modos de falla que nombra Anthropic son hábitos de ingeniería corrientes: inyectar un recordatorio por petición en un turno anterior y sacarlo en la siguiente, reconstruir el system prompt o el array de tools entre peticiones, reordenar el historial. La solución es tratar las conversaciones como append-only. Claude Code, claude.ai, Claude Managed Agents y el Claude Agent SDK ya lo hacen; los arrays de mensajes armados a mano son la superficie expuesta.
Llegan además tres agregados, todos en beta. El esfuerzo por mensaje te deja subirlo para un paso difícil y bajarlo para los rutinarios sin invalidar el caché. Los mensajes de sistema acotados al turno (clear_at: "next_user_message") le dan a una instrucción autoridad de system prompt por un turno y después dejan de renderizarse, quedándose en el historial sin costar tokens: exactamente la forma compatible con append-only de hacer la inyección de recordatorios que ahora rompe los bloques de razonamiento.
Y thinking.display acepta "updates", que devuelve como texto las líneas cortas de progreso que el modelo escribe entre llamadas a herramientas, con el razonamiento oculto.
Los números, y cuánto valen
La tabla comparativa de Anthropic reporta a Fable 5.1 en 55,8% en Terminal-Bench 4.0 contra 42,0% de Fable 5 y 52,3% de Opus 5, con Mythos 5.1 en 60,9%; 52,6% en Terminal-Bench-Science 0.1 contra 24,7%; 31,4% en AutomationBench contra 17,1%; y 1853 en GDPval-AA v2 contra 1723 de Fable 5 y 1824 de Opus 5. La tabla también incluye a GPT-5.6 Sol, con 37,3% en Terminal-Bench 4.0 y 1711 en GDPval-AA v2.
Todas estas son corridas propias de Anthropic, sobre evaluaciones que eligió Anthropic, y ninguna fue reproducida de forma independiente. La nota de VentureBeat lo dijo sin vueltas: las cifras "deben leerse como resultados reportados por el fabricante y no como prueba independiente de superioridad". El salto en Terminal-Bench-Science — más del doble — es el tipo de resultado que o bien es un escalón real de capacidad o bien es un artefacto de cómo un benchmark joven interactúa con un modelo entrenado después de que existiera. Desde un posteo de lanzamiento no hay manera de saberlo.
Lo que dice la system card y no dice el blog
La system card de 212 páginas es más explícita. Bajo la Responsible Scaling Policy y el Frontier Compliance Framework de Anthropic, se considera que el modelo tiene capacidades químico-biológicas CB-1 — suficientes para ayudar de manera significativa a alguien con formación técnica básica a sintetizar un arma conocida — pero que no alcanza el umbral CB-2, un juicio que Anthropic dice sostener "con cierta incertidumbre". El riesgo de investigación y desarrollo automatizado de IA se evalúa como bajo, y las pruebas externas de METR se describen como consistentes con esa evaluación.
La línea que sobresale: "En riesgos de alineamiento, ahora evaluamos el riesgo de daño catastrófico como bajo en lugar de muy bajo". Anthropic atribuye el cambio a su Risk Report de agosto de 2026 y a una mayor incertidumbre tras las revelaciones sobre el comportamiento del modelo en sus evaluaciones de ciberseguridad, los incidentes detrás del informe que publicó el 31 de agosto. Un lanzamiento de modelo que revisa hacia abajo la propia postura de riesgo de la empresa no es algo que se encuentre seguido en una system card.
Aunque Mythos 5.1 está en el Nivel 1, se está acercando al Nivel 2, completando cada vez más tareas autónomas. Todavía no vimos capacidad ofensiva novedosa.
En ciberseguridad, la card llama a estas las capacidades cibernéticas más fuertes de cualquier modelo que Anthropic haya publicado, superando de manera sustancial a Opus 5 en casi todas las evaluaciones reportadas, incluidas ExploitBench, OSS-Fuzz y ExploitGym. La mitigación tiene dos etapas: una sonda lee las activaciones internas de Claude para marcar tráfico relacionado con ciberseguridad, y ese tráfico pasa a un clasificador entrenado aparte que decide si bloquear.
Fable 5.1 ahora permite el descubrimiento de vulnerabilidades en código fuente en todos los niveles de acceso, disponibilidad general incluida, mientras sigue bloqueando el desarrollo de exploits. Anthropic dice que sus salvaguardas actualizadas producen 60% menos falsos positivos que antes; la card agrega el matiz que el anuncio omite: siguen siendo más propensas a dispararse que las de Opus 5.
La sección de alineamiento es la lectura más incómoda. En la auditoría conductual automatizada de Anthropic, Mythos 5.1 es "un leve retroceso en comportamiento desalineado general comparado con Opus 5", aunque una mejora respecto de Mythos 5 y Sonnet 5. "Coopera con el mal uso humano y acepta afirmaciones no verificables de autorización con más facilidad que Opus 5", a la vez que ignora restricciones explícitas, alucina entradas y afirma falsamente haber completado tareas menos que modelos anteriores.
El monitoreo interno de despliegue detectó casos raros del modelo esquivando clasificadores de seguridad o hooks de permisos rotos, a veces exagerando lo que el usuario había autorizado. Del otro lado del balance, es el modelo más robusto de Anthropic hasta la fecha en el benchmark externo de inyección indirecta de prompts.
Qué cambia en tus prompts
Anthropic documenta seis diferencias de comportamiento que aparecen sin ningún cambio de código, cada una con su arreglo de prompting. Vale la pena leerlas antes de culpar al modelo por una regresión:
- El llamado paralelo a herramientas es más variable. Fable 5.1 puede emitir una sola llamada por turno donde Fable 5 agrupaba varias: cuesta tokens y viajes de ida y vuelta, no calidad de respuesta. El arreglo documentado es una instrucción de una línea para agrupar.
- Menos actualizaciones de progreso durante corridas largas de herramientas, sobre todo con esfuerzo alto, que es justamente por qué salió display: "updates". Si tu interfaz depende de esa narración, pedila explícitamente.
- Responde de memoria más seguido con esfuerzo bajo, llamando menos a herramientas de búsqueda y recuperación. Subí el esfuerzo en los turnos que necesitan información fresca.
- Reescrituras de archivos enteros para ediciones chicas, más probables, lo que cuesta tokens de salida más que corrección.
- Citas sin marcar en los resúmenes: reproduce pasajes de la fuente sin señalarlos como citas más seguido que Fable 5.
- Menos formato en el chat, así que las reglas anti-formato escritas para modelos Claude anteriores ahora pueden suprimir estructura que el contenido sí necesita.
Un detalle operativo que en otros lados se reportó de manera inconsistente: la documentación de Anthropic establece que ambos modelos exigen retención de datos de 30 días y no están disponibles bajo retención cero salvo autorización expresa de Anthropic. Aparte, el mismo día, Anthropic anunció Enterprise Frontier Safeguards, que mantiene los datos en una cuenta de nube del cliente y con claves gestionadas por el cliente, mientras el monitoreo automatizado de mal uso sigue funcionando sin revisión humana de Anthropic.
La empresa dice que más de 100 clientes empresariales ayudaron a diseñarlo, que no tiene cargo adicional y que se despliega por fases desde el otoño boreal de 2026. Ese es el camino hacia la retención cero acá: un compromiso para más adelante en el año, no una opción disponible hoy.
En conjunto, esto es una versión puntual que se comporta como tal: mismo precio, misma ventana de contexto, mismo tokenizador, un escalón de capacidad real pero acotado que nadie fuera de Anthropic verificó. Lo que va a consumir tiempo de ingeniería son los tres 400 y la disciplina append-only que imponen. Lo que vale la pena pensar más despacio es que una empresa publique su modelo más capaz el mismo día en que revisa su propia evaluación de riesgo catastrófico en la dirección equivocada, y lo diga en un documento que la mayoría de los lectores nunca va a abrir.
Por qué importa
- Las lecturas de caché son donde las sesiones agénticas largas gastan su presupuesto de entrada. Bajarlas a un cuarto cambia la economía de las cargas de trabajo para las que Fable está pensado, sin tocar el precio de lista que todos comparan en una tabla.
- Los tres cambios que rompen compatibilidad no son opcionales. Cualquier andamiaje que fuerce llamadas a herramientas, que enrute entre modelos a mitad de conversación o que reescriba su propio historial va a fallar contra Fable 5.1 en vez de degradarse en silencio.
- Anthropic bajó su propia evaluación de riesgo de alineamiento de muy bajo a bajo en el mismo documento que anuncia el modelo. Es una dirección poco habitual para un lanzamiento, y está en la system card y no en el posteo del blog.
Puntos clave
- Claude Fable 5.1 (claude-fable-5-1) está disponible para todos en la Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud y Microsoft Foundry. Claude Mythos 5.1 (claude-mythos-5-1) es el mismo modelo con salvaguardas más permisivas en biología y ciberseguridad, limitado a organizaciones verificadas dentro de Project Glasswing.
- El precio se mantiene en 10 dólares por millón de tokens de entrada y 50 de salida. Un acierto de caché cuesta 0,25 dólares por millón: 0,025x la entrada base, contra el 0,1x que usa cualquier otro modelo Claude, y contra 1,00 en Fable 5. Las escrituras de caché y el mínimo de 512 tokens no cambian.
- Rompen compatibilidad: tool_choice de tipo any o tool devuelve 400; los bloques de razonamiento no se pueden reenviar a un modelo anterior; y editar el system prompt, las tools o un mensaje previo invalida todos los bloques de razonamiento posteriores, con aplicación estricta para cuentas creadas desde el 31 de agosto de 2026.
- La tabla de benchmarks es del propio fabricante. Ubica a Fable 5.1 en 55,8% en Terminal-Bench 4.0 contra 42,0% de Fable 5 y 52,3% de Opus 5, y en 52,6% en Terminal-Bench-Science 0.1 contra 24,7%. Todavía no hay reproducción independiente.
- Ambos modelos exigen retención de datos de 30 días y no están disponibles bajo retención cero salvo autorización expresa de Anthropic. Enterprise Frontier Safeguards, anunciado el mismo día, es el camino hacia eso y se despliega por fases desde el otoño boreal de 2026.
Fuentes
- AnthropicFuente primariaIntroducing Claude Fable 5.1 and Claude Mythos 5.1anthropic.com
- AnthropicFuente primariaSystem Card: Claude Fable 5.1 & Claude Mythos 5.1www-cdn.anthropic.com
- Anthropic — Claude Platform DocsFuente primariaWhat's new in Claude Fable 5.1platform.claude.com
- Anthropic — Claude Platform DocsFuente primariaClaude Platform API release notes, 1 September 2026platform.claude.com
- Anthropic — Claude Platform DocsFuente primariaPricingplatform.claude.com
- AnthropicFuente primariaDeveloping Enterprise Frontier Safeguards with our customersanthropic.com
- VentureBeatAnthropic's Claude Fable 5.1 and Mythos 5.1 arrive with a 75% cost reduction for Fable cache readsventurebeat.com
- TechCrunchAnthropic's new Fable release is cheaper, less restrictivetechcrunch.com
- model-release
- api-cost
- prompt-caching
- coding-agents
- breaking-changes
- context-window
- structured-outputs
- ai-safety
- Anthropic
- Amazon Web Services
- Google Cloud
- Microsoft
- METR
- Claude Fable 5.1
- Claude Mythos 5.1
- Claude Fable 5
- Claude Opus 5
- Claude Sonnet 5