Anthropic lanza Claude Opus 5.5 y el titular es el precio
El nuevo Opus sale a $4 y $20 por millón de tokens de entrada y salida, contra $5 y $25 de Opus 5, y Anthropic dice que rinde como Fable 5.1 en la mayoría del trabajo. Es además el primer modelo de la empresa desde que Dario Amodei pidió públicamente moderar el ritmo de la frontera.
Anthropic publicó Claude Opus 5.5 este martes, y el número más importante del anuncio no es un benchmark. El modelo cotiza a $4 por millón de tokens de entrada y $20 por millón de salida, contra $5 y $25 de Claude Opus 5: un recorte del 20% en la punta de la línea ampliamente disponible de la empresa, mientras la documentación ahora recomienda Opus 5.5 —y no otro modelo— como punto de partida para la mayoría de las cargas.
El id de API es `claude-opus-5-5`. La ventana de contexto sigue en 1M de tokens, la salida máxima en 128K y el corte de datos de entrenamiento en junio de 2026. Está disponible desde el día uno en la Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry y Claude Platform on AWS.
De dónde sale ese 40%
El encuadre de Anthropic es que Opus 5.5 "cuesta 40% menos de operar que Opus 5" en cargas típicas. Eso es una afirmación sobre cargas de trabajo, no un recorte de precio, y conviene separar las dos cosas.
- Los precios de lista por token bajaron 20%, no 40%: de $5 a $4 en entrada y de $25 a $20 en salida.
- Las lecturas de caché bajaron más: $0,20 por millón de tokens, que Anthropic ubica 60% por debajo de Opus 5. La documentación explica por qué: normalmente las lecturas de caché son el 10% del precio base de entrada, pero en Opus 5.5 son el 5%.
- La generación de salida es más de 30% más rápida, así que el mismo trabajo ocupa menos tiempo de reloj.
- El nivel de effort por defecto pasó de `high` en Opus 5 a `medium` en Opus 5.5. Un pedido que omite `effort` ahora piensa menos por defecto, y por lo tanto factura menos tokens.
Ese último punto no es una nota al pie. La propia guía de migración de Anthropic pone "volvé a correr tu barrido de effort" como primer cambio recomendado, y aclara que effort es ahora el único control de thinking y que su valor por defecto bajó un escalón. Los equipos que actualicen cambiando el string del modelo y nada más van a ver una factura más barata en parte porque el modelo es más barato y en parte porque, por defecto, está haciendo menos trabajo por pedido. Si ese canje conviene es justamente lo que el barrido de effort sirve para averiguar.
El reclamo de benchmarks: ganarle al modelo más grande
La afirmación más llamativa es que un Opus más barato ahora iguala o supera a Claude Fable 5.1 —el modelo más capaz de amplia disponibilidad de Anthropic, que cotiza a $10 y $50 por millón de tokens— en buena parte del trabajo. Según las cifras publicadas por la empresa, comparando Opus 5.5, Fable 5.1 y Opus 5:
- Terminal-Bench 4.0: 66,4% contra 55,8% contra 52,3%
- FrontierCode v1.1: 54,4% contra 50,3% contra 48,0%
- CursorBench 4.0: 57,8% contra 51,8% contra 46,6%
- OSWorld 2.0 (uso de computadora): 81,8% contra 80,7% contra 74,0%
- GDPval-AA v2.1: 1846 contra 1735 contra 1708 Elo
Son evaluaciones propias de Anthropic, reportadas por Anthropic, y al momento de esta publicación no existía réplica independiente. La documentación sigue derivando el razonamiento exigente y el trabajo agéntico de horizonte largo a Fable 5.1, con una indicación reveladora: usá Fable 5.1 cuando "tus evals con Claude Opus 5.5 a mayor effort igual se quedan cortas". Es decir: la recomendación es exigirle más al modelo barato antes de pagar por el grande.
Cuatro cosas que se rompen al actualizar
No es un reemplazo directo para código corriendo en Opus 5. La guía de migración documenta cuatro cambios que rompen compatibilidad, y cada uno devuelve un 400 en vez de degradarse en silencio:
- El thinking no se puede desactivar. Tanto `thinking: {"type": "disabled"}` como la forma vieja con `budget_tokens` son rechazados. Effort es el único control que queda; donde antes desactivabas el thinking para ahorrar tokens, ahora elegís un effort más bajo.
- Se fue el uso forzado de herramientas. Los tipos `any` y `tool` de `tool_choice` devuelven 400, incluso en el endpoint de conteo de tokens. El reemplazo es `auto` más strict tool use o structured outputs, y decir en el prompt cuándo aplica la herramienta.
- Los bloques de thinking quedan atados al modelo y a la conversación. Solo Fable 5.1 y Mythos 5.1 pueden leer los bloques de thinking de Opus 5.5, así que un router o un fallback que mueva la conversación a otro lado corre esos turnos sin ellos. Mantené la conversación append-only.
- El uso de computadora se mudó a un toolset nuevo. En la Claude API y Google Cloud, `computer_20251124` es rechazado en favor de `computer_toolset_20260801`, que cambia el bucle del agente, no solo el request. En Amazon Bedrock la herramienta vieja sigue funcionando.
Hay un cambio más silencioso que no va a hacer fallar ningún pedido pero sí va a cambiar un producto a la vista: el texto que el modelo escribe entre llamadas a herramientas ahora vuelve como bloques `thinking` de actualización de progreso en lugar de bloques `text`, y con la configuración de display por defecto ese contenido viene vacío. Una aplicación que le muestra esa narración al usuario como progreso se queda muda entre llamadas hasta que active `display: "updates"` o `"summarized"`.
Quien programe también tiene que esperar un abanico más amplio de rechazos. Los clasificadores de seguridad de Opus 5.5 cubren más categorías que los de Opus 5, así que a `cyber` se le suman valores de `stop_details.category` como `bio` y `reasoning_extraction` — y el fallback del lado del servidor no reintenta los pedidos rechazados por `reasoning_extraction`.
Lanzado dentro de una discusión que abrió la propia Anthropic
El timing es la parte que da para pensar. Es el primer lanzamiento de modelo de Anthropic desde que su CEO, Dario Amodei, argumentó públicamente que había que desacelerar el progreso de la IA para que el trabajo de seguridad pueda seguirle el paso: una posición que el anuncio no desanda, sino que reencuadra.
Moderar el ritmo es un enfoque para mantener la IA segura, seguir siendo competitivos frente a China y concretar los beneficios de la IA, particularmente en áreas como la biología y la medicina.
Las afirmaciones de seguridad que acompañan al lanzamiento son concretas. Anthropic dice que Opus 5.5 es el modelo con mejor desempeño que evaluó en su auditoría conductual automatizada —su test de alineación más completo— corrida sobre unos 2.000 escenarios. El modelo fue evaluado antes del lanzamiento por organizaciones externas, entre ellas METR y Frontier Design, y sale con salvaguardas equivalentes a las de Fable 5.1 en ciberseguridad y biología, más protección anti-destilación. El acceso para trabajo legítimo de alto riesgo se canaliza por dos vías con verificación: el Life Sciences Verification Program para investigación en biología y el Cyber Verification Program para profesionales de seguridad validados.
La tensión honesta es que moderar el ritmo y recortar 40% el costo tiran para lados distintos. Inferencia de clase frontera más barata significa más inferencia, de más gente y más rápido, que es exactamente el punto declarado del lanzamiento y también aquello que la moderación del ritmo busca atemperar. La respuesta de Anthropic es que las prácticas de seguridad escalan con la capacidad y que los programas con verificación cubren los bordes filosos. Es una posición coherente; no es una desaceleración, y la empresa tampoco dice que lo sea.
Anthropic dice que Claude Sonnet 5.5 y Claude Haiku 5.5 llegan en las próximas semanas, lo que haría de este el primero de una tanda y no un caso suelto. Para quien hoy paga tarifas de Opus 5 o Fable 5.1 para programación agéntica, la tarea inmediata es poco glamorosa y vale la pena: corré tus propias evals en más de un nivel de effort antes de dar por sentado el ahorro o la calidad.
Por qué importa
- Un recorte de 20% en el precio de lista del tramo frontera, más 60% en las lecturas de caché, cambia la aritmética de cualquiera que corra programación agéntica o cargas de horizonte largo a escala, y presiona los precios de la competencia en el mismo tramo.
- Si los números de Anthropic se sostienen de forma independiente, que un modelo más barato le gane a uno más caro del mismo laboratorio debilita el supuesto de que la capacidad de frontera tiene que costar precios de frontera.
- Actualizar no sale gratis: cuatro cambios que rompen compatibilidad y un effort por defecto que bajó de high a medium implican que cambiar solo el string del modelo modifica tu factura y tu calidad de salida sin avisarte.
- Es el primer lanzamiento de Anthropic desde que su CEO pidió moderar el ritmo de la frontera, lo que vuelve la distancia entre el discurso de seguridad y un modelo más barato, más rápido y más desplegado el punto a seguir.
Puntos clave
- Claude Opus 5.5 (`claude-opus-5-5`) cotiza a $4/$20 por millón de tokens de entrada/salida, contra $5/$25 de Opus 5; las lecturas de caché bajan a $0,20.
- Anthropic dice 40% menos de costo en cargas típicas y salida 30%+ más rápida: el recorte de lista por sí solo es 20%, y un effort por defecto más bajo explica parte del resto.
- En los benchmarks propios de Anthropic le gana al más caro Fable 5.1 en programación agéntica, uso de computadora y trabajo de conocimiento; todavía sin réplica independiente.
- Cuatro cambios que rompen desde Opus 5: el thinking no se desactiva, se rechaza el tool_choice forzado, los bloques de thinking quedan atados al modelo y el uso de computadora exige el toolset nuevo.
- El contexto sigue en 1M de tokens y la salida máxima en 128K; Sonnet 5.5 y Haiku 5.5 llegarían en las próximas semanas.
Fuentes
- AnthropicFuente primariaIntroducing Claude Opus 5.5anthropic.com
- AnthropicFuente primariaModels overview — Claude Docsplatform.claude.com
- AnthropicFuente primariaMigrating to Claude Opus 5.5 — Claude Docsplatform.claude.com
- TechCrunchAnthropic releases Opus 5.5 with lower prices and Fable-level performancetechcrunch.com
- claude
- opus-5-5
- frontier-models
- pricing
- agentic-coding
- ai-safety
- model-migration
- effort
- Anthropic
- Claude Opus 5.5
- Claude Opus 5
- Claude Fable 5.1