Promptea.
Lanzamiento de modeloImportante

Claude Sonnet 5.5 mantiene el precio, promete menos tokens y rompe el uso forzado de herramientas

El nuevo modelo intermedio de Anthropic cuesta lo mismo que Sonnet 5 y dice terminar las tareas más rápido. La letra chica está en la documentación: cinco cambios incompatibles en la API.

Promptea Editorial5 min de lectura

Anthropic lanzó Claude Sonnet 5.5 el lunes 28 de septiembre, como segundo modelo de la línea 5.5 después de Opus 5.5. El precio no se movió: US$2 por millón de tokens de entrada y US$10 por millón de salida, igual que Sonnet 5, con ventana de contexto de 1M de tokens y 128K de salida. Lo que vende Anthropic es eficiencia. Según sus propias pruebas, Sonnet 5.5 genera salida más de 30% más rápido que Sonnet 5 y cuesta hasta 30% menos por tarea, porque necesita menos tokens y menos llamadas a herramientas para terminar el mismo trabajo (Anthropic).

Para quien desarrolla, lo más importante está en la documentación, no en la página de lanzamiento. Anthropic enumera cinco cambios incompatibles para el código que ya corre sobre Sonnet 5 (release notes). Cambiar solo el ID del modelo no es una actualización segura.

Lo que dice Anthropic

Todas las cifras de benchmarks que siguen salen del anuncio de Anthropic; al momento de publicar no había ninguna evaluación independiente. Según los números de la empresa, Sonnet 5.5 queda cerca de Opus 5.5 en varias pruebas, a la mitad de precio por token (US$2/US$10 contra US$4/US$20):

  • Terminal-Bench 4.0 (tareas de varios pasos en la línea de comandos): 70,6%, contra 66,4% de Opus 5.5 en su nivel de esfuerzo más alto.
  • CursorBench 4.0: 55,5%, contra 34,1% de Sonnet 5 y 57,8% de Opus 5.5.
  • FrontierCode 1.1: 46,2%, contra 42,4% de Sonnet 5, 54,4% de Opus 5.5 y 49,3% de GPT-6 Sol, de OpenAI.
  • OSWorld 2.1 (uso de computadora, crédito parcial): 80,1%, contra 57,0% de Sonnet 5 y 81,8% de Opus 5.5.
  • GDPval-AA v2.1 (trabajo de conocimiento, corrido por Artificial Analysis): 1844, contra 1449 de Sonnet 5 y 1846 de Opus 5.5.

Las notas al pie importan. Anthropic dice que Artificial Analysis probó un despliegue previo al lanzamiento que tenía un bug que degradaba las respuestas con salidas estructuradas, ya corregido. También dice que Sonnet 5.5 sacó menos en FrontierCode con esfuerzo Max que con Xhigh, porque en Max lanzaba más seguido una revisión de código multiagente que se colgaba o hacía cambios fuera del alcance de la tarea. La propia Anthropic reconoce que Opus 5.5 sigue siendo claramente superior en trabajo complejo y abierto que exige criterio sostenido.

TechCrunch leyó el lanzamiento como una apuesta por la velocidad e informó que Anthropic planea un nuevo modelo Haiku en las próximas semanas, sin fecha firme.

Los cinco cambios incompatibles

Según las notas de migración de Anthropic, cada uno de estos devuelve un error o cambia el comportamiento sin avisar en código escrito para Sonnet 5:

  1. Se terminó thinking: disabled. Mandarlo devuelve un 400. El nivel más bajo ahora es between_tools, que apaga el razonamiento inicial y solo funciona con esfuerzo high o menor. Los presupuestos manuales de thinking también devuelven 400.
  2. No hay uso forzado de herramientas. tool_choice de tipo any o tool devuelve 400. Solo se aceptan auto y none. Anthropic recomienda reemplazarlo por strict tool use o salidas estructuradas, y decir en el prompt cuándo corresponde usar la herramienta.
  3. Los bloques de thinking quedan atados al modelo y a la conversación. Ningún otro modelo puede leer los bloques de Sonnet 5.5, y en cuentas creadas desde el 31 de agosto de 2026, reenviar un bloque después de editar el system prompt, las herramientas o un mensaje anterior devuelve 400 por defecto.
  4. Se rechaza la herramienta vieja computer_20251124 en la API de Claude y en Google Cloud; ahí el uso de computadora exige el nuevo computer_toolset_20260801. Amazon Bedrock todavía acepta la herramienta anterior.
  5. Algunas combinaciones del advisor tool fallan: Opus 4.8, Opus 4.7 y Sonnet 5 quedan rechazados como asesores de un ejecutor Sonnet 5.5.

Hay además un cambio más silencioso. Entre llamadas a herramientas, las notas de progreso más largas ahora vuelven como bloques de thinking, que por defecto vienen vacíos. Una app que le muestra esas notas a sus usuarios en streaming se va a quedar muda a mitad de la tarea, sin ningún error, hasta que cambie la opción de display o use between_tools.

Qué cambia para los prompts y la elección de modelo

Sacar el uso forzado de herramientas es lo que más probablemente rompa código en producción. Un patrón muy común para obtener JSON es definir una única herramienta y obligar al modelo a llamarla. Ese patrón devuelve 400 en Sonnet 5.5. Si tu equipo depende de él, conviene pasar a salidas estructuradas o strict tool use antes de migrar, y volver a probar cualquier prompt que daba por sentado que el modelo no tenía opción.

El esfuerzo también hay que recalibrarlo. Anthropic dice que los niveles cambiaron, así que la misma configuración no produce la misma cantidad de razonamiento que en Sonnet 5. Su recomendación: arrancar en high por defecto, bajar a medium para coding agéntico con tareas bien especificadas y usar medium o low para chat y trabajo sensible a la latencia. El esfuerzo por defecto en la API es high.

En costos, el precio por token no cambia, así que cualquier ahorro depende de que el modelo use efectivamente menos tokens en tu carga de trabajo. El mínimo cacheable del prompt baja de 1.024 tokens en Sonnet 5 a 512, lo que puede ayudar al prompt caching con system prompts cortos. Poner temperature, top_p o top_k en valores no predeterminados sigue devolviendo 400.

Salvaguardas

Sonnet 5.5 es el primer Sonnet que sale con las salvaguardas de ciberseguridad que Anthropic usa en sus modelos más potentes. Según el anuncio, los pedidos de ciberseguridad de mayor riesgo pasan de forma visible a Sonnet 5, y los equipos de seguridad pueden postularse a un Cyber Verification Program ampliado para tener acceso más amplio. El modelo suma además clasificadores contra la extracción de su razonamiento interno, y sus bloques de thinking solo funcionan en la cuenta que los generó.

Disponibilidad

El ID del modelo es claude-sonnet-5-5 en la API de Claude, Amazon Bedrock, Google Cloud, Microsoft Foundry y Claude Platform on AWS. AWS confirmó ese mismo día la disponibilidad en Bedrock y en AWS GovCloud (US). Sonnet 5 figura ahora como legacy; el retiro de Sonnet 5.5 está fijado no antes del 28 de septiembre de 2027 (página del modelo).

Por qué importa

  • Sonnet es el caballito de batalla de muchas cargas en la API y en agentes de código, así que una actualización al mismo precio con ahorro por tarea afecta mucho tráfico en producción.
  • El código que fuerza una llamada a herramienta para obtener JSON, o que apaga el thinking, va a devolver errores 400 en Sonnet 5.5 y hay que cambiarlo antes de migrar.
  • Todas las cifras de benchmarks y costos son de Anthropic; todavía no hay evaluación independiente.

Puntos clave

  • Precio sin cambios: US$2 de entrada / US$10 de salida por millón de tokens, 1M de contexto, 128K de salida.
  • Anthropic dice que es más de 30% más rápido y hasta 30% más barato por tarea que Sonnet 5.
  • tool_choice any/tool y thinking: disabled ahora devuelven 400; usá salidas estructuradas o strict tool use, y between_tools.
  • Los niveles de esfuerzo cambiaron; volvé a calibrarlos en lugar de copiar la configuración de Sonnet 5.

Fuentes

  1. AnthropicFuente primaria
    Introducing Claude Sonnet 5.5
    anthropic.com
  2. Anthropic (Claude Platform Docs)Fuente primaria
    What's new in Claude Sonnet 5.5
    platform.claude.com
  3. Anthropic (Claude Platform Docs)Fuente primaria
    Claude Platform release notes (September 28, 2026)
    platform.claude.com
  4. Anthropic (Claude Platform Docs)Fuente primaria
    Claude Sonnet 5.5 model page
    platform.claude.com
  5. Amazon Web ServicesFuente primaria
    Claude Sonnet 5.5 now available on AWS
    aws.amazon.com
  6. TechCrunch
    Anthropic releases Sonnet 5.5, which it calls a significantly cheaper, faster work partner
    techcrunch.com
Etiquetas:
  • claude
  • sonnet
  • api
  • tool-use
  • structured-outputs
  • migration
  • pricing
Empresas:
  • Anthropic
  • Amazon Web Services
Modelos:
  • Claude Sonnet 5.5
  • Claude Sonnet 5
  • Claude Opus 5.5

Recibí Promptea Semanal en tu email

Un email cada lunes — las mejores historias de IA de la semana, verificadas y resumidas.