Esta semana los tokens bajaron. Los agentes ahora van con medidor.
Anthropic y OpenAI bajaron precios el mismo día, mientras Microsoft y Google pasaron el trabajo de agentes y avatares a facturación por uso. Debajo, Anthropic firmó un acuerdo de CPU por USD 11.600 millones y un tribunal dijo que los límites de un proveedor pueden ser un riesgo de cadena de suministro.
Cubre del 20-09-2026 al 26-09-2026
Dos laboratorios de frontera bajaron precios el mismo martes, y dos plataformas se pasaron el resto de la semana poniéndole medidor al trabajo de los agentes. Juntos, los anuncios dicen algo simple: el precio unitario de una llamada al modelo sigue cayendo, pero el costo real ahora está en cuántas llamadas hace un agente y en cómo se facturan.
Dos rebajas, con 90 minutos de diferencia
El 22 de septiembre Anthropic lanzó Claude Opus 5.5 a USD 4 por millón de tokens de entrada y USD 20 por millón de salida, contra USD 5 y USD 25 de Opus 5, y las lecturas de caché bajaron de USD 0,50 a USD 0,20. Anthropic dice que el modelo cuesta alrededor de un 40% menos que Opus 5 en cargas típicas, genera salida más de un 30% más rápido y rinde al nivel del más grande Fable 5.1 en la mayoría de las tareas. Son mediciones de la propia Anthropic. Migrar tiene su costo: en Opus 5.5 ya no se puede desactivar el razonamiento (thinking).
OpenAI respondió ese mismo día con GPT-6 Sol y GPT-6 Luna, dos modelos de razonamiento que quedan por debajo de GPT-6 Astra. Su changelog de la API fija Sol en USD 2 de entrada, USD 0,20 de entrada cacheada y USD 10 de salida por millón de tokens, y Luna en USD 0,10, USD 0,01 y USD 0,50, para prompts de hasta 272K tokens. Según TechCrunch, es la mitad del precio de las versiones GPT-5.6, y el lanzamiento de Anthropic salió unos 90 minutos antes. OpenAI dice que Sol comete cerca de la mitad de errores que su antecesor y que supera a los mejores modelos de Anthropic; ninguna de las dos afirmaciones tiene todavía evaluación independiente. El 25 de septiembre OpenAI publicó además un arreglo para un defecto de codificación de imágenes que degradaba la visión de ambos modelos, y pidió a quienes trabajan con imágenes que vuelvan a probar.
Después llegaron los medidores
El 25 de septiembre Microsoft reorganizó Copilot en torno a Home, Code y Autopilot, el agente persistente que antes se llamaba Scout. Importa más el esquema de precios que los nombres. El chat cotidiano y el trabajo en Office siguen en la licencia por usuario. Cowork, Code, Autopilot y modelos de frontera como Astra y Fable pasan a facturación por uso, medida en Copilot Credits, con políticas de gasto que por defecto se aplican solas a los servicios nuevos.
Live Avatar para Gemini 3.8 Live, de Google, disponible en Gemini Enterprise desde el 24 de septiembre, muestra el mismo patrón a nivel API. Su página de precios convierte el video del avatar a 6.192 tokens por segundo, facturados a USD 1,00 por millón: unos USD 0,37 por minuto de avatar hablando, solo por el video. Google no cobra el tiempo en que el avatar escucha, pero sí vuelve a procesar y facturar los turnos anteriores de la sesión en cada turno nuevo, hasta el límite de contexto.
El cómputo de fondo
Akamai anunció el 24 de septiembre que Anthropic se comprometió a pagar unos USD 11.600 millones en siete años por su nube, orientada a cargas de CPU y no de GPU, con opción de ampliar hasta USD 9.000 millones más. Akamai le emitió a Anthropic un warrant por hasta cerca del 5% de sus acciones, que se habilita a medida que crece el gasto, y el compromiso depende de que Akamai cumpla requisitos de entrega y disponibilidad. TechCrunch vincula el foco en CPU con los agentes, que pasan buena parte del tiempo ejecutando código y navegando en vez de hacer inferencia. A principios de la semana, ABB lanzó Infinitus, una línea de equipos de corriente continua para data centers de IA. La cifra de eficiencia que destaca, más de un 5%, sale de un informe que ABB hizo junto con BCG, y el comunicado no menciona clientes ni fechas de entrega.
Un fallo que va en sentido contrario
El 25 de septiembre la Corte de Apelaciones del Circuito de D.C. confirmó, por 2 a 1, que el Departamento de Guerra puede excluir a Claude de su cadena de suministro bajo la ley federal de seguridad de la cadena de suministro en adquisiciones (FASCSA). El juez Katsas escribió que el departamento tenía sustento de sobra para tratar a Claude como un riesgo de cadena de suministro después de que Anthropic se negó a flexibilizar las prohibiciones contractuales sobre guerra autónoma letal y vigilancia doméstica, y señaló restricciones incorporadas al modelo que le impidieron completar pedidos de usuarios del gobierno. Henderson votó en disidencia. La lectura práctica: la política de uso de un proveedor puede, en sí misma, contar como el riesgo. Cuando revisamos, Anthropic no había publicado una respuesta en su sala de prensa.
También esta semana
- Anthropic informó que unos 950 agentes de Claude detectaron en 21 horas un nuevo sistema enzimático parecido a CRISPR, llamado ART. El trabajo de laboratorio lo hicieron científicos humanos, y la función del sistema todavía no se conoce.
- OpenAI creó un grupo asesor de matemática, sin remuneración, con sede en el Institute for Advanced Study. TechCrunch señala que su estatuto excluye asesorar sobre el ritmo de investigación, y la afirmación de OpenAI de haber resuelto más de 100 problemas abiertos no fue verificada de forma independiente.
- Hugging Face incorporó la carga de GGUF en transformers manteniendo los pesos cuantizados, por ahora solo en Apple Silicon y empezando por Qwen3.5, y sigue recomendando llama.cpp para inferencia local eficiente.
Qué cambia si construís con estos modelos
El precio de lista por token ya no es el número con el que conviene presupuestar. Un modelo más barato que hace más turnos, vuelve a facturar el contexto acumulado o transmite video puede terminar costando más que el caro al que reemplaza. Antes de cambiar, medí el costo por tarea completada con tus propias cargas, fijate si aplica la caché (Opus 5.5 la abarató; la Live API no publica tarifa de entrada cacheada) y leé las notas de migración: el razonamiento obligatorio de Opus 5.5 cambia la latencia y el gasto en tokens de salida.
Por qué importa
- Los precios de lista por token cayeron fuerte, pero los productos con agentes pasan a facturarse por uso, así que el costo total depende de cuántos turnos y cuánto contexto consume un agente.
- El fallo del Circuito de D.C. implica que las negativas incorporadas a un modelo pueden tratarse legalmente como un riesgo de compras para el Departamento de Guerra de EE. UU., algo que afecta a cualquier proveedor que le venda.
Puntos clave
- Claude Opus 5.5 cuesta USD 4/20 por millón de tokens y GPT-6 Sol USD 2/10; las mejoras de rendimiento que declaran ambos proveedores son autoinformadas.
- Microsoft factura por uso Cowork, Code, Autopilot y los modelos de frontera; el video de Gemini Live Avatar cuesta unos USD 0,37 por minuto hablado.
- Anthropic se comprometió a pagarle a Akamai unos USD 11.600 millones en siete años por capacidad de CPU, con hasta USD 9.000 millones más posibles.
- El Circuito de D.C. confirmó 2 a 1 la exclusión de Claude por parte del Pentágono, con la disidencia de Henderson.
Fuentes
- AnthropicFuente primariaIntroducing Claude Opus 5.5anthropic.com
- OpenAIFuente primariaOpenAI API changelogdevelopers.openai.com
- TechCrunchOpenAI launches GPT-6 Sol and Luna, boasting lower cost and fewer mistakestechcrunch.com
- MicrosoftFuente primariaIntroducing the new Copilot with Home, Code and Autopilotblogs.microsoft.com
- Microsoft LearnFuente primariaUnderstand usage-based billing and cost management for Copilot Creditslearn.microsoft.com
- GoogleFuente primariaIntroducing Gemini 3.8 Live with Live Avatarblog.google
- Google CloudFuente primariaGenerative AI pricingcloud.google.com
- Akamai Technologies / SEC EDGARFuente primariaAkamai Announces $11.6 Billion Multi-year Agreement with Anthropic (Form 8-K, Exhibit 99.1)sec.gov
- TechCrunchAnthropic to pay Akamai $11.6 billion over seven years in cloud dealtechcrunch.com
- U.S. Court of Appeals for the D.C. CircuitFuente primariaAnthropic PBC v. United States Department of War, No. 26-1049 (D.C. Cir.)storage.courtlistener.com
- AnthropicFuente primariaClaude discovers a novel enzyme system with CRISPR-like repeatsanthropic.com
- TechCrunchOpenAI forms math advisory group as its AI resolves more than 100 open problemstechcrunch.com
- Hugging FaceFuente primariaTransformers now runs llama.cpp quantshuggingface.co
- ABB / GlobeNewswireFuente primariaABB's new direct current portfolio aims to rewire AI data center energy infrastructureglobenewswire.com
- weekly-recap
- pricing
- agents
- usage-based-billing
- compute
- policy
- Anthropic
- OpenAI
- Microsoft
- Akamai
- ABB
- Hugging Face
- Claude Opus 5.5
- GPT-6 Sol
- GPT-6 Luna
- Gemini 3.8 Live