Una semana tranquila en modelos y ruidosa en quién los controla
Ningún lanzamiento de frontera, ningún cambio de precios. En cambio: el trimestre de NVIDIA y dos millones de GPU más para AWS, una oferta reportada de 12.900 millones por Hugging Face, OpenAI cortándole el acceso a Cursor tras la compra de SpaceX, y Anthropic ganando un juicio y estrenando otro.
Cubre del 23-08-2026 al 29-08-2026
En la frontera no se movió nada esta semana. Ningún laboratorio lanzó un modelo insignia nuevo, ninguna ventana de contexto creció, ninguna lista de precios cambió. Los números más comentados salieron de un balance trimestral. Lo que sí se movió fue la propiedad: quién fabrica el silicio, quién puede terminar siendo dueño del lugar donde se distribuyen los modelos abiertos, y quién tiene permitido comprar acceso a los modelos de un laboratorio de frontera.
La semana del silicio terminó con los números de NVIDIA
Hot Chips fue de domingo a martes y dejó dos hechos concretos. El 24 de agosto NVIDIA anunció que Groq 3 LPX, su acelerador de inferencia interactiva, entró en producción plena como extensión de la plataforma Vera Rubin NVL72; cita un récord de 3.400 tokens de salida por segundo sobre el modelo abierto Gemma 4 31B con 100.000 tokens de contexto en mediciones de Artificial Analysis, y a Nebius como la primera nube en adoptarlo. El 25 de agosto OpenAI publicó los primeros resultados de Jalapeño, su chip de inferencia propio. Esas cifras salen del anuncio de la propia OpenAI; no encontramos ninguna evaluación independiente.
Después, el 26 de agosto, NVIDIA reportó su segundo trimestre fiscal: ingresos por 96.200 millones de dólares, 18% más que el trimestre anterior y 106% más que un año atrás, con 89.000 millones de centro de datos, un alza del 117%, y margen bruto de 75,0%. Esa misma noche anunció junto a AWS un plan para desplegar 2 millones de GPU adicionales en la infraestructura de AWS durante 2027 y 2028, llevar las CPU Vera a AWS, extender NVLink Fusion con memoria de alto ancho de banda a medida, y construir fábricas de IA para el gobierno de Estados Unidos, incluidas 100.000 GPU en infraestructura segura de AWS.
Lo interesante es que se trata de las mismas empresas. Los laboratorios y nubes que diseñan sus propios aceleradores para escapar del poder de NVIDIA — OpenAI, Google, Amazon, Anthropic — son también los que firman sus despliegues más grandes. La integración vertical y la dependencia crecen a la vez, no una después de la otra.
El territorio común de los modelos abiertos podría tener dueño
El 26 y 27 de agosto, The Information informó que NVIDIA acordó comprar Hugging Face por unos 12.900 millones de dólares, después de que Business Insider reportara durante el fin de semana que la empresa recibía interés de compra, y esa misma noche que las conversaciones, con una valuación superior a los 13.000 millones, todavía no habían producido un acuerdo firmado. Ninguna de las dos empresas respondió al pedido de comentarios de TechCrunch, y el blog de Hugging Face no publicó nada al respecto esta semana. Es un reporte creíble, no un hecho confirmado.
Si se cierra, el punto de distribución por defecto de los pesos abiertos quedaría dentro de la empresa que vende el hardware sobre el que corre casi todo eso. NVIDIA viene apoyando los modelos abiertos todo el año — publica su propia familia Nemotron — y la lógica no es sutil: un ecosistema abierto sano les da a los compradores una alternativa a los laboratorios cerrados, y esos compradores alquilan GPU de NVIDIA. Una razón coherente para querer el activo, y una razón para que quien depende del Hub mire quién lo gobierna.
El acceso pasó a ser condicional
El 28 de agosto OpenAI anunció que da de baja el contrato que pone sus modelos dentro de Cursor, tras la adquisición de Cursor por parte de SpaceX. SpaceX cerró esa compra a mediados de agosto, ejerciendo una opción de 60.000 millones de dólares pactada en abril. No pudimos abrir la página del anuncio de OpenAI — openai.com devuelve 403 a clientes automatizados —, así que esto se apoya en el propio feed de noticias de OpenAI, que trae el posteo, su fecha y su resumen: la decisión "de dar de baja nuestro contrato que provee modelos de OpenAI a Cursor tras su adquisición por SpaceX". Detalles ampliamente reportados, como una fecha exacta de corte, no pudimos confirmarlos contra una fuente que lográramos abrir, así que quedan afuera.
Para quien construye sobre un agente de código, la lección práctica es acotada y concreta: qué modelos hay disponibles dentro de una herramienta pasó a depender, en parte, de quién es dueño de esa herramienta. Es un modo de falla nuevo. Si un flujo de trabajo, una configuración de agente o una biblioteca de prompts asume un modelo puntual en un IDE puntual, esa suposición ahora arrastra una dependencia societaria que hace un mes no tenía. Mantener las instrucciones de agente portables entre proveedores dejó de ser una cuestión de prolijidad.
Dos tribunales, un laboratorio
Anthropic tuvo el vaivén más pronunciado de la semana. El 27 de agosto la jueza Rita Lin, del Tribunal de Distrito para el Distrito Norte de California, resolvió que el veto de la administración contra la empresa fue una represalia ilegal bajo la Primera Enmienda, y anuló las directivas que prohibían a las agencias federales y a los contratistas de defensa usar sus productos. "La invocación vacía de la seguridad nacional no es un cheque en blanco para castigar a quienes critican al gobierno y tomar represalias contra ellos", escribió.
El viernes 28 a última hora, en el mismo distrito, Sony Music Publishing, Warner Chappell y otras editoras demandaron a Anthropic y señalaron a los cofundadores Dario Amodei y Benjamin Mann como demandados individuales, alegando una "campaña descarada de descarga ilegal por torrent, scraping y copia de obras protegidas" y reclamando hasta 150.000 dólares por obra, más hasta 25.000 por cada caso de información de gestión de derechos removida. Anthropic le dijo a TechCrunch que está en desacuerdo con los reclamos y que va a defenderse. No hay nada resuelto; lo relevante por ahora es que la pregunta legal viva sobre los laboratorios de frontera es la procedencia de los datos de entrenamiento, no el comportamiento de los modelos.
Lo que sí se lanzó
- Gemini Omni 1.1 Flash (27 de agosto): el modelo de video generativo de Google quedó listo para producción, con extensión de escena en tramos de 10 segundos hasta 40 acumulados, 10 segundos de contexto previo en lugar de uno, control de fotograma inicial y final, previews en 360p para iterar barato y escalado a 4K. Disponible por la API de Gemini en AI Studio.
- Evaluaciones doble ciego (27 de agosto): Google DeepMind puso a prueba lo que llama la primera evaluación doble ciego de un modelo propietario de clase frontera, junto al Instituto de Seguridad de IA de Singapur, OpenMined y AVERI, corriendo un modelo Gemini Flash Lite dentro de Confidential Space para que quien evalúa no vea los pesos y Google no vea los prompts de prueba. Una respuesta estructural a la contaminación de benchmarks es más interesante que la mayoría de los resultados de benchmarks.
- Límites de Gemini Notebook (28 de agosto): los topes diarios de prompts dan lugar a límites ponderados por cómputo que se renuevan cada cinco horas y contemplan la complejidad del prompt, el largo del chat, la cantidad de fuentes y las funciones usadas, para cuentas de consumo en web y móvil desde el 2 de septiembre. Google no publicó números.
Una semana tranquila en capacidad, entonces. Los modelos que usabas el lunes son los mismos que usás hoy, al mismo precio. Lo que cambió es el conjunto de supuestos que hay debajo: quién provee el cómputo, quién administra las alternativas abiertas, y si la relación con el proveedor sobre la que construiste sobrevive a la próxima adquisición.
Por qué importa
- Que modelos hay disponibles dentro de una herramienta pasó a ser en parte una cuestión societaria, no solo técnica o comercial: el corte de OpenAI a Cursor es el primer caso claro, y convierte la portabilidad de configuraciones de agentes y bibliotecas de prompts en un asunto práctico, no en una preferencia.
- Si NVIDIA efectivamente compra Hugging Face, el punto de distribución por defecto de los pesos abiertos queda en manos de la empresa que vende el hardware sobre el que corren. El reporte es creíble pero no está confirmado y ninguna de las dos empresas hizo comentarios.
- El trimestre de NVIDIA y el acuerdo con AWS muestran que la integración vertical y la dependencia crecen a la vez: los mismos laboratorios y nubes que fabrican aceleradores propios firman los despliegues más grandes de NVIDIA.
- La exposición legal viva de los laboratorios de frontera es la procedencia de los datos de entrenamiento, no el comportamiento de los modelos. La demanda de Sony y Warner reclama hasta 150.000 dólares por obra sobre decenas de miles de obras.
Puntos clave
- Segundo trimestre fiscal de NVIDIA: ingresos por 96.200 millones de dólares, 106% más interanual; centro de datos 89.000 millones, 117% más; margen bruto de 75,0%.
- AWS y NVIDIA planean dos millones de GPU adicionales en AWS durante 2027 y 2028, más 100.000 GPU en infraestructura segura de AWS para cargas del gobierno de Estados Unidos.
- Groq 3 LPX entró en producción plena el 24 de agosto; NVIDIA cita 3.400 tokens de salida por segundo sobre Gemma 4 31B con 100K de contexto en mediciones de Artificial Analysis. Los primeros resultados de Jalapeño salen del anuncio de la propia OpenAI, sin evaluación independiente publicada.
- The Information informó que NVIDIA acordó comprar Hugging Face por unos 12.900 millones de dólares; el acuerdo no está firmado y ninguna de las dos empresas hizo comentarios.
- El 27 de agosto una jueza federal anuló las directivas que prohibían usar productos de Anthropic, por considerarlas represalia ilegal bajo la Primera Enmienda; el 28 Sony Music Publishing y Warner Chappell demandaron a la empresa y a dos cofundadores por datos de entrenamiento.
- Se lanzaron: Gemini Omni 1.1 Flash para desarrolladores, un piloto de evaluación doble ciego de DeepMind y límites de uso ponderados por cómputo en Gemini Notebook desde el 2 de septiembre.
Fuentes
- NVIDIA NewsroomFuente primariaNVIDIA Groq 3 LPX Now in Full Production With World-Class Speed for Agentic AInvidianews.nvidia.com
- NVIDIA NewsroomFuente primariaNVIDIA Announces Financial Results for Second Quarter Fiscal 2027nvidianews.nvidia.com
- NVIDIA NewsroomFuente primariaAWS and NVIDIA to Deliver 2 Million Additional GPUs and Next-Generation Infrastructure for Agentic and Physical AInvidianews.nvidia.com
- OpenAIFuente primariaOpenAI News feed: 'Our decision on Cursor following its acquisition by SpaceX' and 'Jalapeno's first results'openai.com
- GoogleFuente primariaGemini Omni 1.1 Flash lets you build with more controlblog.google
- Google DeepMindFuente primariaPiloting the world's first double-blind AI evaluationsdeepmind.google
- GoogleFuente primariaWe're introducing flexible usage limits for Gemini Notebookblog.google
- Ars TechnicaReport: Nvidia to acquire AI model repository Hugging Face for $13 billionarstechnica.com
- TechCrunchNvidia closes in on Hugging Face acquisitiontechcrunch.com
- Ars TechnicaTrump blacklisting of 'woke' Anthropic deemed illegal by federal judgearstechnica.com
- TechCrunchSony Music, Warner sue Anthropic, alleging a 'brazen campaign' of intellectual property thefttechcrunch.com
- The VergeSony Music and Warner Chappell are suing Anthropictheverge.com
- TechCrunchSpaceX officially closes its Cursor acquisitiontechcrunch.com
- weekly-recap
- ai-infrastructure
- open-models
- coding-agents
- copyright
- earnings
- NVIDIA
- OpenAI
- Google DeepMind
- Anthropic
- Amazon Web Services
- Hugging Face
- Cursor
- SpaceX
- Sony Music Publishing
- Warner Chappell
- Groq 3 LPX
- Jalapeno
- Gemini Omni 1.1 Flash
- Gemini Flash Lite
- Gemma 4 31B
- Nemotron