
Clusters Kubernetes aislados por equipo sobre una misma GPU
NVIDIA documenta una arquitectura que combina KAI Scheduler y vCluster para dar a cada equipo su propio plano de control, con cuotas de GPU independientes y sin dividir el hardware físico.
19 notas publicadas

Tras perder gran parte de su cartera pública ante Citadel, el fondo de IA mantiene una apuesta clave en Anthropic valorada en 5.000 millones de dólares.

La industria de la IA enfrenta una nueva restricción crítica: la eficiencia operativa. Gestionar las GPUs como activos en tierra es el desafío financiero del momento.

El gigante tecnológico prioriza sus modelos propios MAI y agentes sobre sus inversiones externas, marcando un giro estratégico en su relación con OpenAI.

El fabricante de chips financia al laboratorio detras de Claude, que a cambio desplegara hasta 2 gigavatios de GPU AMD Instinct MI450 en sistemas Helios desde 2027.

El nuevo switch de 102.4 Tbps llega para potenciar las fábricas de IA, duplicando la capacidad de red necesaria para los modelos de próxima generación.

El nuevo DPU y el procesador Vera BlueField-4 STX descargan redes, almacenamiento y seguridad de las CPU para sostener a los agentes de IA, con hasta 6 veces más cómputo que la generación anterior.

Su CEO Guillermo Rauch dice que la gran pelea de esta etapa es si el modelo y el agente quedaran acoplados o si cada pieza sera intercambiable, como en la ingenieria de software.
El fabricante de GPUs se compromete a arrendar la capacidad no colocada por los proveedores jóvenes, financiando a la vez el hardware y el centro de datos que lo aloja.

Bloomberg reveló que Meta prepara una división llamada Meta Compute que competirá directo con AWS, Google Cloud y Microsoft Azure, replicando lo que hizo antes SpaceX con xAI.

OpenAI se suma a la tendencia de las Big Tech al crear su propio procesador de inferencia junto a Broadcom, buscando mayor control y eficiencia de hardware.

Matei Zaharia apuesta por una arquitectura open source y pluggable que pretende estandarizar cómo se orquestan agentes de código y conocimiento dentro de una organización.

El tercer contrato GPU de SpaceX, ahora con Reflection AI, lleva sus rentas anuales a USD 28.000 millones según Jamin Ball: doble de la facturación actual de Coreweave.

La marca registra el nombre menos de un año después del cierre de Dojo y apunta a un mercado dominado por Nvidia y su sistema NVL72.

El CEO Matt Murphy presentó en Computex 2026 una visión donde Colorz 1600, Ara y el switch Teralynx T100 disuelven los límites del cobre y permiten pooled compute, memoria y XPUs a escala global.

El Reino Unido avanza en su meta de ser un creador de IA, no solo un consumidor, integrando tecnología de punta en infraestructura, startups y centros de datos.

El CEO de NVIDIA, Jensen Huang, visita Seúl para consolidar alianzas estratégicas en infraestructura de IA, robótica y manufactura de semiconductores.

Francia apuesta por 5 GW de capacidad mediante un acuerdo con SoftBank, desafiando la posición de España como líder europeo en infraestructura para inteligencia artificial.

El ecosistema suma Firmus en Australia, CoreWeave en Vera Rubin con Anthropic encima, Nebius con Physical AI Workbench y DSX MaxLPS, que mete 40% más GPUs en el mismo presupuesto eléctrico.
Otros temas que aparecen junto a #infraestructura ia en nuestra cobertura editorial.