
Microsoft libera TauGrid y arma el stack de GPU con un Helm
El equipo de Azure Kubernetes Service publicó bajo licencia MIT las cinco piezas que los equipos de plataforma solían integrar a mano para correr entrenamiento sobre Kubernetes.
17 notas publicadas

La empresa, escindida de Intel en 2020, presentó Active Compute Fabric, una red que busca recortar el tiempo que las GPU pasan esperando datos.

La ingeniería detrás de Perplexity explica cómo Ivy, Tulip y ROSE gestionan la carga de trabajo para sus modelos de embedding a escala web.

El proxy traduce en ambos sentidos entre los formatos de OpenAI y Anthropic, así que Claude Code y Codex CLI pueden apuntar al mismo modelo sin tocar el agente.

La compañía publicó un marco de trabajo que ordena el cálculo alrededor del uso real de la carga, con cuatro escenarios de empresa y sus requisitos de memoria.

Tras los resultados trimestrales, el foco se movió a los sistemas que rodean al acelerador: la CPU Vera, el almacenamiento y la red que ordenan el tráfico en instalaciones de escala gigavatio.

El campus de Pike County correrá exclusivamente con hardware NVIDIA, se levanta en parte sobre terreno federal de enriquecimiento de uranio y arranca en 2028.

NVIDIA, Google y Microsoft empujan en la Open Compute Project una distribución en corriente continua de 800 voltios. Más de 80 fabricantes ya construyen equipos bajo esa especificación.

El complejo de Hrazdan parte con computación acelerada de NVIDIA e infraestructura Dell, y proyecta más de 70.000 GPU Rubin y Blackwell hacia fines de 2027.

La colaboración busca democratizar el acceso a recursos computacionales de alto rendimiento, software y formación técnica para instituciones académicas en EE. UU.

NVIDIA documenta una arquitectura que combina KAI Scheduler y vCluster para dar a cada equipo su propio plano de control, con cuotas de GPU independientes y sin dividir el hardware físico.

Tras perder gran parte de su cartera pública ante Citadel, el fondo de IA mantiene una apuesta clave en Anthropic valorada en 5.000 millones de dólares.

La industria de la IA enfrenta una nueva restricción crítica: la eficiencia operativa. Gestionar las GPUs como activos en tierra es el desafío financiero del momento.

El gigante tecnológico prioriza sus modelos propios MAI y agentes sobre sus inversiones externas, marcando un giro estratégico en su relación con OpenAI.

El fabricante de chips financia al laboratorio detras de Claude, que a cambio desplegara hasta 2 gigavatios de GPU AMD Instinct MI450 en sistemas Helios desde 2027.

El nuevo switch de 102.4 Tbps llega para potenciar las fábricas de IA, duplicando la capacidad de red necesaria para los modelos de próxima generación.

El nuevo DPU y el procesador Vera BlueField-4 STX descargan redes, almacenamiento y seguridad de las CPU para sostener a los agentes de IA, con hasta 6 veces más cómputo que la generación anterior.
Otros temas que aparecen junto a #infraestructura ia en nuestra cobertura editorial.