
Firebird enciende en Armenia la mayor fábrica de IA de la CEI
El complejo de Hrazdan parte con computación acelerada de NVIDIA e infraestructura Dell, y proyecta más de 70.000 GPU Rubin y Blackwell hacia fines de 2027.
8 notas publicadas

Una guía técnica de NVIDIA explica por qué la forma de un modelo (capas cuadradas, dimensiones múltiplos de 128 y más ancho que profundo) define cuánto rendimiento se saca de una GPU Blackwell.

El host offloading libera memoria HBM al mover activaciones a la RAM del sistema, con hasta 57% más rendimiento al entrenar modelos como DeepSeek-V3 671B en NVIDIA Grace Blackwell.

Nonuniform Tensor Parallelism reconfigura el paralelismo tensorial en caliente cuando una GPU falla dentro de un dominio NVLink, con overhead bajo 1%.

El benchmark en HGX B300 con Qwen 3.5-397B-A17B-FP8 muestra menos del 8% de overhead con Confidential Computing activado.

La arquitectura GPU Query Engine descarga la descompresión al bloque dedicado del Blackwell y aprovecha HBM y NVLink-C2C para acelerar consultas SQL sobre grandes volúmenes de datos.

El stack full-stack de inferencia sobre GB300 combina Dynamo, TensorRT-LLM, NVFP4 y NVLink para multiplicar por 20 el throughput por GPU y desplomar el costo por token.

Anthropic, Microsoft y NVIDIA declaran la disponibilidad general de Claude sobre GPUs Blackwell Ultra y redes Quantum-X800 InfiniBand en Microsoft Foundry para agentes empresariales.
Otros temas que aparecen junto a #blackwell en nuestra cobertura editorial.