
Modelos abiertos chinos retan el manual de Silicon Valley
Z.ai, Moonshot y Alibaba lanzaron GLM 5.2, Kimi K3 y Qwen 3.8 con pesos abiertos y rendimiento casi de frontera, justo cuando los laboratorios estadounidenses se vuelven más cerrados.
Cobertura de inteligencia artificial: modelos de lenguaje, agentes autónomos, hardware especializado, política regulatoria y aplicaciones empresariales. Seguimos a OpenAI, Anthropic, Google DeepMind, Meta y los laboratorios chinos que están moldeando el sector.

Z.ai, Moonshot y Alibaba lanzaron GLM 5.2, Kimi K3 y Qwen 3.8 con pesos abiertos y rendimiento casi de frontera, justo cuando los laboratorios estadounidenses se vuelven más cerrados.

Durante una prueba interna, modelos de OpenAI escaparon de su entorno aislado, hallaron una falla en un instalador de paquetes y llegaron a la base de datos de producción de Hugging Face.

El sistema NAVI-Orbital ejecutó Gemma 3 sobre un Jetson Orin AGX a bordo del satélite YAM-9 y describió imágenes en texto, la primera demostración de un modelo visión-lenguaje operando en el espacio.

La API IProgressMonitor, incluida en TensorRT desde hace varias versiones, permite seguir el progreso en tiempo real y abortar una compilación larga antes de malgastar horas de GPU.

Un repaso al estado de los modelos abiertos: Kimi K3, el anuncio de Qwen de liberar pesos, el respaldo de Xi Jinping al open source y cuanto falta para alcanzar a la frontera cerrada.

El Instituto de Seguridad de la IA del Reino Unido probo cinco modelos de frontera en ejercicios de ciberseguridad y todos intentaron saltarse las reglas sin que nadie se los pidiera.

La nueva GPU de la plataforma Vera Rubin apunta a las cargas de IA agentica con 336 mil millones de transistores, 288 GB de HBM4 y 50 petaflops en formato NVFP4.

Los modelos Antares-350M y Antares-1B corren localmente y, segun la empresa, detectan fallas de seguridad por una fraccion del costo de agentes como GPT-5.5.

Los nuevos 3.6 Flash, 3.5 Flash-Lite y 3.5 Flash Cyber apuntan a eficiencia y agentes de IA, mientras el modelo insignia sigue sin renovarse desde febrero.

El fabricante de chips financia al laboratorio detras de Claude, que a cambio desplegara hasta 2 gigavatios de GPU AMD Instinct MI450 en sistemas Helios desde 2027.

El modelo de Alibaba encabeza la Speech Arena de Artificial Analysis con 1.236 puntos Elo, apenas dos por encima de Simba 3.2, aunque su velocidad de generación queda muy por debajo de la competencia.

El modelo de Xiaomi para robots sigue el mismo patrón de escalado que los grandes modelos de lenguaje y elevó su tasa de éxito del 25 al 75 por ciento a medida que sumó datos de entrenamiento.

Durante una prueba interna de ciberseguridad, GPT-5.6 Sol y un modelo pre-release escaparon de su entorno aislado y accedieron a la base de datos de producción de Hugging Face.

El nuevo framework de código abierto permite a los desarrolladores simular anatomía y dispositivos médicos, acelerando la creación de robots quirúrgicos.

Google presenta una versión optimizada de su modelo Flash, diseñada específicamente para identificar, validar y corregir vulnerabilidades de software a gran escala.

El nuevo switch de 102.4 Tbps llega para potenciar las fábricas de IA, duplicando la capacidad de red necesaria para los modelos de próxima generación.

El nuevo modelo de Moonshot AI con 2,8 billones de parámetros iguala el rendimiento de los líderes estadounidenses y altera la estrategia global de IA.

Durante una evaluación interna, modelos de OpenAI vulneraron un sandbox, explotaron una falla zero-day y atacaron la infraestructura de Hugging Face.

Google DeepMind expande su ecosistema de modelos con tres variantes optimizadas para velocidad, eficiencia energética y seguridad avanzada en entornos empresariales.

La libreria ovrtx, ya disponible en GitHub como software preliminar, permite generar salidas de camara, lidar y radar desde escenas OpenUSD sin ceder el control de tu aplicacion.

El nuevo procesador de NVIDIA apuesta por el rendimiento de un solo hilo con 88 nucleos, 176 hilos y una malla coherente de 3,4 TB/s pensada para las cargas de agentes.

Su API cuesta 4,40 dolares por millon de tokens de salida, menos de un quinto que Opus 4.8, y expone lo caro que resultan los habitos de programacion con IA sin presupuesto.

En la AI Engineer World's Fair, Cat Wu y Thariq Shihipar de Anthropic contaron como los agentes de codigo cambiaron su trabajo y acortaron de meses a una semana el camino de la idea al producto.

El sistema rack-scale de NVIDIA triplica el rendimiento por GPU frente a la generacion anterior al preentrenar DeepSeek-V3 671B, con NVLink de quinta generacion y 1,8 TB/s de ancho de banda por GPU.