
Lanzan Laguna S 2.1: Supera a Deepseek v4 Pro y es más barata
El nuevo modelo de neolab demuestra que es posible superar a los gigantes actuales con una arquitectura optimizada y costos de inferencia reducidos.
23 notas publicadas

El sistema rack-scale de NVIDIA triplica el rendimiento por GPU frente a la generacion anterior al preentrenar DeepSeek-V3 671B, con NVLink de quinta generacion y 1,8 TB/s de ancho de banda por GPU.
Un analisis del Instituto britanico de Seguridad en IA advierte que la brecha en capacidades ciberneticas cayo de seis a diez meses a solo cuatro a siete, y a una fraccion del costo.

Investigadores de Zhejiang y Alibaba demostraron que prompts lógicamente inconsistentes pueden inflar las respuestas de los modelos de razonamiento hasta 26 veces: un vector de denegación de servicio.

El host offloading libera memoria HBM al mover activaciones a la RAM del sistema, con hasta 57% mas rendimiento al entrenar modelos como DeepSeek-V3 671B en NVIDIA Grace Blackwell.

DeepSeek y Z.ai ya representan más del 30% del tráfico semanal en OpenRouter, con picos de 46%, gracias a precios entre 60% y 90% más bajos que los de OpenAI o Anthropic.

El modelo rediseña la atención (R-SWA) para mantener el KV cache constante y procesar más de 40 páginas sin degradación de memoria ni velocidad.

Un estudio panel de 30 meses documenta cómo el uso de asistentes IA acelera la tarea pero desploma los puntajes en exámenes cerrados; el daño en la prueba de acceso tarda dos años en aflorar.
The Information reveló que la compañía optimizó la inferencia para visitantes sin cuenta y bajó a unos pocos cientos las GPU NVIDIA necesarias.

El stack full-stack de inferencia sobre GB300 combina Dynamo, TensorRT-LLM, NVFP4 y NVLink para multiplicar por 20 el throughput por GPU y desplomar el costo por token.

Dos meses después del lanzamiento, el stack abierto pasó de 2.200 a 11.200 tok/s/GPU a la misma interactividad gracias a KV Compression V2, W4A4 MegaMoE y CUDA graphs rompibles en el prefill.

El SoC chino combina cuatro C920 a 2,3 GHz, cuatro C908 a 1,9 GHz y un acelerador IA que corre DeepSeek-7B a 8 tokens por segundo; el dev kit A210 SODIMM V2 se vende en AliExpress por USD 334,33.

Fue la única plataforma en presentar resultados sobre cada test, incluyendo DeepSeek-V3 (671B parámetros) y GPT-OSS-20B, y escaló a 8.192 GPUs Blackwell Ultra en datacenters de producción.

Nathan Lambert y Finbarr Timbers repasan en Interconnects cómo MiMo Flash v2, DeepSeek V4 y Nemotron 3 Ultra adoptaron destilación on-policy con múltiples profesores en lugar de un único RL gigante.

El ex jefe de ecosistema Asia-Pacífico de Hugging Face habló con Rest of World sobre destilación, monetización y por qué los modelos abiertos chinos están corriendo en hardware estadounidense.

Los kernels fusionados eliminan cuellos de botella de memoria y sincronización CPU-GPU, entregan speedup de 1,3× a 2× por kernel y mejoran 93% el pre-entrenamiento de GPT-OSS.

Las suscripciones de Anthropic y OpenAI quedan en rojo si el usuario las exprime, mientras firmas como Lindy reportan ahorros de millones cambiando Sonnet por DeepSeek V4 sin perder calidad.

El GB300 NVL72 corre 20× más agentes por megawatt que el HGX H200 en AgentPerf, el primer benchmark de Artificial Analysis que mide cargas reales de agentes encadenando llamadas LLM.

La IA china escala posiciones en el mercado corporativo estadounidense gracias a una agresiva estrategia de precios que desafía a los gigantes de Silicon Valley.

El fundador Liang Wenfeng le dijo a inversionistas que la ronda de 13.200 millones de dolares apunta a AGI y modelos open source, no a monetizar rapido.

El recorte sobre DeepSeek V4 Pro lleva el output a USD 0,87 por millon de tokens y consolida la guerra de precios que la oferta china abrio contra OpenAI y Anthropic.

Un giro narrativo de Greg Brockman, el cierre del equipo de modelos de AI21 y el primer equipo de harness en DeepSeek apuntan al mismo movimiento: el modelo dejó de ser el producto.

La china Deepseek monta un equipo "Harness" en Beijing para construir su propio agente de programación, en competencia directa con los productos de Anthropic, OpenAI y Cursor.
Otros temas que aparecen junto a #deepseek en nuestra cobertura editorial.