Saltar al contenido
Etiqueta

#deepseek

23 notas publicadas

GB300 NVL72: record de 1.648 TFLOPs por GPU entrenando MoE
IA

GB300 NVL72: record de 1.648 TFLOPs por GPU entrenando MoE

El sistema rack-scale de NVIDIA triplica el rendimiento por GPU frente a la generacion anterior al preentrenar DeepSeek-V3 671B, con NVLink de quinta generacion y 1,8 TB/s de ancho de banda por GPU.

NVIDIA Developer
Modelos abiertos ya alcanzan a los cerrados en cibercapacidad
IA

Modelos abiertos ya alcanzan a los cerrados en cibercapacidad

Un analisis del Instituto britanico de Seguridad en IA advierte que la brecha en capacidades ciberneticas cayo de seis a diez meses a solo cuatro a siete, y a una fraccion del costo.

The Decoder
Modelos de IA que 'sobrepiensan': un nuevo riesgo de seguridad
IA

Modelos de IA que 'sobrepiensan': un nuevo riesgo de seguridad

Investigadores de Zhejiang y Alibaba demostraron que prompts lógicamente inconsistentes pueden inflar las respuestas de los modelos de razonamiento hasta 26 veces: un vector de denegación de servicio.

IEEE Spectrum AI
JAX descarga activaciones al host y sube 57% el rendimiento
IA

JAX descarga activaciones al host y sube 57% el rendimiento

El host offloading libera memoria HBM al mover activaciones a la RAM del sistema, con hasta 57% mas rendimiento al entrenar modelos como DeepSeek-V3 671B en NVIDIA Grace Blackwell.

NVIDIA Developer
Modelos chinos superan el 30% en OpenRouter por su bajo costo
IA

Modelos chinos superan el 30% en OpenRouter por su bajo costo

DeepSeek y Z.ai ya representan más del 30% del tráfico semanal en OpenRouter, con picos de 46%, gracias a precios entre 60% y 90% más bajos que los de OpenAI o Anthropic.

The Decoder
Baidu presenta OCR ilimitado que lee decenas de páginas de una vez
IA

Baidu presenta OCR ilimitado que lee decenas de páginas de una vez

El modelo rediseña la atención (R-SWA) para mantener el KV cache constante y procesar más de 40 páginas sin degradación de memoria ni velocidad.

The Decoder
26 mil alumnos chinos: la IA baja 24% las notas de examen
IA

26 mil alumnos chinos: la IA baja 24% las notas de examen

Un estudio panel de 30 meses documenta cómo el uso de asistentes IA acelera la tarea pero desploma los puntajes en exámenes cerrados; el daño en la prueba de acceso tarda dos años en aflorar.

The Decoder
OpenAI corta a la mitad el costo de ChatGPT para invitados
IA

OpenAI corta a la mitad el costo de ChatGPT para invitados

The Information reveló que la compañía optimizó la inferencia para visitantes sin cuenta y bajó a unos pocos cientos las GPU NVIDIA necesarias.

The Decoder
NVIDIA baja hasta 5x el costo por token de DeepSeek V4 en Blackwell
IA

NVIDIA baja hasta 5x el costo por token de DeepSeek V4 en Blackwell

El stack full-stack de inferencia sobre GB300 combina Dynamo, TensorRT-LLM, NVFP4 y NVLink para multiplicar por 20 el throughput por GPU y desplomar el costo por token.

NVIDIA Blog
SGLang sirve DeepSeek-V4 en GB300 con 5x más throughput
IA

SGLang sirve DeepSeek-V4 en GB300 con 5x más throughput

Dos meses después del lanzamiento, el stack abierto pasó de 2.200 a 11.200 tok/s/GPU a la misma interactividad gracias a KV Compression V2, W4A4 MegaMoE y CUDA graphs rompibles en el prefill.

PyTorch Blog
Zhihe A210: SoC RISC-V de 8 núcleos con NPU 12 TOPS para SBC modular
Electrónica

Zhihe A210: SoC RISC-V de 8 núcleos con NPU 12 TOPS para SBC modular

El SoC chino combina cuatro C920 a 2,3 GHz, cuatro C908 a 1,9 GHz y un acelerador IA que corre DeepSeek-7B a 8 tokens por segundo; el dev kit A210 SODIMM V2 se vende en AliExpress por USD 334,33.

CNX Software
NVIDIA Blackwell domina MLPerf Training 6.0 con 8.192 GPUs
IA

NVIDIA Blackwell domina MLPerf Training 6.0 con 8.192 GPUs

Fue la única plataforma en presentar resultados sobre cada test, incluyendo DeepSeek-V3 (671B parámetros) y GPT-OSS-20B, y escaló a 8.192 GPUs Blackwell Ultra en datacenters de producción.

NVIDIA Developer
Post-training de frontera 2026: MOPD reemplaza al RL monolítico
IA

Post-training de frontera 2026: MOPD reemplaza al RL monolítico

Nathan Lambert y Finbarr Timbers repasan en Interconnects cómo MiMo Flash v2, DeepSeek V4 y Nemotron 3 Ultra adoptaron destilación on-policy con múltiples profesores en lugar de un único RL gigante.

Interconnects
Tiezhen Wang: por qué el open source chino le gana a OpenAI
IA

Tiezhen Wang: por qué el open source chino le gana a OpenAI

El ex jefe de ecosistema Asia-Pacífico de Hugging Face habló con Rest of World sobre destilación, monetización y por qué los modelos abiertos chinos están corriendo en hardware estadounidense.

Rest of World
NVIDIA acelera el entrenamiento MoE hasta 93% con kernels CuTe DSL
IA

NVIDIA acelera el entrenamiento MoE hasta 93% con kernels CuTe DSL

Los kernels fusionados eliminan cuellos de botella de memoria y sincronización CPU-GPU, entregan speedup de 1,3× a 2× por kernel y mejoran 93% el pre-entrenamiento de GPT-OSS.

NVIDIA Developer
Costos de IA disparan a empresas hacia DeepSeek V4 y modelos open-source
Electrónica

Costos de IA disparan a empresas hacia DeepSeek V4 y modelos open-source

Las suscripciones de Anthropic y OpenAI quedan en rojo si el usuario las exprime, mientras firmas como Lindy reportan ahorros de millones cambiando Sonnet por DeepSeek V4 sin perder calidad.

Tom's Hardware
NVIDIA Blackwell lidera el primer benchmark de IA agéntica
IA

NVIDIA Blackwell lidera el primer benchmark de IA agéntica

El GB300 NVL72 corre 20× más agentes por megawatt que el HGX H200 en AgentPerf, el primer benchmark de Artificial Analysis que mide cargas reales de agentes encadenando llamadas LLM.

NVIDIA Blog
DeepSeek gana terreno en empresas de EE. UU. por sus bajos costos
IA

DeepSeek gana terreno en empresas de EE. UU. por sus bajos costos

La IA china escala posiciones en el mercado corporativo estadounidense gracias a una agresiva estrategia de precios que desafía a los gigantes de Silicon Valley.

Xataka
Deepseek prioriza investigacion AGI sobre ganancias rapidas
IA

Deepseek prioriza investigacion AGI sobre ganancias rapidas

El fundador Liang Wenfeng le dijo a inversionistas que la ronda de 13.200 millones de dolares apunta a AGI y modelos open source, no a monetizar rapido.

The Decoder
DeepSeek deja permanente el 75% de descuento: hasta 51x mas barato
IA

DeepSeek deja permanente el 75% de descuento: hasta 51x mas barato

El recorte sobre DeepSeek V4 Pro lleva el output a USD 0,87 por millon de tokens y consolida la guerra de precios que la oferta china abrio contra OpenAI y Anthropic.

The Decoder
Los laboratorios de modelos se transforman en laboratorios de agentes IA
IA

Los laboratorios de modelos se transforman en laboratorios de agentes IA

Un giro narrativo de Greg Brockman, el cierre del equipo de modelos de AI21 y el primer equipo de harness en DeepSeek apuntan al mismo movimiento: el modelo dejó de ser el producto.

Latent Space
Deepseek arma equipo en Beijing para competir con Claude Code y Codex
IA

Deepseek arma equipo en Beijing para competir con Claude Code y Codex

La china Deepseek monta un equipo "Harness" en Beijing para construir su propio agente de programación, en competencia directa con los productos de Anthropic, OpenAI y Cursor.

The Decoder

Etiquetas relacionadas

Otros temas que aparecen junto a #deepseek en nuestra cobertura editorial.