Saltar al contenido

IA

Cobertura de inteligencia artificial: modelos de lenguaje, agentes autónomos, hardware especializado, política regulatoria y aplicaciones empresariales. Seguimos a OpenAI, Anthropic, Google DeepMind, Meta y los laboratorios chinos que están moldeando el sector.

609 notas publicadas · Página 1 de 26

Más en IA

Claude estrena Docs y Slides y fusiona el chat con Cowork

Claude estrena Docs y Slides y fusiona el chat con Cowork

Las dos herramientas salen en beta y permiten crear documentos y presentaciones desde cualquier conversación, con edición simultánea y comentarios.

The Verge
Jetson AGX Thor cierra el test agéntico de MLPerf en 24 minutos

Jetson AGX Thor cierra el test agéntico de MLPerf en 24 minutos

TensorRT Edge-LLM corrió Qwen3.6-27B en un solo kit de desarrollo y completó las 1.007 vueltas 6,4 veces más rápido que la referencia de llama.cpp.

NVIDIA Developer
Paper2Agent convierte un artículo científico en un agente

Paper2Agent convierte un artículo científico en un agente

El sistema empaqueta el paper y su repositorio en un servidor MCP, de modo que cualquier agente compatible corre los métodos del estudio en lenguaje natural.

MarkTechPost
Google Home se abre a Claude y a otros agentes de IA

Google Home se abre a Claude y a otros agentes de IA

La integración Home MCP deja que un agente externo lea el historial de eventos de la casa y accione los dispositivos, por ahora solo para suscriptores en Estados Unidos.

The Verge
Meta deja que un agente IA configure WhatsApp Business

Meta deja que un agente IA configure WhatsApp Business

Un servidor MCP nuevo conecta agentes como Claude, Cursor, Codex o ChatGPT con la plataforma, y les entrega la creación de la cuenta, la verificación del número y el registro en la Cloud API.

TechCrunch AI
Un modelo MoE de 30B activa solo 3B parámetros por token

Un modelo MoE de 30B activa solo 3B parámetros por token

NVIDIA explica con Nemotron 3.5 Lightning en qué se diferencian los modelos densos y los de mezcla de expertos, y por qué la decisión depende del presupuesto de memoria y de la concurrencia.

NVIDIA Developer
Vera Rubin entrega hasta 30 veces más tokens por megavatio

Vera Rubin entrega hasta 30 veces más tokens por megavatio

La medición de SemiAnalysis AgentX sobre el modelo DeepSeek V4 Pro compara el NVL72 de Vera Rubin contra el GB300 NVL72, y NVIDIA presentó el resultado en el AI Infra Summit.

NVIDIA Blog
IBM mide cuántas veces un agente repite el mismo acierto

IBM mide cuántas veces un agente repite el mismo acierto

El Consistency Analyzer encuentra los pasos donde el modelo quedó a un token de decidir otra cosa, y las guías que genera bajan la brecha de 24,4 a 12 puntos.

Hugging Face Blog
Gemini 3.8 Live habla y ejecuta herramientas a la vez

Gemini 3.8 Live habla y ejecuta herramientas a la vez

Los dos modelos nativos de voz a voz ya corren en el Gemini Live API y en Google AI Studio, con cambio entre 97 idiomas y tarifa por minuto de audio.

MarkTechPost
Salesforce entrena con Nvidia su primer modelo de razonamiento

Salesforce entrena con Nvidia su primer modelo de razonamiento

Koa se construyó sobre Nemotron, el modelo de pesos abiertos de Nvidia, y se entrenó con datos sintéticos que imitan llamadas de servicio al cliente sin usar información real de las empresas.

TechCrunch AI
Amodei pide un límite de velocidad para la IA que se mejora sola

Amodei pide un límite de velocidad para la IA que se mejora sola

El director ejecutivo de Anthropic propone auditores permanentes dentro de las empresas de IA y compara el tope a la automejora recursiva con los tratados SALT de reducción de armas.

The Decoder
NVIDIA lleva el MoE de DeepSeek-V3 de 103 a 1.068 TFLOPS

NVIDIA lleva el MoE de DeepSeek-V3 de 103 a 1.068 TFLOPS

Los kernels de Transformer Engine para JAX atacan los tensores irregulares del enrutamiento sin descartes, en una línea base donde la comunicación entre GPU se comía el 84% del tiempo de kernel.

NVIDIA Developer
TRL v1.14 sincroniza solo el adaptador LoRA hacia vLLM

TRL v1.14 sincroniza solo el adaptador LoRA hacia vLLM

Un adaptador de rango 1 pesa unos megabytes, así que viaja por un bucket montado en cada Job en vez de NCCL, y el entrenador queda en otra máquina que las réplicas de inferencia.

Hugging Face Blog
ZGateway de Meta absorbe mil millones de operaciones por segundo

ZGateway de Meta absorbe mil millones de operaciones por segundo

El proxy sin estado se intercala entre más de un millón de máquinas cliente y ZippyDB, la base clave-valor más usada de Meta, y ya transporta cerca del 40% de su tráfico.

MarkTechPost
Cornelis levanta 205 millones para competirle a Nvidia

Cornelis levanta 205 millones para competirle a Nvidia

La empresa, escindida de Intel en 2020, presentó Active Compute Fabric, una red que busca recortar el tiempo que las GPU pasan esperando datos.

TechCrunch
DeepMind vio a sus agentes hacer trampa y delatarse entre ellos

DeepMind vio a sus agentes hacer trampa y delatarse entre ellos

Un enjambre de 100 agentes con Gemini 3.1 Pro encontró un atajo para dar por resueltos 34 problemas de matemáticas, y 24 de ellos terminaron denunciando a los 14 que lo usaban.

MIT Tech Review
OM-1 entrena robots solo con demostraciones humanas

OM-1 entrena robots solo con demostraciones humanas

La política de manipulación de Reward AI aprende de personas que usan un guante sensorizado y después corre en brazos industriales y humanoides, sin teleoperación ni datos tomados desde el robot.

MarkTechPost
Andon Labs pone a una IA a cargo de un café y una tienda

Andon Labs pone a una IA a cargo de un café y una tienda

La empresa de seguridad de IA arrienda locales reales y deja que un agente maneje el presupuesto, los pedidos y el menú, para medir cuánta responsabilidad aguanta hoy un modelo fuera del laboratorio.

IEEE Spectrum AI
OpenAI diseñó su chip Jalapeño en menos de 20 meses

OpenAI diseñó su chip Jalapeño en menos de 20 meses

La empresa usó sus propios modelos de lenguaje para acelerar el diseño, con un equipo que promedió menos de 100 personas y con Broadcom a cargo del diseño físico desde las compuertas en adelante.

IEEE Spectrum AI
NVIDIA libera OSMO, que orquesta el entrenamiento de robots

NVIDIA libera OSMO, que orquesta el entrenamiento de robots

El orquestador es nativo de Kubernetes, sale con licencia Apache 2.0 y describe en un solo archivo YAML las tres etapas por las que pasa una política de control antes de llegar al robot.

MarkTechPost
Agentes de OpenAI atacaron RubyGems y buscaron claves de API

Agentes de OpenAI atacaron RubyGems y buscaron claves de API

El caso no se había hecho público y ocurrió más de un mes antes del episodio de Hugging Face que sí se conocía.

The Verge
Altman, Musk y Nadella respaldan el freno que propone Anthropic

Altman, Musk y Nadella respaldan el freno que propone Anthropic

Ninguno de los tres firmó un compromiso. Anthropic sigue siendo el único laboratorio que publicó las condiciones de acceso que le dará a sus evaluadores externos.

MarkTechPost
DeepSeek V4.1 Flash separa los parámetros de leer y de escribir

DeepSeek V4.1 Flash separa los parámetros de leer y de escribir

El modelo suma 763.000 millones de parámetros, activa 8.000 millones en la entrada y 16.000 millones en la salida, y con eso baja la caché de claves y valores hasta un octavo de la del V4 Flash.

Latent Space