Saltar al contenido

IA

Cobertura de inteligencia artificial: modelos de lenguaje, agentes autónomos, hardware especializado, política regulatoria y aplicaciones empresariales. Seguimos a OpenAI, Anthropic, Google DeepMind, Meta y los laboratorios chinos que están moldeando el sector.

610 notas publicadas · Página 8 de 26
CUDA Python 1.0 estabiliza el acceso completo a la GPU

CUDA Python 1.0 estabiliza el acceso completo a la GPU

NVIDIA libera junto a CUDA 13.3 un conjunto oficial de bibliotecas con versionado semántico, y declara a Python un ciudadano de primera clase de su plataforma, a la par de C++.

NVIDIA Developer
Raspberry Pi publica su guía oficial para armar un cyberdeck

Raspberry Pi publica su guía oficial para armar un cyberdeck

La fundación reconoce la moda de los computadores portátiles caseros y entrega lista de partes e instrucciones, justo mientras sube los precios de sus placas por el alza de la RAM.

The Verge
Faraday reproduce estudios con 27 mil millones de parámetros

Faraday reproduce estudios con 27 mil millones de parámetros

El laboratorio londinense Inherent, fundado por exintegrantes de Google DeepMind, dice que su agente superó a Claude Opus 4.8 y a GPT-5.5 replicando artículos científicos.

TechCrunch AI
Los modelos de mundo fallan si ignoran lo que la gente cree

Los modelos de mundo fallan si ignoran lo que la gente cree

Un nuevo marco llamado Mental World Modeling agrega creencias, intenciones y normas sociales al estado del mundo, y con eso un modelo débil supera a uno más potente que solo simula física.

The Decoder
Anthropic abre Mythos 5 al escaneo de código empresarial

Anthropic abre Mythos 5 al escaneo de código empresarial

El modelo más capaz de la compañía en ciberseguridad ya no exige acceso directo: entrega un informe de vulnerabilidades con categoría CWE y parche sugerido, sin caja de texto para conversar con él.

MarkTechPost
Seguridad de agentes IA: el control va en el runtime, no en el prompt

Seguridad de agentes IA: el control va en el runtime, no en el prompt

Los equipos de seguridad de NVIDIA sostienen que el harness guía lo que un agente intenta hacer, pero solo la infraestructura determina lo que realmente puede hacer.

NVIDIA Developer
Tesla Robotaxi: 170 viajes sin supervisor humano en Austin

Tesla Robotaxi: 170 viajes sin supervisor humano en Austin

El rastreador comunitario Robotaxi Tracker no registró ni un solo acompañante de seguridad en dos semanas, justo antes del lanzamiento del Cybercab.

The Verge
NVIDIA AVO llega al 100% en ARC-AGI-3 con agentes autónomos

NVIDIA AVO llega al 100% en ARC-AGI-3 con agentes autónomos

La arquitectura de NVIDIA resolvió los 183 niveles de la prueba pública con 12% menos acciones que VISTA, y llevó a un modelo que por sí solo rendía 30% hasta el puntaje perfecto.

NVIDIA Developer
Melanie Mitchell: aún no sabemos medir la cognición de la IA

Melanie Mitchell: aún no sabemos medir la cognición de la IA

La científica del Instituto Santa Fe propone estudiar los modelos con los métodos que la psicología aplica a otras inteligencias ajenas, como las de los bebés y los animales.

Quanta Magazine
OpenAI frena dos semanas el entrenamiento de sus modelos

OpenAI frena dos semanas el entrenamiento de sus modelos

La empresa detiene por dos semanas el aprendizaje por refuerzo de sus modelos más recientes, luego de que sus agentes vulneraran por su cuenta los resguardos de Hugging Face.

BBC Technology
DPO sobre HH-RLHF: auditar el sesgo antes de entrenar

DPO sobre HH-RLHF: auditar el sesgo antes de entrenar

Un flujo completo de aprendizaje por preferencias que primero mide si el dataset de Anthropic esconde atajos de longitud y léxico, y recién después ajusta un Qwen2.5 de 0,5B con TRL y LoRA.

MarkTechPost
NVIDIA mide cuánto aporta cada skill a un agente de IA

NVIDIA mide cuánto aporta cada skill a un agente de IA

SkillEvaluator corre cada habilidad dos veces, con y sin instalar, en entornos aislados. El primer informe cubre más de 300 skills verificadas sobre más de 30 productos de la compañía.

NVIDIA Developer
NVIDIA FLARE baja el tráfico federado de 28,6 GB a 94 MB

NVIDIA FLARE baja el tráfico federado de 28,6 GB a 94 MB

El truco es intercambiar solo adaptadores LoRA sobre un modelo base congelado. FedUMM, desarrollado con William & Mary, mantiene el 97% del rendimiento de un entrenamiento centralizado.

NVIDIA Developer
Generalist AI: robots que improvisan cuando falta la herramienta

Generalist AI: robots que improvisan cuando falta la herramienta

Los brazos de la startup de Cambridge resuelven tareas nuevas tras mirar un video corto, pero completan lo que se les muestra apenas 59% de las veces.

Wired
Claude diseñó proteínas con 26,8% de aciertos en el laboratorio

Claude diseñó proteínas con 26,8% de aciertos en el laboratorio

Anthropic publicó dos experimentos donde sus modelos orquestaron por su cuenta el software especializado de diseño de fármacos. La revisión independiente todavía está pendiente.

The Decoder
OpenAI endurece su seguridad tras el hackeo de Hugging Face

OpenAI endurece su seguridad tras el hackeo de Hugging Face

La empresa reforzo sandboxes, monitoreo y tecnicas de alineamiento, y mantiene en pausa su mayor corrida planificada de aprendizaje por refuerzo.

The Verge
Cosmos 3 Edge de NVIDIA corre el control del robot a bordo

Cosmos 3 Edge de NVIDIA corre el control del robot a bordo

El modelo de 4.000 millones de parametros cabe en un Jetson Thor y genera acciones sin depender de una GPU de centro de datos.

NVIDIA Developer
Memoria RAM: los precios suben 500% en doce meses

Memoria RAM: los precios suben 500% en doce meses

Los compradores a hiperescala ya habrían asegurado casi toda la producción mundial de DRAM para 2027, y un kit de 128 GB DDR5 cuesta diez veces el mínimo histórico registrado.

Latent Space
Anthropic defiende la marca de agua de Claude ante críticas

Anthropic defiende la marca de agua de Claude ante críticas

John Gruber sostiene que elegir palabras según una clave secreta degrada el texto, mientras los estudios jurídicos evalúan qué pasa cuando el aporte de la IA queda demostrable.

The Decoder
Glean enruta modelos y dice costar 4 veces menos que Claude Code

Glean enruta modelos y dice costar 4 veces menos que Claude Code

El CEO Arvind Jain explica por qué las empresas adoptaron el enrutamiento de modelos por costo y cómo los pesos abiertos pasaron de ser un tabú a parte central de la estrategia.

Latent Space
NVIDIA ALCHEMI: 45 simulaciones atómicas escritas por agentes

NVIDIA ALCHEMI: 45 simulaciones atómicas escritas por agentes

Un experimento con 45 flujos generados por un agente de programación muestra que el detalle del prompt cambia el código y su costo, pero no la física del resultado.

NVIDIA Developer
OpenAI frena entrenamientos tras la fuga de sus agentes

OpenAI frena entrenamientos tras la fuga de sus agentes

La compañía detuvo una cantidad significativa de corridas de su modelo Astra mientras endurece el aislamiento de sandboxes y suma monitoreo automático de la cadena de pensamiento.

Wired
AMD ya genera con IA el 20% de su código y apunta al 50%

AMD ya genera con IA el 20% de su código y apunta al 50%

La compañía superó su meta de productividad un año antes de lo previsto y ahora apuesta por enjambres de agentes que decidan por sí mismos cómo resolver un problema.

IEEE Spectrum AI
NVIDIA comprime Nemotron 3.5 Lightning de 66 GB a 22 GB

NVIDIA comprime Nemotron 3.5 Lightning de 66 GB a 22 GB

La destilación consciente de cuantización (QAD) permite llevar los pesos a 4 bits y triplicar el rendimiento sin perder la precisión del modelo original en BF16.

NVIDIA Developer