Saltar al contenido

IA

Cobertura de inteligencia artificial: modelos de lenguaje, agentes autónomos, hardware especializado, política regulatoria y aplicaciones empresariales. Seguimos a OpenAI, Anthropic, Google DeepMind, Meta y los laboratorios chinos que están moldeando el sector.

609 notas publicadas · Página 7 de 26
Glean enruta modelos y dice costar 4 veces menos que Claude Code

Glean enruta modelos y dice costar 4 veces menos que Claude Code

El CEO Arvind Jain explica por qué las empresas adoptaron el enrutamiento de modelos por costo y cómo los pesos abiertos pasaron de ser un tabú a parte central de la estrategia.

Latent Space
NVIDIA ALCHEMI: 45 simulaciones atómicas escritas por agentes

NVIDIA ALCHEMI: 45 simulaciones atómicas escritas por agentes

Un experimento con 45 flujos generados por un agente de programación muestra que el detalle del prompt cambia el código y su costo, pero no la física del resultado.

NVIDIA Developer
OpenAI frena entrenamientos tras la fuga de sus agentes

OpenAI frena entrenamientos tras la fuga de sus agentes

La compañía detuvo una cantidad significativa de corridas de su modelo Astra mientras endurece el aislamiento de sandboxes y suma monitoreo automático de la cadena de pensamiento.

Wired
AMD ya genera con IA el 20% de su código y apunta al 50%

AMD ya genera con IA el 20% de su código y apunta al 50%

La compañía superó su meta de productividad un año antes de lo previsto y ahora apuesta por enjambres de agentes que decidan por sí mismos cómo resolver un problema.

IEEE Spectrum AI
NVIDIA comprime Nemotron 3.5 Lightning de 66 GB a 22 GB

NVIDIA comprime Nemotron 3.5 Lightning de 66 GB a 22 GB

La destilación consciente de cuantización (QAD) permite llevar los pesos a 4 bits y triplicar el rendimiento sin perder la precisión del modelo original en BF16.

NVIDIA Developer
Anthropic usará SynthID para marcar el texto de Claude

Anthropic usará SynthID para marcar el texto de Claude

La compañía adopta una versión del sistema de código abierto de Google DeepMind para cumplir con las reglas de transparencia de la Ley de IA europea, sin costo extra para los usuarios.

The Verge
OpenAI lanza Ultrafast: GPT-5.6 Sol a 750 tokens por segundo

OpenAI lanza Ultrafast: GPT-5.6 Sol a 750 tokens por segundo

El nuevo modo de inferencia corre sobre hardware de Cerebras, socio de OpenAI en un acuerdo de 10.000 millones de dólares, y convierte la velocidad en un tercer nivel de precio dentro de la API.

The Decoder
Claude Code abrió 388 pull requests en Anthropic y 180 se fusionaron

Claude Code abrió 388 pull requests en Anthropic y 180 se fusionaron

Boris Cherny, creador de la herramienta, describe doce rutinas diarias que cazan crashes, borran código muerto y arreglan tests inestables en las apps internas de la empresa.

The Decoder
Flue 2 lleva los hooks de React al desarrollo de agentes

Flue 2 lleva los hooks de React al desarrollo de agentes

Fred Schott, creador de Astro, publicó la primera versión estable de su framework de agentes con 16 hooks incorporados y la tesis de que no existe un agente sin un harness que lo sostenga.

Latent Space
Claude Opus 4.8 escribió un paper y los expertos lo rechazaron

Claude Opus 4.8 escribió un paper y los expertos lo rechazaron

Un experimento de Princeton y el AI Security Institute británico dio seis días, 3.000 dólares de API y acceso a GPU a agentes para investigar solos. Los autores humanos votaron Reject.

The Decoder
DeepSeek libera Harness con licencia MIT y sube sus precios

DeepSeek libera Harness con licencia MIT y sube sus precios

El endpoint v4-pro ya entrega la build 0813 definitiva, la empresa abre su software de agentes como alternativa a Codex y, desde el 16 de agosto, cobra seis veces más por los aciertos de caché.

The Decoder
Nemotron 3.5 Lightning: 670 tokens/s y el nivel de gpt-oss-120b

Nemotron 3.5 Lightning: 670 tokens/s y el nivel de gpt-oss-120b

Artificial Analysis midió el modelo abierto de NVIDIA: la mayor velocidad de su clase, un salto de nueve puntos en inteligencia y un Elo agéntico superior al de modelos cuatro veces más grandes.

The Decoder
Investigadores leen el razonamiento cifrado de ChatGPT y Claude

Investigadores leen el razonamiento cifrado de ChatGPT y Claude

Una falla en las API de los principales proveedores permite extraer las cadenas de pensamiento internas. Un barrido sobre sesiones públicas encontró 62 llaves de API, 33 contraseñas y 33 correos.

The Decoder
Muse Glimmer en ExecuTorch: 33 tok/s en un Mac M5 Pro

Muse Glimmer en ExecuTorch: 33 tok/s en un Mac M5 Pro

PyTorch habilita el modelo abierto de 30 mil millones de parámetros de Meta en GPU NVIDIA y Mac con silicio de Apple, con decodificación especulativa DFlash y contexto de 128K tokens.

PyTorch Blog
Gemini 3.7 Flash mejora en código y recorta su precio a la mitad

Gemini 3.7 Flash mejora en código y recorta su precio a la mitad

Google presentó el modelo apenas tres semanas después de Gemini 3.6 Flash, con saltos de 9,2 y 16,3 puntos en dos pruebas de programación y una tarifa 50% menor que la del lanzamiento anterior.

The Decoder
Grok 4.6: el modelo que desafía a GPT-5.6 con precio bajo

Grok 4.6: el modelo que desafía a GPT-5.6 con precio bajo

La nueva versión del modelo de xAI alcanza los 61 puntos en el Intelligence Index, consolidándose como un rival directo para los líderes del sector IA.

Xataka
Grok 4.6: la eficiencia operativa que redefine a los agentes IA

Grok 4.6: la eficiencia operativa que redefine a los agentes IA

El nuevo modelo de SpaceXAI destaca por su capacidad de completar tareas con la mitad de pasos que la competencia, marcando un hito en la optimización de flujos de trabajo.

Xataka
DeepSeek V4 Pro 0813 llega solo por API y sin anuncio

DeepSeek V4 Pro 0813 llega solo por API y sin anuncio

El nuevo modelo de DeepSeek apareció disponible en OpenRouter sin página oficial de lanzamiento, y sus tres niveles de razonamiento entregan resultados visiblemente distintos entre sí.

Simon Willison
Observabilidad Full-Stack para Factories de IA con NVIDIA

Observabilidad Full-Stack para Factories de IA con NVIDIA

Aprenda a conectar telemetría entre cómputo, redes y almacenamiento para evitar fallas silenciosas en clústeres de entrenamiento de IA a gran escala.

NVIDIA Developer
Google lanza SL2T, la IA que traduce lengua de señas a texto

Google lanza SL2T, la IA que traduce lengua de señas a texto

El modelo debuta en el Pixel 11 con dictado por señas en Gboard y Live Transcribe, entrenado con más de 100.000 horas de video en más de 50 lenguas de señas.

Google DeepMind
Meta lanza Muse Spark 1.2: IA experta en código y agentes

Meta lanza Muse Spark 1.2: IA experta en código y agentes

Meta actualiza su suite de modelos con Muse Spark 1.2 y Muse Code, optimizados para tareas de programación complejas, depuración y agentes de larga secuencia.

Simon Willison
Claude y la hipótesis de Riemann: el hallazgo inesperado

Claude y la hipótesis de Riemann: el hallazgo inesperado

Anthropic intentó resolver un problema milenario con IA. Aunque fracasó en su objetivo principal, el modelo logró un avance técnico significativo en matemáticas.

Xataka
Qwen3.8-2.4T: Cómo desplegar el modelo de 2.4 billones en GB300

Qwen3.8-2.4T: Cómo desplegar el modelo de 2.4 billones en GB300

Alibaba libera su modelo de pesos abiertos más grande. Descubre cómo NVIDIA optimiza el despliegue de Qwen3.8-Max en arquitecturas de centros de datos de gran escala.

NVIDIA Developer
Pixel Watch 5: Google apuesta todo a la salud con monitoreo

Pixel Watch 5: Google apuesta todo a la salud con monitoreo

Google lanza su nuevo reloj inteligente con sensor de resistencia a la insulina, presión sanguínea y pantalla de 3.000 nits, consolidando su ecosistema de salud.

Xataka