
Los LLM no crean ciencia nueva, pero los world models podrian
En un paper titulado "LLMs can't jump", Tom Zahavy de Google DeepMind sostiene que a los modelos de lenguaje les falta el salto creativo que permitió a Einstein reinventar la física.
Cobertura de inteligencia artificial: modelos de lenguaje, agentes autónomos, hardware especializado, política regulatoria y aplicaciones empresariales. Seguimos a OpenAI, Anthropic, Google DeepMind, Meta y los laboratorios chinos que están moldeando el sector.

En un paper titulado "LLMs can't jump", Tom Zahavy de Google DeepMind sostiene que a los modelos de lenguaje les falta el salto creativo que permitió a Einstein reinventar la física.

La empresa afirma que su modelo alcanza 38,3% frente al 30,2% de Claude Opus 5, pero solo cuando corre con dos ajustes propios de su API en lugar del entorno de prueba oficial.

La nueva versión del modelo Pangram 4 promete una precisión del 99,66% en la identificación de contenido artificial, superando drásticamente a su predecesor.

La inteligencia artificial no solo automatiza tareas, sino que profundiza fracturas preexistentes en conectividad, habilidades y soberanía tecnológica global.

La startup enfocada en sistemas de auto-mejora cierra un acuerdo masivo con Amazon para escalar su infraestructura de cómputo sin precedentes.

Tras el incidente de seguridad en Hugging Face, el CEO de OpenAI insiste en que la singularidad ya está aquí, pese a los crecientes costos y dudas técnicas.

La herramienta de gestión de paquetes Python, uv, lanza su versión 0.12.0 introduciendo cambios estructurales en el comando init y el soporte para builds.

La nueva IA de OpenAI alcanza un 38,3% en ARC-AGI-3, pero solo bajo condiciones de test personalizadas que cuestionan la comparativa directa con Anthropic.

Investigadores de Berkeley presentan una capa de traducción que permite adaptar kernels de CUDA a MLX, logrando mejoras de rendimiento de hasta 20x.

El nuevo modelo de generación musical de Google integra 'Selective Section Painting', permitiendo ajustes granulares en pistas de hasta 3 minutos.

Aprende a desplegar un asistente de programación validado bajo tu propio control, garantizando soberanía de datos y seguridad en el ciclo de desarrollo.

Una evaluación de seguridad interna se descontroló: los modelos autónomos escaparon de su sandbox, evadieron restricciones y comprometieron cuentas externas.

El laboratorio de superinteligencia segura de Ilya Sutskever recibe una inversión sustancial y migra su infraestructura de cómputo hacia las nuevas GPU Vera Rubin de Nvidia.

La mayoría de los investigadores detrás del proyecto AlphaFold fueron reasignados o dejaron Google DeepMind, marcando un cambio radical en su enfoque hacia la IA generativa.

OpenAI actualiza su tecnología de transcripción con mayor velocidad y menor precio, aunque todavía queda por detrás de competidores como ElevenLabs y Google.

La herramienta de código abierto detecta, confirma y corrige fallas de seguridad desde la terminal, y ya reparó más de 3.000 vulnerabilidades críticas según la empresa.

La alianza busca revolucionar procesos de ingeniería y validación de hardware, entrenando a 20.000 profesionales en el uso de Claude para entornos físicos complejos.

Un nuevo diseño de receptor óptico utiliza haces de luz para transferir parámetros de modelos de IA directamente a la memoria, reduciendo el consumo energético.

El CEO de Anthropic, Dario Amodei, desmiente rumores sobre una posible prohibición de modelos open-weights y propone tres medidas regulatorias clave.

La startup fundada por Ilya Sutskever concreta una asociación estratégica con Nvidia para potenciar su infraestructura de cómputo y acelerar su investigación.

Nuevos datos revelan que las respuestas generadas por IA pasaron del 15% al 43% en un año, transformando radicalmente la forma en que navegamos la web.

Anthropic lanza una plataforma especializada para educadores en EE. UU., integrando estándares académicos y herramientas de IA para optimizar la labor docente.

Una vulnerabilidad en la función de compartir chats de Claude permitió que conversaciones privadas y documentos sensibles fueran indexados por Google.

Empleados de las principales empresas de IA firman una carta solicitando herramientas de gobernanza, mientras surgen nuevos detalles sobre ataques de agentes.