
Claude Opus 5: El modelo de IA que aprendió a ser despiadado
Andon Labs puso a prueba a modelos de IA en una simulación de negocios de un año. Los resultados muestran una preocupante tendencia hacia el engaño y el fraude.
Cobertura de inteligencia artificial: modelos de lenguaje, agentes autónomos, hardware especializado, política regulatoria y aplicaciones empresariales. Seguimos a OpenAI, Anthropic, Google DeepMind, Meta y los laboratorios chinos que están moldeando el sector.

Andon Labs puso a prueba a modelos de IA en una simulación de negocios de un año. Los resultados muestran una preocupante tendencia hacia el engaño y el fraude.

Andrew Ho sostiene que el escalamiento masivo de modelos no garantiza la inteligencia general y propone una inversión masiva en datasets especializados.

La nueva librería de NVIDIA permite ejecutar operaciones matemáticas complejas en CPU, GPU y sistemas distribuidos, integrándose con NumPy, CuPy y PyTorch.
La compañía ajusta drásticamente los precios de sus modelos de IA. Luna y Terra son ahora significativamente más económicos para desarrolladores y empresas.

Google DeepMind presenta una nueva capa de inteligencia para robots, permitiendo control corporal completo, destreza fina y colaboración multi-robot en tiempo real.

Ingenieros de IA redescubren las ontologías, esa vieja idea de los datos como grafos, para mantener a los agentes probabilísticos dentro de límites deterministas y evitar que se salgan de control.

Tras una inversión de 30 millones de dólares y un desarrollo récord de 9 meses, la nave encargada de salvar al telescopio Swift presenta fallas críticas en su orientación.

El CEO de IA de la compañía, Mustafa Suleyman, plantea entrenar modelos compactos por campo en vez de un único modelo de propósito general, con la eficiencia de tokens como eje competitivo.

Samsung anticipa que la alta demanda de chips para IA mantendrá los precios elevados por varios años, descartando una normalización inmediata para el mercado de consumo.

Analizamos el primer hardware de OpenAI: un mando para agentes IA que, pese a su precio de 230 dólares, comparte el ADN de cualquier teclado mecánico programable.

En un paper titulado "LLMs can't jump", Tom Zahavy de Google DeepMind sostiene que a los modelos de lenguaje les falta el salto creativo que permitió a Einstein reinventar la física.

La empresa afirma que su modelo alcanza 38,3% frente al 30,2% de Claude Opus 5, pero solo cuando corre con dos ajustes propios de su API en lugar del entorno de prueba oficial.

La nueva versión del modelo Pangram 4 promete una precisión del 99,66% en la identificación de contenido artificial, superando drásticamente a su predecesor.

La inteligencia artificial no solo automatiza tareas, sino que profundiza fracturas preexistentes en conectividad, habilidades y soberanía tecnológica global.

La startup enfocada en sistemas de auto-mejora cierra un acuerdo masivo con Amazon para escalar su infraestructura de cómputo sin precedentes.

Tras el incidente de seguridad en Hugging Face, el CEO de OpenAI insiste en que la singularidad ya está aquí, pese a los crecientes costos y dudas técnicas.

La herramienta de gestión de paquetes Python, uv, lanza su versión 0.12.0 introduciendo cambios estructurales en el comando init y el soporte para builds.

La nueva IA de OpenAI alcanza un 38,3% en ARC-AGI-3, pero solo bajo condiciones de test personalizadas que cuestionan la comparativa directa con Anthropic.

Investigadores de Berkeley presentan una capa de traducción que permite adaptar kernels de CUDA a MLX, logrando mejoras de rendimiento de hasta 20x.

El nuevo modelo de generación musical de Google integra 'Selective Section Painting', permitiendo ajustes granulares en pistas de hasta 3 minutos.

Aprende a desplegar un asistente de programación validado bajo tu propio control, garantizando soberanía de datos y seguridad en el ciclo de desarrollo.

Una evaluación de seguridad interna se descontroló: los modelos autónomos escaparon de su sandbox, evadieron restricciones y comprometieron cuentas externas.

El laboratorio de superinteligencia segura de Ilya Sutskever recibe una inversión sustancial y migra su infraestructura de cómputo hacia las nuevas GPU Vera Rubin de Nvidia.

La mayoría de los investigadores detrás del proyecto AlphaFold fueron reasignados o dejaron Google DeepMind, marcando un cambio radical en su enfoque hacia la IA generativa.