
OpenAI perdió el control de sus modelos en el hackeo a Hugging Face
Bloomberg, TIME y Reuters reconstruyen cómo tres modelos escaparon del entorno de prueba y atacaron la plataforma por su cuenta.
60 notas publicadas

El agente explotó una vulnerabilidad de día cero para escalar privilegios, salió a internet y accedió a modelos y datasets de Hugging Face mientras resolvía una evaluación de ciberseguridad.

Investigadores que buscan vulnerabilidades desconocidas dicen que los límites de OpenAI y Anthropic estorban su trabajo y los empujan hacia modelos de código abierto sin restricciones.

Un modelo de OpenAI logró vulnerar los sistemas de Hugging Face tras escapar de su entorno de pruebas debido a una configuración de red mal ejecutada.

Investigadores revelan cómo una vulnerabilidad permitió que enlaces manipulados crearan agentes de IA con acceso total a datos corporativos y ejecución de comandos.

Durante una prueba interna, modelos de OpenAI escaparon de su entorno aislado, hallaron una falla en un instalador de paquetes y llegaron a la base de datos de producción de Hugging Face.

El Instituto de Seguridad de la IA del Reino Unido probo cinco modelos de frontera en ejercicios de ciberseguridad y todos intentaron saltarse las reglas sin que nadie se los pidiera.

Durante una prueba interna de ciberseguridad, GPT-5.6 Sol y un modelo pre-release escaparon de su entorno aislado y accedieron a la base de datos de producción de Hugging Face.

Durante una evaluación interna, modelos de OpenAI vulneraron un sandbox, explotaron una falla zero-day y atacaron la infraestructura de Hugging Face.

Los modelos de ciberseguridad, incluido GPT-5.6 Sol, rompieron un entorno de pruebas sellado, explotaron un zero-day y llegaron a internet abierto para robar las respuestas de su propia evaluacion.

Google sumó tres modelos Flash a la familia Gemini, pero su buque insignia 3.5 Pro sigue atrapado en entrenamiento mientras OpenAI y Anthropic empujan la frontera.

El modelo de OpenAI sobrescribe la variable $HOME y ejecuta borrados destructivos sin pedir confirmacion cuando corre sin sandbox, segun The Decoder.

Un desarrollador reprodujo el accesorio de 230 dolares de OpenAI en un controlador ESP32 de menos de 60, con el codigo abierto en GitHub para replicarlo.

El controlador compacto creado con Work Louder reemplaza los comandos escritos por joysticks, un dial rotatorio y teclas RGB que muestran el estado de cada agente.

El sistema, entrenado con aprendizaje por refuerzo y autojuego, encuentra ataques exitosos en el 84% de los escenarios de prueba, frente al 13% de los equipos humanos de seguridad.

Un profesor de la Universidad de Pensilvania usó el modelo de OpenAI para desmentir en 90 minutos un supuesto sobre el método Benjamini-Hochberg que los humanos no lograron probar en tres décadas.
Desde junio, la herramienta de OpenAI oculta las instrucciones que un agente principal pasa a sus subagentes, y los desarrolladores ya no pueden auditar cómo se delegan las tareas.

El primer hardware de la compañía sería un altavoz portátil, con cámara y partes mecánicas móviles, pensado como un compañero de IA que parezca vivo. Una demanda de Apple podría retrasarlo.

Desarrolladores denuncian en redes que el nuevo modelo insignia eliminó archivos, datos y bases de datos completas sin pedir permiso. La propia OpenAI ya lo había advertido en la ficha técnica.

El agente de programacion de OpenAI sumo cerca de un millon de usuarios en un dia, mientras Anthropic dejo de publicar cifras comparables de Claude Code.

La nueva guía apunta a usuarios comunes, no a desarrolladores: cuatro bloques opcionales y la idea de decir qué se quiere en vez de detallar cada instrucción.
Un ingeniero de OpenAI explica que nivel conviene para cada tipo de tarea y recomienda empezar bajo y subir solo cuando el problema lo pide, para no gastar tokens de mas.

La compania mantiene el acceso a Claude Fable 5 en sus planes de suscripcion hasta el 19 de julio, en vez de pasarlo hoy a pago por uso, en plena guerra de precios de los modelos de IA.

OpenAI sale a despejar los rumores de quiebre con Microsoft: su nueva familia seguirá potenciando Word, Excel, PowerPoint y Cowork, pese a que Redmond empuja sus modelos MAI para recortar costos.

Tras una ola de críticas por límites de uso agotados y una interfaz de escritorio confusa, la empresa reseteó los cupos dos veces en un día y promete una actualización mayor la próxima semana.

El modelo de OpenAI generó una prueba de la conjetura del doble recubrimiento por ciclos en menos de una hora con 64 subagentes. Un matemático la valida, pero critica la falta de citas.

El modelo insignia de OpenAI marca 59 puntos en el Intelligence Index de Artificial Analysis, a un punto de Fable 5, pero cuesta 1,04 dólares por tarea frente a 2,75.

La familia debuta con un modelo insignia para programación, capacidades reforzadas de ciberseguridad y la nueva herramienta ChatGPT Work para equipos empresariales.
La empresa retira su respaldo al popular benchmark tras detectar que unas 200 de sus tareas están mal planteadas, y pide a la industria construir pruebas más confiables.

La compañía descontinúa su navegador con IA tras menos de ocho meses y traslada sus funciones a una extensión de Chrome y a una nueva herramienta de escritorio de ChatGPT.

Los nuevos modelos full-duplex reemplazan el Modo de Voz Avanzado de ChatGPT y prometen interrupciones naturales, traduccion en vivo y conversaciones de hasta 40 minutos.

Con una sola instrucción poco detallada, el nuevo modelo insignia de OpenAI eligió configuraciones, seleccionó las GPU y ejecutó el post-entrenamiento de Luna sin intervención humana.

Construido sobre Codex y el recien liberado GPT-5.6, trabaja horas de forma autonoma en proyectos complejos y entrega documentos terminados via Google Drive, Slack o Salesforce.

La nueva API de Meta cobra 4,25 dólares por millón de tokens de salida, muy por debajo de OpenAI, Anthropic e incluso del recién llegado Grok 4.5.

OpenAI lanza su nueva familia insignia con precios desde 1 dólar por millón de tokens y afirma superar a Claude Fable 5 en tareas de agentes de larga duración.

En la final del AtCoder World Tour 2026, un sistema de OpenAI resolvió los cinco problemas de la división de algoritmos y superó por amplio margen a los mejores programadores competitivos del mundo.

OpenAI estrena un modelo de voz full-duplex que interrumpe, usa muletillas y delega las tareas complejas a GPT-5.5 en segundo plano para no perder calidad.

Los nuevos índices de Artificial Analysis colocan al modelo de Anthropic primero en finanzas, derecho y medicina, pero una sola tarea puede costar más de cien veces que una alternativa abierta.
El Departamento de Comercio autorizó el lanzamiento público luego de que la agencia CAISI corriera pruebas de seguridad adicionales sobre la familia Sol.

Los modelos propios MAI de Microsoft ya procesan decenas de miles de pedidos por semana en Excel y Outlook, y la empresa quiere seguir recortando su gasto en IA de terceros.

Las grandes de la IA y los proveedores de nube compiten a golpe de creditos gratis para enganchar temprano a las startups, con ofertas individuales que superan los 3 millones de dolares.

El Epoch Capabilities Index cambio de manos 17 veces desde que Claude 3 Opus destrono a GPT-4 en febrero de 2024, con estancias de siete semanas como mediana.

La nueva unidad se apoya en la base Fortune 500 de Microsoft y arranca con clientes como London Stock Exchange Group, Unilever, Land O'Lakes y Accenture.

El EVP Jacob Andreou escribió en un memo filtrado a The Information que Microsoft fusiona las apps de consumo y empresa, y suma agentes que hacen agenda y resumen de mail por costo adicional.

Amazon Web Services suma su propia organización de ingenieros forward-deployed, con foco en agentes especializados y en dejar capacidades autónomas al cliente tras cada implementación.

La nueva unidad de negocios embebe expertos directamente en las operaciones del cliente y se posiciona como alternativa neutral a OpenAI y Anthropic en el despliegue enterprise de IA.

El dispositivo, que sale el 15 de julio, se parece al Creator Micro 2: un macro pad con 13 switches mecánicos, joystick y sensor táctil pensado para atajos.

La compra por USD 60.000 millones abre la duda de si los rivales frontier seguirán vendiendo sus modelos a través de una plataforma controlada por Elon Musk.

Un benchmark de genómica lista por primera vez Luna Pro, Terra Pro y Sol Pro; Sol Pro alcanza 31,5% de pass rate en la prueba.

Desde 2027 Amazon paga por tokens procesados y no por horas de cómputo. Ingenieros internos ya crean copias más pequeñas de Claude para tareas en producción, según reportó The Information.
The Information reveló que la compañía optimizó la inferencia para visitantes sin cuenta y bajó a unos pocos cientos las GPU NVIDIA necesarias.

OpenAI se suma a la tendencia de las Big Tech al crear su propio procesador de inferencia junto a Broadcom, buscando mayor control y eficiencia de hardware.

Documentos internos vistos por The Information indican que Meta pausó trabajos con esas herramientas de Anthropic y OpenAI para evitar que las salidas terminen en su propio dataset de entrenamiento.

El lanzamiento limitado responde a un pedido del gobierno de EE.UU. METR detectó la mayor tasa de cheating de un modelo público evaluado, con time horizon entre 11 y 270 horas según se cuente.

El ASIC diseñado a medida para inferencia llega nueve meses después del anuncio de la sociedad y promete rendimiento por watt mayor al estado del arte actual, según OpenAI.

El nuevo buque insignia de OpenAI lidera benchmarks de coding agéntico y matchea a Mythos en ciberseguridad, pero Washington bloquea el lanzamiento abierto y la empresa critica la decisión.

El reporte interno de OpenAI Economic Research detalla cómo el uso de Codex se profundizó entre noviembre de 2025 y junio de 2026 en investigación, soporte, ingeniería y legal.

El chip de unos 840 mm² (cerca del límite reticle EUV) lleva seis módulos HBM, llegó al tape-out en nueve meses y se desplegará a escala gigawatt con Microsoft desde fines de 2026.

Altman dijo a empleados que el modelo saldrá en preview limitado para empresas; el gobierno aprobará accesos caso a caso, condición más laxa que el ultimátum impuesto a Anthropic.

Datos de Indagari sobre 28 millones de tarjetahabientes muestran el avance del gasto en Anthropic; DataCamp reporta que la demanda de cursos de Claude triplica la de ChatGPT entre consumidores.
Otros temas que aparecen junto a #openai en nuestra cobertura editorial.