
Agente IA de OpenAI hackeó múltiples servicios externos
El incidente de seguridad, originado durante una prueba interna, resultó ser más extenso de lo revelado inicialmente, afectando infraestructura crítica de terceros.
Cobertura de inteligencia artificial: modelos de lenguaje, agentes autónomos, hardware especializado, política regulatoria y aplicaciones empresariales. Seguimos a OpenAI, Anthropic, Google DeepMind, Meta y los laboratorios chinos que están moldeando el sector.

El incidente de seguridad, originado durante una prueba interna, resultó ser más extenso de lo revelado inicialmente, afectando infraestructura crítica de terceros.

El CEO de Anthropic responde a las críticas de la industria y aclara que, aunque defiende los modelos abiertos, teme por la supremacía militar de China.

El gigante tecnológico presentó su primer modelo especializado en vulnerabilidades y una plataforma de agentes para automatizar la defensa empresarial.

La plataforma NVIDIA Jetson permite a desarrolladores llevar modelos de IA de frontera a cualquier lugar, combinando alto rendimiento y portabilidad extrema.

Aunque no siempre están visibles en el chat, la temperatura y la longitud de respuesta definen la calidad de lo que obtienes. Aprende a manipularlos desde el prompt.

Un modelo pre-lanzamiento de OpenAI vulneró los sistemas de Hugging Face. El incidente reabre la discusión sobre el control y la alineación de modelos avanzados.

NVIDIA presentó una plataforma de simulación médica nativa en GPU para acelerar el desarrollo de robots quirúrgicos mediante física avanzada y modelos de IA.

El líder de ingeniería de OpenAI analiza la evolución de Codex, el auge de los agentes de conocimiento y por qué la IA está transformando el trabajo moderno.

Segun el Wall Street Journal, empleados siguieron encontrando respuestas problematicas tras el lanzamiento, pero la empresa bajo la clasificacion de riesgo del modelo ese otono.

Una vulnerabilidad en la función de compartir enlaces de Claude permitió que conversaciones privadas fueran indexadas por motores de búsqueda. ¿Qué falló?

El nuevo modelo de Anthropic ya está disponible en Claude Max y Pro. Ofrece un rendimiento de vanguardia en codificación y razonamiento a un costo eficiente.

Google DeepMind anuncia la llegada de Gemini 3.6 Flash, junto con las variantes 3.5 Flash-Lite y 3.5 Flash Cyber, optimizando rendimiento y costos de inferencia.

El nuevo modelo de Anthropic alcanza un 30.2% en el benchmark ARC-AGI-3, superando por amplio margen el 7.8% obtenido previamente por el GPT-5.6 Sol de OpenAI.

El proyecto de código abierto de NVIDIA Labs modela cada agente como una clase de Python y alcanza el estado del arte en SWE-bench con la mitad de los tokens.

El modelo compacto de ciberseguridad resuelve el 90% de las tareas y solo deriva los casos más difíciles a GPT-5.4, con un ahorro de costos del 50% según la empresa.

El incidente muestra lo difícil que es impedir que los rastreadores web hagan públicas conversaciones supuestamente privadas con chatbots de IA.

El nuevo indicador, llamado horizonte de gasto, pone una cifra en dólares al punto exacto donde un agente de IA deja de ser más barato que una persona para resolver el mismo problema.

El CEO de Hugging Face, Clem Delangue, pidió a OpenAI liberar las trazas del agente que atacó su plataforma y comprometer 100 millones de dólares en cómputo para reforzar las defensas de la comunidad.

Las dos empresas integraron simulación acelerada por GPU en toda la cadena de fabricación de chips, desde el diseño de materiales a escala atómica hasta el gemelo digital de una fábrica completa.

Ising Calibration 1.5 es un VLM abierto de 31.000 millones de parámetros que interpreta diagnósticos de procesadores cuánticos y decide cómo ajustarlos, ahora en una versión que corre en una GPU.

La compañía usa su procesador Vera en los flujos de diseño electrónico (EDA) con que crea sus próximas CPU y GPU, con hasta 1,5x de rendimiento junto a Cadence y Synopsys.

Moonshot AI publica los pesos del modelo y libera parte de su infraestructura, mientras pruebas independientes exponen brechas en ciberseguridad y matematicas.

Un experimento reconstruyo SQLite en Rust con enjambres de agentes: los planificadores de frontera solo disenaron y los trabajadores economicos hicieron el grueso, recortando el costo hasta 15 veces.

El modelo de NVIDIA alcanza 97,1% de tasa de aprobacion en el benchmark CVDP usando hasta 71% menos tokens que sus rivales de codigo abierto en diseno de chips.