
Agentes de OpenAI dejaron 18.000 mensajes en una wiki alemana
Los sistemas se pasaron respuestas de sus propias pruebas y compartieron un truco para saltarse el aislamiento de su entorno, que otro agente replicó 14 minutos después.
16 notas publicadas

Un informe de investigadores documenta un segundo caso de agentes que rompieron sus restricciones, ocurrido en mayo, meses antes del incidente de Hugging Face que la empresa sí divulgó.

La alianza que la compañía fundó en julio junto a más de dos docenas de empresas pasa a gobernanza neutral, con IBM, Red Hat, SpaceX y Palantir entre sus respaldos.

Pandex publicó paquetes señuelo referenciados en archivos de instrucciones para agentes y logró que empresas del Fortune 500 corrieran su código, sin inyección de prompts ni ingeniería social.

La versión llega tras siete semanas sin lanzamientos, reescribe la instalación, mueve las sesiones a SQLite y suma trabajo compartido en la nube que la documentación advierte que no aísla inquilinos.

El hardware del fabricante de Shenzhen se vende en todo el mundo bajo decenas de marcas distintas, así que el nombre impreso en la carcasa no dice quién escribió el software que corre adentro.

El asistente de IA que nació como proyecto de fin de semana enfrenta hoy una avalancha de propuestas de código escritas por agentes, y sus mantenedores rehicieron sus criterios de confianza.

El investigador Johann Rehberger encadenó pasos individualmente inofensivos hasta lograr ejecución remota de código en el agente, con una tasa de éxito de entre 60% y 80% en sus pruebas.

El equipo detrás del escaneo de secretos comparte seis prácticas para pasar de un prototipo prometedor a un sistema desplegado, con la métrica de seguridad como restricción y no como promedio.

Un análisis práctico sobre el comportamiento de filamentos comunes ante llamas abiertas. ¿Cuáles materiales son un riesgo real en caso de incendio?

Aprende a gestionar tus dependencias de forma eficiente mediante agrupaciones y calendarios personalizados, manteniendo siempre la seguridad de tu repositorio.

El incidente muestra lo difícil que es impedir que los rastreadores web hagan públicas conversaciones supuestamente privadas con chatbots de IA.

La empresa Palm Garden AI desarrolla una capa de decisión relacional que evalúa si una acción del robot es socialmente apropiada antes de ejecutarla frente a personas.

El modelo de OpenAI sobrescribe la variable $HOME y ejecuta borrados destructivos sin pedir confirmación cuando corre sin sandbox, según The Decoder.

El agente de terminal subía directorios completos a Google Cloud, incluidas llaves SSH y contraseñas. Tras la reacción, xAI liberó las 844.530 líneas de Rust bajo Apache 2.0.

El Secure Agent Workspace Reference Design separa el laptop del usuario del entorno de ejecución del agente, con VMs dedicadas, SSO, sandboxing runtime y GitOps para políticas firmadas.
Otros temas que aparecen junto a #seguridad en nuestra cobertura editorial.