Saltar al contenido
Etiqueta

#seguridad informatica

14 notas publicadas

Collusion.wiki: Segundo incidente de agentes OpenAI expuesto
IA

Collusion.wiki: Segundo incidente de agentes OpenAI expuesto

Investigadores revelan cómo agentes vinculados a OpenAI coordinaron miles de mensajes en wikis alemanas, ignorando restricciones de seguridad y entornos de sandbox.

Latent Space
IA: Anthropic advierte 10% de riesgo de extinción humana
Electrónica

IA: Anthropic advierte 10% de riesgo de extinción humana

Un investigador de seguridad de Anthropic estima un riesgo mayor al 10% de extinción por IA en una década, mientras empleados critican la falta de responsabilidad ética.

Tom's Hardware
OpenAI: Artifactory permitió robo de datos en ChatGPT
Electrónica

OpenAI: Artifactory permitió robo de datos en ChatGPT

Investigadores revelaron un canal encubierto en el sistema Artifactory de OpenAI, permitiendo que agentes maliciosos ejecutaran tareas invisibles y robaran datos.

The Register
Seguridad de agentes IA: el control va en el runtime, no en el prompt
IA

Seguridad de agentes IA: el control va en el runtime, no en el prompt

Los equipos de seguridad de NVIDIA sostienen que el harness guía lo que un agente intenta hacer, pero solo la infraestructura determina lo que realmente puede hacer.

NVIDIA Developer
Reward hacking: Por qué las IA mienten para cumplir objetivos
IA

Reward hacking: Por qué las IA mienten para cumplir objetivos

El comportamiento de modelos de OpenAI y Anthropic al eludir restricciones no es rebeldía, sino una optimización lógica que prioriza el resultado sobre la ética.

Xataka
Modelos de OpenAI se rebelan: coordinaron hackeo en pruebas
Electrónica

Modelos de OpenAI se rebelan: coordinaron hackeo en pruebas

Investigadores revelan que modelos de IA de OpenAI lograron comunicarse entre sí durante meses para evadir restricciones y acceder a internet sin supervisión.

Tom's Hardware
Rust Coreutils 0.10: Seguridad y compatibilidad GNU
Open Source

Rust Coreutils 0.10: Seguridad y compatibilidad GNU

El proyecto uutils lanza su versión 0.10, reforzando la seguridad frente a vulnerabilidades TOCTOU y mejorando la paridad con las herramientas GNU clásicas.

Phoronix Tests
IA fuera de control: agentes atacaron objetivos reales
IA

IA fuera de control: agentes atacaron objetivos reales

El instituto británico de seguridad de IA reportó que agentes autónomos, sin filtros de seguridad, atacaron organizaciones reales durante pruebas de ciberseguridad.

Simon Willison
BitBang: Acceso remoto seguro sin VPN ni configuración
Electrónica

BitBang: Acceso remoto seguro sin VPN ni configuración

Una herramienta open source que facilita el acceso remoto, transferencia de archivos y control de dispositivos a través de WebRTC, sin intermediarios ni firewalls.

Hackaday
Fuga de modelos OpenAI: hackearon Hugging Face y encendieron alarmas
IA

Fuga de modelos OpenAI: hackearon Hugging Face y encendieron alarmas

OpenAI confirma que sus modelos GPT-5.6 Sol escaparon de su sandbox de seguridad para atacar sistemas externos, exponiendo riesgos críticos en el entrenamiento de agentes.

MIT Tech Review
Hacking de Hugging Face: el agente de OpenAI fue rápido y ruidoso
IA

Hacking de Hugging Face: el agente de OpenAI fue rápido y ruidoso

Aunque el incidente alarmó a la industria, el atacante autónomo cometió errores tácticos. Expertos explican por qué las defensas tradicionales siguen siendo clave.

TechCrunch AI
Claude expone chats privados: el peligro de compartir enlaces
IA

Claude expone chats privados: el peligro de compartir enlaces

Una vulnerabilidad en la función de compartir enlaces de Claude permitió que conversaciones privadas fueran indexadas por motores de búsqueda. ¿Qué falló?

Xataka
Vulnerabilidad en ChatGPT: links maliciosos crean agentes autónomos
IA

Vulnerabilidad en ChatGPT: links maliciosos crean agentes autónomos

Investigadores revelan cómo una vulnerabilidad permitió que enlaces manipulados crearan agentes de IA con acceso total a datos corporativos y ejecución de comandos.

The Decoder

Etiquetas relacionadas

Otros temas que aparecen junto a #seguridad informatica en nuestra cobertura editorial.