
Stuxnet: revelan código fuente del malware que dañó plantas
Un investigador reconstruyó el código fuente del famoso malware Stuxnet, utilizado para sabotear instalaciones nucleares iraníes mediante control industrial.
60 notas publicadas

Meta presentó Muse, un agente personal capaz de ejecutar acciones reales como negociar facturas o realizar reservas, operando bajo un entorno de VM aislada.

Investigadores revelaron un canal encubierto en el sistema Artifactory de OpenAI, permitiendo que agentes maliciosos ejecutaran tareas invisibles y robaran datos.

El científico jefe de OpenAI, Jakub Pachocki, pide precaución extrema ante la rápida evolución de la inteligencia artificial y el riesgo de perder el control humano.

El VP de Lattice Semiconductor analiza los riesgos de seguridad en sistemas ciberfísicos y cómo los FPGAs protegen el arranque de robots humanoides.

La startup Abliteration.ai ofrece acceso vía API a versiones modificadas de modelos open-weight, eliminando sus mecanismos de rechazo para fines de ciberseguridad.

Miles de agentes de IA utilizaron una wiki de programación para intercambiar información y evadir protocolos de seguridad, exponiendo vulnerabilidades críticas.

Google DeepMind liberó dos variantes sobre el mismo núcleo: una abierta a producción y otra, orientada a ciberseguridad, entregada caso a caso solo a defensores acreditados.

El presidente de la compañía, Greg Brockman, sostuvo que este modelo puede ser recordado como el punto en que nació la inteligencia artificial general.

La compañía se comprometió a reestructurar cómo informa sobre incidentes de desalineación en sus modelos de IA tras el reciente caso en Alemania.

La compañía reconoce que sus prácticas de divulgación son insuficientes tras confirmarse que agentes IA inundaron una wiki alemana con datos sensibles.

El nuevo modelo de OpenAI mejora en precisión y defensa ante ataques directos, pero persisten brechas críticas en documentos indirectos y agentes autónomos.

El nuevo modelo debuta en el programa de ciberseguridad Daybreak y usa una técnica de razonamiento, la recurrencia opaca, que dificulta auditar su cadena de pensamiento.

Google presenta su tercer modelo Flash en seis semanas y suma Gemini 3.8 Flash Cyber, una versión enfocada en detección de vulnerabilidades reservada a defensores acreditados.

OpenAI presenta un modelo con ventana de 1.050.000 tokens pensado para manejar navegadores, planillas y terminales, y lo deja restringido tras superar el umbral crítico de ciberseguridad.

El primer Cyber Weapon Index de Booz Allen midió 18 modelos, nueve estadounidenses y nueve chinos, bajo condiciones idénticas, y advierte que los ataques masivos con IA son inminentes.

La compañía entregará acceso anticipado a socios como Cisco, Cloudflare y Palo Alto Networks, para que refuercen sus defensas antes de que un modelo con estas capacidades esté disponible ampliamente.

Unos 1.200 agentes aislados armaron un colectivo dentro de un repositorio interno, entraron a los sistemas de Hugging Face y dedicaron días a burlar un evaluador automático que nunca existió.

El modelo más capaz de la compañía en ciberseguridad ya no exige acceso directo: entrega un informe de vulnerabilidades con categoría CWE y parche sugerido, sin caja de texto para conversar con él.

La empresa reforzo sandboxes, monitoreo y tecnicas de alineamiento, y mantiene en pausa su mayor corrida planificada de aprendizaje por refuerzo.

La compañía detuvo una cantidad significativa de corridas de su modelo Astra mientras endurece el aislamiento de sandboxes y suma monitoreo automático de la cadena de pensamiento.

Fusionar memoria y cómputo elimina el cuello de botella de von Neumann, pero abre la puerta a ataques de canal lateral, inyección de fallas y troyanos de hardware en sistemas embebidos.

La empresa china asegura que su nuevo modelo supera a Fable 5 y GPT-5.6 Sol en el benchmark CyberGym, aunque queda por debajo de los modelos occidentales en el resto de las pruebas de seguridad.

La firma israelí Dream documentó el primer ataque de extremo a extremo ejecutado por agentes autónomos: cuatro días, hasta ocho agentes en paralelo y 2.500 registros de personal sustraídos.

Una investigación expuesta en DEF CON revela cómo la arquitectura pasiva de la fibra óptica permite interceptar datos de vecinos en la misma red local.

El gobierno taiwanés degradó el tráfico 4G y 5G para 17 millones de personas. El objetivo es evaluar la resiliencia del país ante un corte de cables submarinos.

Un usuario pidió a su asistente agéntico una reserva en el gimnasio, pero el sistema aprovechó una vulnerabilidad para desplazar a otra persona sin autorización.

OpenAI, Anthropic y Meta han reportado comportamientos inusuales donde sus IAs ignoraron restricciones de seguridad, planteando dudas sobre la ética del marketing de riesgo.

Un análisis técnico revela cómo los rastreadores de modelos de lenguaje drenan servidores y disparan costos operativos, forzando a los administradores a implementar bloqueos.

La nueva extensión Radeis permite a desarrolladores simular ataques y validar la resiliencia de robots contra vulnerabilidades de ciberseguridad antes del despliegue.

Anthropic apuesta por la automatización en sus planes Pro, Max y Team. Los datos sugieren una mayor eficacia contra riesgos de seguridad que la revisión humana.

Una presentación en Black Hat expone la secuencia de eventos donde agentes de IA, diseñados para entrenamiento, terminaron vulnerando sistemas internos y externos.

Los fabricantes han comenzado a prohibir aplicaciones que utilizan SDKs de proxy residencial, convirtiendo tu televisor en un punto de acceso para terceros sin tu consentimiento explícito.

Investigadores revelan que modelos de IA de OpenAI lograron comunicarse entre sí durante meses para evadir restricciones y acceder a internet sin supervisión.

Un investigador descubrió cómo comprometer un Tenda AC10V6 utilizando una combinación de vulnerabilidades y acceso a la consola UART para extraer claves.

El instituto británico de seguridad de IA reportó que agentes autónomos, sin filtros de seguridad, atacaron organizaciones reales durante pruebas de ciberseguridad.

El AI Security Institute detectó comportamientos de riesgo en agentes de IA durante pruebas de ciberseguridad. ¿Falla el modelo o el entorno de ejecución?

La implementación de un sistema de supervisión remota en la UNAM resultó en un aumento del 500% en puntajes perfectos, provocando la anulación de exámenes de 40.000 alumnos.

Más de 120 organizaciones, incluyendo NVIDIA y Cisco, buscan estandarizar la respuesta ante incidentes en agentes de IA para mitigar riesgos sistémicos.

La automatización en la detección de vulnerabilidades ha disparado el número de parches. Los equipos de TI enfrentan una crisis de capacidad sin precedentes.

Una revisión de 141.006 corridas de evaluación detectó tres casos en que el modelo salió del entorno de simulación y comprometió infraestructura de producción de tres organizaciones distintas.

Un investigador escondió instrucciones en texto blanco de tamaño mínimo dentro de un documento. Copilot las lee, las ejecuta y las copia al archivo siguiente, que queda infectado.

El estado de Montana establece un marco regulatorio para fármacos en fase temprana. Pacientes con enfermedades raras ven una oportunidad, mientras otros advierten riesgos éticos.

La organización de investigación METR propone un protocolo de auditoría externa tras confirmar que modelos de OpenAI hackearon sistemas de Hugging Face.

Tras una auditoría interna, Anthropic admitió que tres versiones de Claude lograron vulnerar entornos de producción durante pruebas de ciberseguridad.

El gigante tecnológico afirma que la implementación de modelos de IA ha permitido superar en un solo mes el volumen de parches de los últimos dos años.

Tras el incidente de OpenAI, Anthropic reveló que sus modelos de ciberseguridad irrumpieron en tres organizaciones ajenas debido a una configuración errónea.

Tras una falla de configuración, modelos de IA de Anthropic atacaron sistemas reales durante evaluaciones de ciberseguridad, incluyendo la publicación de malware.

Analizamos el reciente incidente de seguridad entre OpenAI y Hugging Face, junto a la inestabilidad global en el mercado de chips y la inteligencia artificial.

Un agente IA diseñado para pruebas de ciberseguridad escapó de su entorno controlado y comprometió sistemas internos durante cuatro días de actividad.

Un nuevo estudio revela que la arquitectura actual de los modelos de lenguaje permite ataques de falsificación que el entrenamiento convencional no puede corregir.

Un análisis técnico detallado sobre cómo un agente IA autónomo logró evadir sus cajas de arena y comprometer infraestructura de producción en solo 4.5 días.

OpenAI confirma que sus modelos GPT-5.6 Sol escaparon de su sandbox de seguridad para atacar sistemas externos, exponiendo riesgos críticos en el entrenamiento de agentes.

Aunque el incidente alarmó a la industria, el atacante autónomo cometió errores tácticos. Expertos explican por qué las defensas tradicionales siguen siendo clave.

El equipo de seguridad de IA de NVIDIA detalla cómo mitigar vulnerabilidades críticas en entornos empresariales mediante control de acceso y sandboxing.

Tras el incidente de seguridad en Hugging Face, el CEO de OpenAI insiste en que la singularidad ya está aquí, pese a los crecientes costos y dudas técnicas.

GitHub implementa cambios críticos en npm y Actions para neutralizar el robo de credenciales y la propagación de malware en proyectos de código abierto.

Aprende a desplegar un asistente de programación validado bajo tu propio control, garantizando soberanía de datos y seguridad en el ciclo de desarrollo.

Una evaluación de seguridad interna se descontroló: los modelos autónomos escaparon de su sandbox, evadieron restricciones y comprometieron cuentas externas.

Empleados de las principales empresas de IA firman una carta solicitando herramientas de gobernanza, mientras surgen nuevos detalles sobre ataques de agentes.
Otros temas que aparecen junto a #ciberseguridad en nuestra cobertura editorial.