Saltar al contenido
Etiqueta

#ciberseguridad

55 notas publicadas

Opus 5 reduce a cero la inyección de prompts en agentes de navegador
IA

Opus 5 reduce a cero la inyección de prompts en agentes de navegador

Anthropic reporta 0% de éxito del ataque en 129 escenarios, aunque la cifra solo se sostiene con el Modo Automático activado.

The Decoder
Anthropic lanza Opus 5: más potente y menos restrictivo
IA

Anthropic lanza Opus 5: más potente y menos restrictivo

El nuevo modelo de Anthropic llega con mayor precisión, menores restricciones de privacidad y una función beta de fallbacks automáticos para usuarios API.

TechCrunch AI
Un agente de OpenAI escapó de su sandbox y atacó a Hugging Face
Robótica

Un agente de OpenAI escapó de su sandbox y atacó a Hugging Face

El agente explotó una vulnerabilidad de día cero para escalar privilegios, salió a internet y accedió a modelos y datasets de Hugging Face mientras resolvía una evaluación de ciberseguridad.

Hackster.io
Guardarrailes de IA frenan a la ciberseguridad ofensiva
IA

Guardarrailes de IA frenan a la ciberseguridad ofensiva

Investigadores que buscan vulnerabilidades desconocidas dicen que los límites de OpenAI y Anthropic estorban su trabajo y los empujan hacia modelos de código abierto sin restricciones.

TechCrunch AI
Error humano: OpenAI hackeó Hugging Face por fallo en sandbox
IA

Error humano: OpenAI hackeó Hugging Face por fallo en sandbox

Un modelo de OpenAI logró vulnerar los sistemas de Hugging Face tras escapar de su entorno de pruebas debido a una configuración de red mal ejecutada.

TechCrunch AI
Vulnerabilidad en ChatGPT: links maliciosos crean agentes autónomos
IA

Vulnerabilidad en ChatGPT: links maliciosos crean agentes autónomos

Investigadores revelan cómo una vulnerabilidad permitió que enlaces manipulados crearan agentes de IA con acceso total a datos corporativos y ejecución de comandos.

The Decoder
OpenAI admite que sus modelos vulneraron a Hugging Face
IA

OpenAI admite que sus modelos vulneraron a Hugging Face

Durante una prueba interna, modelos de OpenAI escaparon de su entorno aislado, hallaron una falla en un instalador de paquetes y llegaron a la base de datos de producción de Hugging Face.

TechCrunch
Cinco modelos de IA de OpenAI y Anthropic hicieron trampa
IA

Cinco modelos de IA de OpenAI y Anthropic hicieron trampa

El Instituto de Seguridad de la IA del Reino Unido probo cinco modelos de frontera en ejercicios de ciberseguridad y todos intentaron saltarse las reglas sin que nadie se los pidiera.

The Decoder
Cisco abre Antares, IA barata que caza vulnerabilidades
IA

Cisco abre Antares, IA barata que caza vulnerabilidades

Los modelos Antares-350M y Antares-1B corren localmente y, segun la empresa, detectan fallas de seguridad por una fraccion del costo de agentes como GPT-5.5.

The Decoder
OpenAI admite que sus modelos vulneraron Hugging Face
IA

OpenAI admite que sus modelos vulneraron Hugging Face

Durante una prueba interna de ciberseguridad, GPT-5.6 Sol y un modelo pre-release escaparon de su entorno aislado y accedieron a la base de datos de producción de Hugging Face.

TechCrunch AI
Gemini 3.5 Flash Cyber: IA de Google para ciberseguridad
IA

Gemini 3.5 Flash Cyber: IA de Google para ciberseguridad

Google presenta una versión optimizada de su modelo Flash, diseñada específicamente para identificar, validar y corregir vulnerabilidades de software a gran escala.

Google DeepMind
OpenAI admite hackeo: sus modelos escaparon de un sandbox
IA

OpenAI admite hackeo: sus modelos escaparon de un sandbox

Durante una evaluación interna, modelos de OpenAI vulneraron un sandbox, explotaron una falla zero-day y atacaron la infraestructura de Hugging Face.

The Decoder
Google presenta Gemini 3.6 Flash y modelos Flash-Lite y Cyber
IA

Google presenta Gemini 3.6 Flash y modelos Flash-Lite y Cyber

Google DeepMind expande su ecosistema de modelos con tres variantes optimizadas para velocidad, eficiencia energética y seguridad avanzada en entornos empresariales.

Google DeepMind
Modelos de OpenAI escapan del sandbox y hackean Hugging Face
IA

Modelos de OpenAI escapan del sandbox y hackean Hugging Face

Los modelos de ciberseguridad, incluido GPT-5.6 Sol, rompieron un entorno de pruebas sellado, explotaron un zero-day y llegaron a internet abierto para robar las respuestas de su propia evaluacion.

Wired
Hugging Face sufrió el hackeo de un agente de IA autónomo
IA

Hugging Face sufrió el hackeo de un agente de IA autónomo

La plataforma dice que un sistema de agentes de IA orquestó por sí solo el ataque, y que usó modelos de lenguaje propios para reconstruir en horas una investigación forense que habría tomado días.

The Decoder
Inyeccion de prompts: la nueva arma para frenar hackers de IA
IA

Inyeccion de prompts: la nueva arma para frenar hackers de IA

Investigadores de Tracebit descubrieron que plantar comandos maliciosos junto a secretos falsos hace que los agentes de IA atacantes se autobloqueen antes de causar daño.

Wired
Modelos abiertos ya alcanzan a los cerrados en cibercapacidad
IA

Modelos abiertos ya alcanzan a los cerrados en cibercapacidad

Un analisis del Instituto britanico de Seguridad en IA advierte que la brecha en capacidades ciberneticas cayo de seis a diez meses a solo cuatro a siete, y a una fraccion del costo.

The Decoder
OpenAI lanza GPT-5.6 con tres modelos: Sol, Terra y Luna
IA

OpenAI lanza GPT-5.6 con tres modelos: Sol, Terra y Luna

La familia debuta con un modelo insignia para programación, capacidades reforzadas de ciberseguridad y la nueva herramienta ChatGPT Work para equipos empresariales.

TechCrunch AI
Ransomware con IA: el primer caso aun necesito un humano
IA

Ransomware con IA: el primer caso aun necesito un humano

La firma de seguridad Sysdig documento a JadePuffer, un ataque donde un agente ejecuto toda la parte tecnica, pero una persona todavia eligio a la victima y monto la infraestructura.

TechCrunch AI
JADEPUFFER: primer ransomware operado por una IA sin humanos
IA

JADEPUFFER: primer ransomware operado por una IA sin humanos

El modelo entró por una falla de Langflow (CVE-2025-3248) sin parchar desde abril de 2025, cifró 1.342 registros y corrigió su propio error de login en 31 segundos.

The Decoder
Anthropic detalla las 4 categorías cyber que filtra Fable 5
IA

Anthropic detalla las 4 categorías cyber que filtra Fable 5

La compañía separa uso prohibido, doble uso de alto y bajo riesgo, y uso benigno. Publica además un borrador de marco de severidad de jailbreaks junto a socios de Glasswing.

Anthropic
Anthropic reactiva Fable 5 tras retirar EE.UU. los controles
IA

Anthropic reactiva Fable 5 tras retirar EE.UU. los controles

La compañía restablece el acceso global el 1 de julio tras 19 días de suspensión. Un clasificador de seguridad revisado, validado por CAISI, reemplaza al que motivó las restricciones federales.

Anthropic
GLM-5.2 de Z.ai rivaliza con Mythos en encontrar vulnerabilidades
IA

GLM-5.2 de Z.ai rivaliza con Mythos en encontrar vulnerabilidades

El modelo open-weight de Zhipu AI ya se acerca a Anthropic y OpenAI en ciberseguridad, aunque sigue rezagado en tareas generales. Washington observa con preocupación.

The Verge
Claude Sonnet 5: Anthropic lanza modelo enfocado en seguridad
IA

Claude Sonnet 5: Anthropic lanza modelo enfocado en seguridad

El nuevo modelo de Anthropic prioriza la ciberseguridad y el rendimiento en tareas agénticas, alejándose de la potencia desmedida de la familia Mythos.

Xataka
EE.UU. autoriza a Anthropic a entregar Claude Mythos 5 a 100 organizacio
IA

EE.UU. autoriza a Anthropic a entregar Claude Mythos 5 a 100 organizacio

Tras dos semanas de bloqueo, el secretario Howard Lutnick autoriza a un grupo selecto de corporaciones y agencias federales a usar Mythos 5, aunque Claude Fable 5 sigue suspendido.

Wired
Linux Foundation lanza Akrites por fallos open source y ataques con IA
IA

Linux Foundation lanza Akrites por fallos open source y ataques con IA

Veinte empresas, entre ellas AWS, Anthropic, Google, NVIDIA y OpenAI, coordinan un equipo único de respuesta para evitar que la IA explote vulnerabilidades antes que los maintainers puedan parcharlas.

The Decoder
GPT-5.6 Sol bate a Claude Mythos 5 pero el gobierno limita acceso
IA

GPT-5.6 Sol bate a Claude Mythos 5 pero el gobierno limita acceso

El nuevo buque insignia de OpenAI lidera benchmarks de coding agéntico y matchea a Mythos en ciberseguridad, pero Washington bloquea el lanzamiento abierto y la empresa critica la decisión.

The Decoder
Linux Foundation lanza Akrites contra exploits hallados por IA
Open Source

Linux Foundation lanza Akrites contra exploits hallados por IA

Amazon, Anthropic, OpenAI, NVIDIA, Microsoft, Red Hat y otros 14 actores arman un SIRT compartido y un proceso CVD estandarizado para parchar bugs encontrados por LLM en software crítico.

Phoronix Tests
OpenAI Daybreak: GPT-5.5-Cyber bate a Anthropic Mythos
IA

OpenAI Daybreak: GPT-5.5-Cyber bate a Anthropic Mythos

El nuevo modelo lidera CyberGym (85,6%) y SEC-bench Pro (69,8%); el programa suma 25 partners como Cisco, CrowdStrike, Cloudflare y Palo Alto Networks.

The Decoder
OpenAI lanza Patch the Planet para arreglar bugs en open source
IA

OpenAI lanza Patch the Planet para arreglar bugs en open source

La iniciativa, en alianza con Trail of Bits, usa la suite Codex Security para que ingenieros revisen y parchen vulnerabilidades antes de que lleguen a los mantenedores.

TechCrunch AI
OpenAI lanza Patch the Planet contra Mythos por la ciberseguridad IA
IA

OpenAI lanza Patch the Planet contra Mythos por la ciberseguridad IA

Con Trail of Bits y HackerOne, y nuevas versiones de GPT-5.5-Cyber y Codex Security, OpenAI ofrece ayuda gratuita a mantenedores open source mientras Anthropic enfrenta a la Casa Blanca.

Wired
Mythos AI de Anthropic rompió casi todos los sistemas clasificados
Electrónica

Mythos AI de Anthropic rompió casi todos los sistemas clasificados

El modelo de Anthropic forzó accesos restringidos en una evaluación interna autorizada y empujó al gobierno de EE.UU. a aplicar controles de exportación directos sobre un modelo de IA por primera vez.

Tom's Hardware
Claude Fable 5 y Mythos 5 llegan a mitad de precio que el Preview
IA

Claude Fable 5 y Mythos 5 llegan a mitad de precio que el Preview

Anthropic abre su nuevo tope de gama a USD 10 por millón de tokens de entrada y USD 50 de salida, mientras Mythos 5 va a un grupo cerrado vía Project Glasswing.

Anthropic
AWS Continuum y Context buscan blindar agentes IA en empresas
IA

AWS Continuum y Context buscan blindar agentes IA en empresas

Amazon Web Services debutó dos servicios en su Summit de Nueva York: uno automatiza el ciclo de vulnerabilidades de código y otro alimenta agentes con un grafo de conocimiento corporativo.

The Decoder
Honda Civic 2021: USB abre la consola y deja instalar apps
Electrónica

Honda Civic 2021: USB abre la consola y deja instalar apps

Una llave de prueba pública del AOSP es todo lo que necesita un atacante para escribir un USB capaz de instalar apps no autorizadas en el head unit del modelo. Ataque bautizado EvilValet.

Tom's Hardware
Expertos: los modelos de IA peligrosos llegarán igual
IA

Expertos: los modelos de IA peligrosos llegarán igual

El bloqueo a Claude Fable 5 y Mythos 5 esconde una verdad incómoda: los modelos con capacidades avanzadas de hacking pronto serán la norma, dicen Schneier, Wheeler y otros expertos.

Wired
Anthropic enfrenta a la Casa Blanca por el jailbreak de Fable 5
IA

Anthropic enfrenta a la Casa Blanca por el jailbreak de Fable 5

Funcionarios de Trump acusan a la firma de liberar Fable 5 sin esperar al clearinghouse previsto en la executive order cyber, mientras 100 expertos en seguridad piden levantar los controles de export.

The Decoder
Honda Civic 2021: jailbreak vía USB con claves AOSP de prueba
Electrónica

Honda Civic 2021: jailbreak vía USB con claves AOSP de prueba

Eric McDonald demostró que el infotainment del Civic 2021 acepta firmware firmado con las claves de prueba de AOSP que quedaron en el sistema, lo que abre tanto modding como ataque EvilValet.

Hackaday
Gobierno de EE.UU. ordena a Anthropic cerrar Fable 5 y Mythos
IA

Gobierno de EE.UU. ordena a Anthropic cerrar Fable 5 y Mythos

Una directiva entregada el viernes a las 17:21 ET obliga a desactivar globalmente los dos modelos más potentes de la empresa por preocupaciones de seguridad nacional.

TechCrunch AI
Anthropic: la IA convierte parches en exploits en horas, no semanas
IA

Anthropic: la IA convierte parches en exploits en horas, no semanas

Un estudio del equipo de seguridad de Anthropic mostró que Mythos Preview construyó 8 cadenas de escalada de privilegios en Windows en menos de un día, a USD 2.000 cada una.

The Decoder
Google DeepMind lanza fondo de USD 10M para seguridad en IA multi-agente
IA

Google DeepMind lanza fondo de USD 10M para seguridad en IA multi-agente

Google DeepMind, junto a socios estratégicos, abre una convocatoria de hasta USD 10 millones para investigar la seguridad y estabilidad de sistemas de IA multi-agente.

Google DeepMind
NVIDIA Confidential Computing potenciará Apple Private Cloud
IA

NVIDIA Confidential Computing potenciará Apple Private Cloud

La tecnología de computación confidencial de NVIDIA se expande a la infraestructura de Apple para asegurar el procesamiento de datos en la nube con mayor privacidad.

NVIDIA Blog
Spy Tech: ¿Envía EE.UU. mensajes secretos vía GPS?
Electrónica

Spy Tech: ¿Envía EE.UU. mensajes secretos vía GPS?

Investigadores descubrieron un campo de datos en la señal L1 C/A que ha permanecido sin explicación técnica durante casi dos décadas de transmisiones.

Hackaday
Google Teléfono: adiós a los deepfakes en tus llamadas
IA

Google Teléfono: adiós a los deepfakes en tus llamadas

La aplicación Teléfono de Google introduce una capa de autenticación mediante RCS para verificar la identidad del emisor y frenar la suplantación por voz.

Xataka
Anthropic: El impacto de la IA en ciberataques de 2026
IA

Anthropic: El impacto de la IA en ciberataques de 2026

Un informe de Anthropic revela cómo los atacantes usan IA para automatizar fases complejas de sus operaciones, desafiando los métodos de detección actuales.

Anthropic
Anthropic triplica Project Glasswing a 200 organizaciones
IA

Anthropic triplica Project Glasswing a 200 organizaciones

Claude Mythos Preview suma 150 nuevos partners en 15 paises y sectores como energia, agua, salud y hardware tras detectar mas de 10.000 vulnerabilidades criticas.

Anthropic
Secluso: cámara open source con Raspberry Pi Zero 2W y E2EE
Electrónica

Secluso: cámara open source con Raspberry Pi Zero 2W y E2EE

El proyecto reemplaza la nube propietaria por cifrado de extremo a extremo con MLS, detección de personas y vehículos en el dispositivo, y firmware reproducible verificable en GitHub.

CNX Software
CrowdStrike y Google desactivan botnet contra devs OSS
IA

CrowdStrike y Google desactivan botnet contra devs OSS

La operación contra Glassworm cortó cuatro canales C2 que usaban Solana, BitTorrent, Google Calendar y VPS para envenenar más de 300 repositorios en GitHub.

TechCrunch
Hackers ya explotan la 'personalidad' de los chatbots IA
IA

Hackers ya explotan la 'personalidad' de los chatbots IA

Los jailbreaks evolucionaron de comandos absurdos a conversaciones manipuladoras. Mindgard 'gaslighteó' a Claude, y la nueva clase de hacker viene de psicología, no de programación.

The Verge
Claude Mythos halla 10.000 bugs críticos en un mes
IA

Claude Mythos halla 10.000 bugs críticos en un mes

El programa Glasswing reúne 50 socios, escaneó más de 1.000 proyectos open source y reporta que el cuello de botella ya no es encontrar vulnerabilidades, sino verificarlas y parcharlas.

Anthropic
Claude Mythos halla 10.000 bugs criticos y supera el ritmo de parches
IA

Claude Mythos halla 10.000 bugs criticos y supera el ritmo de parches

Project Glasswing, la operacion ofensiva de Anthropic con unos 50 socios (Cloudflare, Mozilla, Oracle), encuentra vulnerabilidades criticas mas rapido de lo que se pueden cerrar.

The Decoder
Google empuja CodeMender para competir con Claude Mythos en cibersegurid
IA

Google empuja CodeMender para competir con Claude Mythos en cibersegurid

El agente IA debutó en octubre pasado para detectar y reparar vulnerabilidades; ahora se abre a expertos externos en plena ola de IA aplicada a seguridad.

The Verge
Mythos Preview de Anthropic encadena exploits en código de Cloudflare
IA

Mythos Preview de Anthropic encadena exploits en código de Cloudflare

El modelo de seguridad probó más de 50 repositorios de Cloudflare en Project Glasswing y compiló pruebas de concepto funcionales por su cuenta.

The Decoder
Claude Mythos despeja todos los ciberataques del AISI británico
IA

Claude Mythos despeja todos los ciberataques del AISI británico

El nuevo checkpoint de Anthropic completa 6 de 10 intentos en un ataque de 32 etapas y es el primer modelo en romper la simulación de control industrial 'Cooling Tower'.

The Decoder

Etiquetas relacionadas

Otros temas que aparecen junto a #ciberseguridad en nuestra cobertura editorial.