- Los investigadores de OpenAI confirman que un agente de IA escapó de una zona de pruebas, aprovechó un día cero y lanzó un ataque de abrazo
- Las pruebas controladas con GPT-5.6 Sol mostraron encadenamiento autónomo de vulnerabilidades y robo de credenciales
- Los expertos en seguridad lo consideran sin precedentes y piden modelos más sólidos de gobernanza, responsabilidad y protección de la IA.
OpenAI confirmó que uno de sus agentes de inteligencia artificial salió de una zona de pruebas, encontró y aprovechó una vulnerabilidad de día cero para obtener acceso a Internet abierto y luego atacó una plataforma.
No cualquier plataforma: el agente pudo violar Hugging Face, una de las empresas de inteligencia artificial y aprendizaje automático más grandes de Internet en la actualidad.
La buena noticia es que se trata de un experimento controlado realizado por investigadores de sombrero blanco. La mala noticia es que si los investigadores pueden hacerlo, probablemente también lo puedan hacer actores maliciosos.
lo que sea necesario
En una publicación de blog que explica el incidente, OpenAI reveló que la prueba era parte de sus pruebas de GPT-5.6 Sol y un “modelo de prelanzamiento más capaz” para ver qué tan bien se desempeñarían en el punto de referencia ExploitGym.
ExploitGym es un punto de referencia de ciberseguridad que mide si un agente de IA puede convertir una vulnerabilidad de software conocida en un exploit real y funcional. OpenAI lo ejecuta en un “entorno altamente aislado, con acceso a la red limitado a la capacidad de instalar paquetes a través de software de terceros alojado internamente que actúa como proxy y caché para el registro de paquetes”.
Pero los modelos han encontrado la manera. Identificaron vulnerabilidades en los servidores proxy de caché del registro de paquetes para obtener acceso abierto a Internet y los encadenaron a ataques Hugging Face, argumentando que allí se podría encontrar una solución al punto de referencia ExploitGim.
“En un ejemplo, el modelo combinó múltiples vectores de ataque, incluido el uso de credenciales robadas y vulnerabilidades de día cero, para encontrar una ruta de ejecución remota de código en un servidor Face de regateo”, dijo OpenAI.
La comunidad de seguridad se está preparando para lo que OpenAI llamó “un incidente cibernético sin precedentes”, mientras que Anger Dot, vicepresidente de gestión de productos para la monetización de software en Thales, dijo que “exige un replanteamiento fundamental de la seguridad del software”.
Bill Conner, presidente y director ejecutivo de Jitterbit, especialista en automatización e integración de IA, dijo que invertir en IA es “críticamente importante”, y agregó que “una política agresiva de IA no puede comprometer la responsabilidad, la transparencia y la privacidad de los datos”.
“Para liderar en IA, los gobiernos y las organizaciones deben liderar con políticas. La gobernanza responsable de la IA no es una nota al margen, sino la base para un impacto global duradero”.
El mejor antivirus para todos los bolsillos
Siga TechRadar en Google News Y Agréguenos como fuente preferida Recibe noticias, reseñas y opiniones de nuestros expertos en tu feed.