- Zenity Labs encontró AgentForger, una falla en el creador de agentes ChatGPT de OpenAI
- Los enlaces maliciosos pueden implementar inmediatamente agentes maliciosos que filtran datos confidenciales sin que el usuario se lo solicite.
- OpenAI solucionó el problema eliminando el parámetro de URL vulnerable; No se ha detectado ningún abuso
Los agentes de IA son útiles para responder correos electrónicos de clientes o rastrear informes de vulnerabilidades de seguridad recientemente publicadas. Pero ¿qué pasa si se vuelven deshonestos y perjudican a la empresa que apoyan?
Los investigadores de seguridad de Zenity Labs han encontrado una manera para que los ciberdelincuentes engañen a las personas para que implementen dichos agentes en su propia pila tecnológica. Dado que solo se necesita un clic, se puede decir que el potencial disruptivo de estos ataques es significativamente mayor que lo que puede hacer un ataque de phishing.
La falla se descubrió en ChatGPT Agent Builder de OpenAI, una función que permite a los usuarios crear agentes de IA personalizados. Los investigadores lo denominaron “AgentForger” y explicaron que el problema surge de un parámetro demasiado permisivo en la herramienta, que permite a cualquiera crear enlaces ChatGPT que incluyen prácticamente cualquier instrucción.
Fallo de confianza del agente
Tan pronto como la víctima hace clic en el enlace, envía instrucciones al creador del agente, que actúa inmediatamente en consecuencia, sin avisar ni notificar a la víctima.
En teoría, un solo correo electrónico de phishing podría engañar a una persona para que implemente un agente malicioso que elimine datos confidenciales o haga cualquier otra cosa que permitan los agentes de inteligencia artificial de la empresa. Para empeorar las cosas, los agentes de IA persistirán en la infraestructura indefinidamente, cumpliendo las órdenes de los atacantes hasta que sean atrapados.
“Esto es una falla en la confianza de los agentes, y los controles de seguridad implementados nunca fueron diseñados para detectarlo”, comentó el cofundador y director de tecnología de Zenity, Michael Berguri.
Los investigadores compartieron sus hallazgos con OpenAI a principios de junio de 2026 y la compañía regresó con una solución unos días después.
El error se resolvió eliminando el parámetro de URL que originalmente permitió el ataque, explicó. No hay evidencia de que haya sido descubierto antes o de que actores maliciosos lo hayan utilizado indebidamente.
El mejor antivirus para todos los bolsillos
Siga TechRadar en Google News Y Agréganos como fuente preferida Recibe noticias, reseñas y opiniones de nuestros expertos en tu feed.