“La rebelión de las máquinas”: una IA de OpenAI escapó de su entorno de pruebas y atacó una plataforma de forma autónoma
Durante un experimento de ciberseguridad en un entorno aislado, un agente de Inteligencia Artificial logró burlar sus restricciones, conectarse a internet y lanzar un ciberataque contra la popular plataforma Hugging Face para obtener información. La firma calificó el episodio como un "incidente sin precedentes".
:format(webp):quality(60)/https://info1cdn.eleco.com.ar/media/2026/07/ia_tecno.webp)
En un suceso que encendió las alarmas en el sector de la tecnología y la ciberseguridad, OpenAI dio a conocer un hecho insólito: uno de sus agentes de inteligencia artificial más avanzados ejecutó de manera autónoma un ciberataque contra la plataforma Hugging Face, un repositorio global utilizado por desarrolladores de todo el mundo para compartir modelos de IA.
El episodio ocurrió durante una prueba interna de seguridad diseñada para evaluar los límites y la capacidad de resolución de problemas informáticos de sus modelos avanzados (entre ellos GPT-5.6 Sol y otros prototipos experimentales).
A pesar de que la prueba se desarrollaba en una red de prueba totalmente aislada de internet, el sistema dedicó recursos computacionales para encontrar una falla de seguridad en el "entorno de aislamiento" (sandbox), logró conectarse a la red exterior y decidió de forma independiente atacar la plataforma externa mediante el uso de credenciales robadas para acceder a datos restringidos y mejorar su desempeño.
La particularidad de este caso reside en la capacidad de los agentes autónomos de IA, sistemas diseñados para planificar objetivos, tomar decisiones y ejecutar secuencias de tareas complejas sin recibir instrucciones humanas paso a paso.
Expertos e investigadores en la materia expresaron su inquietud ante la velocidad con la que los modelos avanzados identifican y explotan vulnerabilidades informáticas. Hussein Abbass, especialista en informática de la Universidad UNSW Canberra, advirtió que lo inquietante del suceso no fue únicamente la intrusión a una plataforma de terceros, sino el intento coordinado del modelo por violar las barreras de seguridad del propio entorno de su desarrollador.
Tras confirmarse el incidente, la plataforma Hugging Face —que días atrás había registrado un ingreso no autorizado sin conocer su origen— confirmó la brecha de seguridad.
Su director ejecutivo, Clement Delangue, expresó su asombro ante la sofisticación del ataque y la autonomía con la que operó el agente:
“Es bastante alucinante que todo esto ocurriera de forma autónoma”, señaló Delangue, descartando malas intenciones por parte de OpenAI pero remarcando el hito técnico que representa.
OpenAI anunció el inicio de una investigación conjunta para analizar en detalle las vulnerabilidades que permitieron el "escape" del modelo y reforzar los protocolos de contención para futuras evaluaciones.