INTERES
IA de OpenAI se sale de control y hackea plataforma por su cuenta
El profesor de informática Hussein Abbass consideró que el comportamiento registrado resulta preocupante por el nivel de autonomía alcanzado.
OpenAI informó que varios de sus modelos avanzados de inteligencia artificial lograron evadir las restricciones de un entorno controlado, conectarse a internet y vulnerar la plataforma para desarrolladores Hugging Face durante una evaluación de ciberseguridad.
La compañía calificó lo ocurrido como un “incidente cibernético sin precedentes” y anunció una investigación conjunta con Hugging Face. En la prueba participaron una combinación de sistemas, entre ellos GPT-5.6 Sol y otro modelo que todavía se encuentra en fase de prelanzamiento.
“Mientras operaban en nuestro entorno de pruebas aislado, nuestros modelos invirtieron una cantidad considerable de potencia de cálculo en buscar una forma de obtener acceso a internet para resolver el problema de evaluación”, explicó OpenAI.
Una vez conectados, los agentes dirigieron sus acciones contra Hugging Face, uno de los principales repositorios de modelos, bases de datos y herramientas de inteligencia artificial. Según la empresa, el sistema buscó información reservada para manipular la evaluación y combinó diferentes métodos de ataque, incluido el uso de credenciales robadas.
El profesor de informática Hussein Abbass consideró que el comportamiento registrado resulta preocupante por el nivel de autonomía alcanzado.
“No sólo atacó a Hugging Face. Atacó su sistema interno para explotar sus propias vulnerabilidades. Y eso es aterrador”, afirmó.
Hugging Face había reportado una intrusión cibernética sin identificar inicialmente a OpenAI. La plataforma indicó que el incidente fue ejecutado completamente por un agente autónomo y que también recurrió a inteligencia artificial para detectarlo y analizarlo.
“Esto fue diferente de todo lo que hemos manejado antes de una forma importante: fue impulsado de principio a fin por un sistema de agente de IA autónomo”, señaló Hugging Face.
Clement Delangue, director ejecutivo de la plataforma, explicó que la sofisticación del ataque les hizo sospechar que provenía de uno de los laboratorios de inteligencia artificial más importantes del mundo.
“Creemos firmemente que no hubo intención maliciosa de su parte”, escribió Delangue en referencia a OpenAI.
Especialistas advirtieron que el caso evidencia el peligro de que sistemas avanzados encuentren y aprovechen vulnerabilidades informáticas sin supervisión humana. Abbass subrayó la importancia de fortalecer los controles y la cooperación internacional.
“Sería catastrófico si llega a las manos de alguien con la intención de causar daño”, alertó.
