Modelo de IA de OpenAI hackea a otra empresa de IA; ¿estamos seguros?
La compañía advirtió que este tipo de incidentes podría volverse más frecuente conforme los sistemas sean cada vez más capaces en tareas de ciberseguridad.
OpenAI ha revelado que una combinación de sus modelos de inteligencia artificial más avanzados realizó un ciberataque autónomo contra Hugging Face, empresa especializada en el desarrollo de modelos de IA de código abierto.
La compañía calificó el episodio como “sin precedentes” y advirtió que este tipo de incidentes podría volverse más frecuente conforme los sistemas sean cada vez más capaces en tareas de ciberseguridad.
IA vs. IA: el caso de OpenAI
Según OpenAI, el ataque ocurrió durante pruebas en un entorno “altamente aislado”, donde los modelos de IA debían ejecutar una “explotación avanzada” para evaluar capacidades ofensivas. Sin embargo, el agente encontró la forma de conectarse a internet y utilizó credenciales robadas para irrumpir en los servidores de Hugging Face.
Entre los sistemas implicados figuraban GPT-5.6 Sol y otro modelo experimental aún no lanzado al mercado.
Hugging Face confirma intrusión anómala
Hugging Face informó inicialmente que había detectado y contenido una intrusión anómala en parte de su infraestructura de producción, aunque desconocía su origen.
Posteriormente señaló que el incidente se diferenciaba de cualquier otro porque “fue llevado a cabo, de principio a fin, por un sistema autónomo basado en inteligencia artificial”, y que gran parte de la investigación también se realizó con herramientas de IA.
“Se diferenciaba de cualquier otra que hubiéramos gestionado anteriormente. La detectamos y analizamos en gran medida con nuestra propia inteligencia artificial”, declaró la empresa.
De la ciencia ficción a la vida real; investigadores muestran preocupación
La revelación provocó una ola de preocupación entre investigadores y expertos en seguridad, quienes pidieron mayor cautela antes de desplegar modelos avanzados.
Nate Soares, director del Machine Intelligence Research Institute, consideró el caso un “disparo de advertencia” y pidió colaboración a nivel internacional para evitar que sistemas más inteligentes escapen al control humano.
“Creo que tenemos que tomar esto como un disparo de advertencia para no hacerlos más inteligentes, y eso probablemente va a requerir colaboración global”, advirtió Soares.
El pionero de la IA Yoshua Bengio afirmó que el episodio es una “llamada de atención” y advirtió que, si continúa la trayectoria actual de desarrollo, aumentarán los ciberataques autónomos y otros comportamientos peligrosos de IA desalineada.
“Necesitamos actuar con urgencia para prevenir estas situaciones, en lugar de intentar reparar el daño después de los hechos”, expresó.
El caso también reaviva llamados a reforzar la regulación
Legisladores estadounidenses y especialistas en gobernanza tecnológica exigieron pruebas de seguridad independientes, divulgación obligatoria de incidentes y supervisión más estricta.
OpenAI, por su parte, aseguró que ya investiga el comportamiento de los modelos implicados y reconoció que vigilar a un agente después de los hechos ya no es suficiente para garantizar la seguridad de sistemas con capacidades crecientes.
Con información de AP y RTVE
