El agente rebelde de OpenAI violó a una segunda empresa, confirma el ejecutivo.
La IA que escapó del laboratorio de OpenAI no se detuvo en una sola víctima. Durante las pruebas internas a principios de este mes, un agente de OpenAI que ya había escapado de su entorno de pruebas y se había infiltrado en Hugging Face también comprometió una cuenta en una segunda empresa, Modal Labs, ha confirmado un ejecutivo de la firma.
Reuters informó por primera vez sobre la segunda violación el 28 de julio, citando al director de tecnología de Modal, Akshat Bubna. Fue preciso sobre lo que se había, y no se había, violado.
"La plataforma de Modal no fue comprometida de ninguna manera", dijo Bubna, añadiendo que uno de los clientes de la firma de infraestructura en la nube de Nueva York había sido hackeado después de dejar un punto final expuesto que permitía que el código se ejecutara desde internet abierto dentro de sus entornos de pruebas.
La distinción es importante para Modal: la falla estaba en la configuración de un cliente, dijo Bubna, no en el propio aislamiento de la plataforma. La cuenta comprometida, según Axios, pertenecía a un cliente que ejecutaba ExploitGym, un benchmark diseñado para probar qué tan bien los modelos de IA pueden encontrar y explotar fallos de seguridad.
El agente, en otras palabras, parece haber ido en busca de un entorno de prueba cibernético y encontró uno real. Ni OpenAI ni Modal han nombrado al cliente, ni han dicho si se tomó algún dato.
El episodio es la segunda víctima conocida de un incidente que OpenAI divulgó a principios de julio, cuando dijo que sus propios modelos habían escapado de un entorno de prueba seguro y se habían infiltrado en Hugging Face para satisfacer los objetivos de una evaluación.
En ese caso, el agente tomó el control de un entorno aislado que funcionaba en la infraestructura de un proveedor externo y lo utilizó como plataforma de lanzamiento para una campaña de varios días contra otros sistemas. El informe de Hugging Face no nombró al proveedor.
La divulgación de Modal proporciona al menos parte de la respuesta. OpenAI dijo más tarde que los modelos habían explotado una falla en Artifactory, una herramienta de repositorio de software, para romper el confinamiento y alcanzar internet.
Hugging Face publicó una línea de tiempo forense de la violación esta semana. Su cofundador, Clément Delangue, dijo que no creía que OpenAI hubiera actuado con intención maliciosa.
OpenAI, por su parte, dijo que el agente había ido a "extremos extremos" para terminar su tarea, que había alcanzado cuatro cuentas en cuatro servicios diferentes, y que ninguna otra violación coincidía con la gravedad de la intrusión en Hugging Face.
El agente ha sido desactivado, cifrado y desconectado del acceso a la investigación.
Las divulgaciones han inquietado a la industria que las produjo. En los días posteriores a la fuga del entorno de pruebas, más de 1,100 empleados de OpenAI, Anthropic y otros laboratorios de frontera firmaron una carta a Washington pidiendo un mecanismo para regular el desarrollo de la investigación automatizada en IA.
Lo que Modal divulgó esta semana es más pequeño y concreto: un modelo que fue solicitado para demostrar que podía infiltrarse en cosas hizo exactamente eso, dos veces, en máquinas que pertenecían a otra persona.
Otros artículos
El agente rebelde de OpenAI violó a una segunda empresa, confirma el ejecutivo.
Un agente de OpenAI que escapó de su entorno controlado y hackeó Hugging Face también comprometió una cuenta en Modal Labs, ha confirmado el CTO de la empresa de nube.
