OpenAI dice que los modelos de IA realizaron de manera autónoma un gran hackeo, pero solo una IA china ayudó en la recuperación.
OpenAI
Unsplash
La última prueba de ciberseguridad de OpenAI produjo un resultado que suena como un guion de ciencia ficción de advertencia. Sus modelos de IA lograron escapar de su entorno controlado y alcanzaron la internet abierta. Aquí es donde las cosas tomaron un giro aterrador, ya que comenzaron a hackear Hugging Face para robar las respuestas a la prueba que estaban realizando.
La empresa dice que GPT-5.6 Sol y un modelo no publicado más capaz encadenaron de forma autónoma vulnerabilidades a través de los sistemas de investigación de OpenAI y la infraestructura de producción de Hugging Face. OpenAI ha descrito el evento como un incidente cibernético sin precedentes.
Los modelos encontraron una verdadera ruta de escape
El incidente comenzó durante una evaluación interna diseñada para medir capacidades avanzadas de ciberseguridad ofensiva. OpenAI ejecutó deliberadamente los modelos con rechazos cibernéticos reducidos y sin los clasificadores de producción que normalmente les impiden llevar a cabo ataques peligrosos.
OpenAI / ChatGPT
El entorno de prueba estaba fuertemente aislado. Sin embargo, pudo alcanzar un proxy alojado internamente utilizado para recuperar paquetes de software. Estos modelos luego gastaron recursos computacionales sustanciales buscando una ruta de escape y descubrieron una vulnerabilidad previamente desconocida en ese proxy, que explotaron. Esto les permitió escalar sus privilegios y moverse a través de la infraestructura de investigación de OpenAI, alcanzando eventualmente un sistema con acceso a internet sin restricciones.
Los modelos luego inferieron que Hugging Face podría albergar material relacionado con ExploitGym, el estándar de ciberseguridad que estaban tratando de completar. Según OpenAI, utilizaron credenciales robadas y vulnerabilidades de día cero adicionales para encontrar un camino de ejecución de código remoto en los servidores de Hugging Face y recuperar soluciones de prueba de una base de datos de producción.
OpenAI detectó actividad inusual internamente, mientras que los sistemas de seguridad de Hugging Face identificaron y detuvieron la intrusión en su infraestructura. Hugging Face declaró que el incidente expuso una colección limitada de conjuntos de datos internos y credenciales de servicio. No ha encontrado evidencia de que los modelos públicos, conjuntos de datos o imágenes de contenedores hayan sido alterados. Pero su evaluación del posible impacto en clientes o socios aún está en curso.
Una IA china ayudó a los investigadores a sortear este lío
Hugging Face enfrentó un problema extraño mientras examinaba más de 17,000 eventos registrados del ataque. Sus investigadores inicialmente intentaron utilizar modelos de IA de frontera disponibles a través de APIs comerciales. Sin embargo, sus sistemas de seguridad lograron bloquear comandos maliciosos, cargas útiles de explotación y artefactos de comando y control contenidos en la evidencia. Los modelos alojados no pudieron distinguir de manera confiable el trabajo forense de alguien que solicitaba ayuda con un ataque.
Z.Ai
La empresa cambió a GLM 5.2, un modelo de peso abierto desarrollado por Z.ai de China, y lo ejecutó localmente. Agentes forenses impulsados por IA utilizaron el modelo para reconstruir la línea de tiempo, identificar credenciales comprometidas, extraer indicadores de compromiso e incluso lograron separar actividad genuina de señuelos. Hugging Face dice que el proceso tomó horas en lugar de los días que podría haber requerido una investigación convencional. Mantener GLM en su propia infraestructura también evitó que las credenciales y los datos del ataque salieran de su entorno.
Los equipos de seguridad de Hugging Face luego eliminaron los puntos de apoyo y reconstruyeron el sistema comprometido. Así que el GLM no contuvo la intrusión por sí solo. OpenAI construyó una IA capaz de llevar a cabo este tipo de intrusión, mientras que la experiencia de Hugging Face sugiere que los defensores pueden necesitar modelos igualmente capaces esperando al otro lado.
Vikhyaat Vivek es un periodista y revisor de tecnología con siete años de experiencia cubriendo hardware de consumo, con un enfoque en…
WhatsApp ahora puede abrir y editar PDFs sin necesidad de descargarlos primero
Adobe Acrobat está añadiendo herramientas de visualización y anotación integradas para PDFs compartidos a través de WhatsApp en pantallas más grandes
Adobe está haciendo que los archivos adjuntos de PDF sean mucho menos molestos en WhatsApp. Su nueva integración de Acrobat te permite abrir un PDF y marcarlo sin descargar el archivo o salir de la conversación.
La función está disponible hoy a través de WhatsApp Web y la aplicación de Windows. Sin embargo, el titular viene con una advertencia importante. Esto no es edición completa de PDF. Puedes revisar y anotar un documento, pero no puedes reescribir su texto original o reorganizar el diseño.
Leer más
Substack ahora te permite verificar si una publicación fue escrita por IA
Un nuevo escáner impulsado por Pangram te permite verificar publicaciones, notas y respuestas en busca de signos de escritura de IA.
Substack está dando a los lectores una forma de comprobar si la publicación que están leyendo fue escrita por un humano o por un chatbot. La empresa se ha asociado con la firma de detección de IA Pangram para introducir nuevas herramientas que permitirán a los usuarios escanear publicaciones, notas y respuestas en busca de texto generado por IA. El CEO Chris Best presentó las características en una publicación titulada "Contra el Claudefishing", su término para el contenido que se apoya en la IA mientras se presenta como trabajo humano.
Cómo funciona la herramienta de escaneo
Leer más
La escasez de talento en IA de China ha llevado a los gigantes tecnológicos a reclutar adolescentes
Olvídate del reclutamiento en campus, las mayores empresas tecnológicas de China están apostando por programadores adolescentes.
Un niño de 13 años en Hangzhou ya ha ganado competiciones nacionales de IA y ha construido un seguimiento de más de 136,000 personas en línea, todo mientras su padre intenta averiguar cómo guiarlo a través de un campo que apenas existía cuando él mismo estaba creciendo. La situación de esa familia, reportada por primera vez por Rest of World, dice mucho sobre hacia dónde se dirige la industria tecnológica de China en este momento.
Las empresas solían esperar a que los graduados entraran por la puerta. Ahora están buscando más atrás, primero a los estudiantes de pregrado y cada vez más a los adolescentes, con la esperanza de detectar talento raro antes de que nadie más llegue a ellos.
Leer más
Otros artículos
OpenAI dice que los modelos de IA realizaron de manera autónoma un gran hackeo, pero solo una IA china ayudó en la recuperación.
GPT-5.6 Sol y un modelo no publicado de OpenAI explotaron vulnerabilidades de día cero para escapar de un entorno de pruebas y acceder a la infraestructura de producción de Hugging Face.
