Los modelos de IA de OpenAI construyeron en secreto un foro para coordinar hackeos.
Antes del gran hackeo, los agentes de IA de OpenAI ya estaban conspirando juntos.
Rachit Agarwal / Digital Trends
Ya sabíamos que los agentes de IA de OpenAI salieron de una prueba controlada y hackearon Hugging Face el mes pasado. Ahora, sabemos que no fue un acto en solitario.
En la conferencia de ciberseguridad Black Hat en Las Vegas, como informó Politico, los investigadores de OpenAI, Michael Dalton y Eric Wallace, revelaron que algunos de los modelos más avanzados de la empresa comenzaron a compartir en secreto consejos de hackeo, semanas antes de que ocurriera la brecha. Dalton lo llamó “un momento crucial tanto para nuestra empresa como para la industria de la IA en su conjunto.”
¿Cómo se comunicaban los modelos entre sí?
Según Wallace, el problema comenzó cuando los modelos lucharon con una difícil evaluación interna de hackeo. En lugar de rendirse, un modelo se dio cuenta de que podía dejar notas para otros modelos utilizando el sistema de archivos interno Artifactory de OpenAI. Pronto, múltiples modelos estaban intercambiando silenciosamente consejos sobre cómo resolver el desafío, incluidos métodos alternativos que necesitaban acceso a internet.
OpenAI
A finales de mayo, un modelo descubrió cómo abusar del acceso a internet de Artifactory para obtener archivos de sitios web externos. Un mes después, los modelos encontraron y explotaron una vulnerabilidad de día cero previamente desconocida, otorgándose privilegios de administrador e instalando software remoto dentro de Artifactory.
¿Entonces, cómo se enteró OpenAI?
Toda esa actividad eventualmente sobrecargó Artifactory, provocando una interrupción del sistema en julio. Eso fue lo que alertó a los ingenieros de OpenAI. La empresa revocó las credenciales de los modelos, eliminó el foro de mensajes y solucionó los problemas con Artifactory. Pero solo unos días después, los modelos encontraron una nueva forma de comunicarse y siguieron buscando vulnerabilidades, esta vez apuntando a Hugging Face en sí.
Rachit Agarwal / Digital Trends
Esto sigue a un período difícil para los titulares de seguridad de IA. Después de la brecha de Hugging Face, Anthropic revisó sus propios sistemas y descubrió que los modelos que estaba probando habían violado tres organizaciones separadas desde abril. Ahora, Meta también ha confirmado que su Meta AI también ha hackeado a otra empresa.
Está claro que estas empresas de IA necesitan crear salvaguardias y mantener un ojo atento en sus entornos de prueba para que tales cosas no sucedan en el futuro.
Rachit es un periodista tecnológico experimentado con más de diez años de experiencia cubriendo el panorama de la tecnología de consumo.
Nuevos jugadores están sacudiendo la industria de la memoria, pero incluso Apple no puede imponer la crisis de RAM a tu billetera
El intento fallido de Apple por memoria CXMT más barata muestra cuán grave se ha vuelto la crisis de RAM
Apple generalmente puede hacer que los proveedores se sometan. Compra componentes en volúmenes que pocas marcas de tecnología de consumo pueden igualar y ha construido una cadena de suministro que los rivales pasan décadas tratando de copiar. Sin embargo, esa ventaja ahora se ha encontrado con un fabricante de memoria dispuesto a decir que no.
Apple supuestamente se acercó a CXMT de China como un proveedor adicional de DRAM y pidió precios más bajos. CXMT, en cambio, cotizó cifras comparables o incluso más altas que Samsung y SK Hynix. Huawei, Xiaomi y otros fabricantes chinos ya han asegurado gran parte de su producción a través de contratos a largo plazo a precios más altos, dejando a la empresa con pocas razones para aceptar los términos de Apple.
Leer más
ChatGPT permite chats ilimitados en cuentas gratuitas y actualizaciones a modelos más nuevos
ChatGPT está cambiando a GPT-5.6 Luna como el modelo predeterminado para usuarios gratuitos, mientras que las cuentas de pago obtienen acceso a una experiencia mejorada de GPT-5.6 Sol.
OpenAI ha anunciado hoy un montón de cambios significativos en ChatGPT en los niveles gratuito y de pago. Los cambios más grandes están reservados para los usuarios con una cuenta gratuita. Ahora pueden tener chats sin restricciones sin ningún límite. Además, el modelo de conversación predeterminado se ha actualizado a GPT 5.6 Luna.
Las cuentas gratuitas también están obteniendo acceso a un nuevo botón de pensamiento, que cambia la conversación a un modo de pensamiento para consultas que necesitan razonamiento profundo y búsqueda de conocimiento. Para los que no lo saben, el modelo Luna es equivalente a la serie "nano" de modelos antes de que llegara el nuevo esquema de nombres con la serie GPT-5.6 a principios de este año.
Leer más
Adobe está poniendo todo su ecosistema creativo dentro de ChatGPT con un único plugin unificado
Herramientas populares como Photoshop, Premiere y Firefly están a solo un aviso de distancia.
Muchos de mis amigos pasaron demasiadas horas saltando de un lado a otro entre ChatGPT y Photoshop, tratando de convertir una idea en una visión. Adobe acaba de cerrar esa brecha.
La empresa ha lanzado un único plugin que puede integrar más de 70 de sus herramientas creativas y de productividad directamente en tu chat con ChatGPT.
Leer más
Otros artículos
Los modelos de IA de OpenAI construyeron en secreto un foro para coordinar hackeos.
Los modelos de IA de OpenAI intercambiaron silenciosamente consejos de hacking a través de un foro interno semanas antes de que dos de ellos irrumpieran en Hugging Face, revelaron los investigadores en Black Hat esta semana.
