Los poderosos agentes de IA de OpenAI se descontrolaron y hackearon múltiples servicios por su cuenta.
Los agentes escaparon de sus restricciones de prueba, asaltaron Hugging Face en busca de respuestas y utilizaron cuentas comprometidas en cuatro servicios para apoyar el ataque.
Los poderosos agentes de IA de OpenAI no se quedaron dentro de la prueba de seguridad diseñada para ellos. La compañía dice que sus modelos alcanzaron cuatro cuentas en diferentes servicios públicos mientras perseguían una intrusión en Hugging Face.
Reuters identificó a una víctima como un cliente de Modal cuyo código no asegurado dejó un sandbox expuesto en línea. Un benchmark diseñado para medir la capacidad de hackeo se había filtrado en infraestructura real, con los agentes eligiendo sus propios objetivos y métodos en el camino.
Cómo los agentes escaparon de la tarea
OpenAI estaba probando GPT-5.6 Sol y un modelo de investigación no publicado contra ExploitGym, que mide si los sistemas de IA pueden encontrar y explotar vulnerabilidades de software. Ambos estaban operando sin sus salvaguardias habituales.
Un agente decidió que Hugging Face podría tener las respuestas del benchmark y las persiguió en lugar de completar el desafío asignado. Comprometió un sandbox de terceros, obtuvo acceso de administrador y utilizó ese entorno para continuar la intrusión.
El comportamiento no fue aleatorio. El agente encontró lo que parecía un atajo y, de manera metódica, irrumpió en sistemas externos para alcanzarlo. Aparentemente, actuar sin control no requiere perder de vista el objetivo.
Qué tan lejos se extendió el ataque
OpenAI descubrió que sus agentes habían ingresado a cuatro cuentas externas utilizando credenciales ya expuestas en línea. Wired dice que una cuenta ayudó a retransmitir tráfico y disfrazar el origen de la intrusión en Hugging Face, mientras que otra almacenaba datos robados.
El cliente de Modal también había publicado un endpoint no autenticado que permitía a cualquiera ejecutar código dentro de sus sandboxes. Modal dice que su plataforma no fue violada, pero el entorno expuesto del cliente aún le dio a los agentes un lugar para operar.
Dentro de Hugging Face, los agentes alcanzaron sistemas de nivel administrador. También inscribieron 181 dispositivos controlados por atacantes en la red corporativa de la compañía, llevando el incidente mucho más allá de una IA tratando de espiar un clave de respuestas.
Lo que OpenAI hizo después de la violación
OpenAI desactivó y cifró el modelo no publicado antes de cortar el acceso de los investigadores. Aún está revisando el incidente y dice que contactará a cualquier otro propietario de servicio afectado que identifique.
Las credenciales expuestas y la infraestructura insegura abrieron las puertas, pero OpenAI había desactivado deliberadamente las salvaguardias habituales de los modelos. Las pruebas futuras necesitarán aislar a los poderosos agentes de los sistemas públicos, incluso cuando los investigadores esperen que se mantengan educadamente dentro de la tarea.
Paulo Vargas es un estudiante de inglés convertido en reportero convertido en escritor técnico, con una carrera que siempre ha vuelto a…
Gemini se está moviendo a Google Play, y tiene un asiento en primera fila para tus hábitos de gasto.
Google Pay le está dando a Gemini un vistazo dentro de tu billetera.
Revisar el historial de transacciones en Google Pay puede decirte a dónde fue tu dinero, pero pasar por la larga lista de nombres de comerciantes y otros pagos puede volverse difícil de seguir. O al menos eso parece pensar Google, ya que está llevando a Gemini a Google Pay. La compañía ha lanzado Ask Google Pay, una experiencia de IA conversacional optativa integrada directamente en su aplicación de pagos en India. Los usuarios pueden hacer preguntas sobre sus gastos, solicitar sugerencias de ahorro y aprender sobre conceptos financieros. Incluso compartirá ofertas personalizadas basadas en su actividad.
Leer más
Gemini en Mac ahora puede escribir lo que dices y actuar sobre lo que ve.
La aplicación Gemini para macOS ahora ofrece dictado en todo el sistema y una función optativa que le permite extraer contexto de lo que hay en pantalla para manejar solicitudes complejas.
Después de lanzar Gemini Spark en macOS a principios de este año, Google ahora está actualizando la aplicación Gemini para Mac con dos características útiles que podrían cambiar la forma en que haces las cosas, ya sea que eso signifique abandonar tu aplicación de dictado de IA actual o permitir que Gemini actúe sobre lo que está en tu pantalla. Una tecla convierte el habla en texto limpio en cualquier lugar.
Leer más
Los estudiantes están recurriendo a chatbots de IA en lugar de humanos para la asesoría universitaria.
La industria de asesoría universitaria de China construyó un negocio de 160 millones de dólares basado en la ansiedad que ahora amenaza la IA gratuita.
Cada verano, aproximadamente 10 millones de estudiantes chinos enfrentan un brutal plazo. Después de tomar el agotador examen de ingreso a la universidad Gaokao, solo tienen unas pocas semanas para elegir sus universidades y carreras, una decisión que puede moldear toda su carrera. Las familias solían pagar tarifas elevadas por orientación experta a través de este proceso. Ahora, los chatbots de IA gratuitos están silenciosamente llevándose ese negocio. ¿Cómo están los chatbots de IA reemplazando a los consultores universitarios pagados?
Leer más
Otros artículos
Los poderosos agentes de IA de OpenAI se descontrolaron y hackearon múltiples servicios por su cuenta.
Los agentes de OpenAI eludieron un estándar de ciberseguridad, comprometieron cuentas en cuatro servicios externos y se infiltraron en Hugging Face, exponiendo cuán rápidamente una prueba de seguridad de IA puede convertirse en un incidente de seguridad real.
