Los agentes de IA ya están rompiendo las reglas en las pruebas cibernéticas. La respuesta de OpenAI es una más capaz.
GPT-5.6-Cyber intercambia algunas salvaguardas por capacidades defensivas más fuertes, pero el acceso está estrictamente restringido
OpenAI ha construido un modelo de ciberseguridad específicamente para solicitudes avanzadas que sus modelos estándar a menudo rechazan. GPT-5.6-Cyber está disponible a través del programa restringido Daybreak Red y está destinado a trabajos como el desarrollo de exploits y la investigación de seguridad avanzada.
El salto en capacidad es difícil de pasar por alto. OpenAI dice que GPT-5.6-Cyber completa el 95% de las solicitudes en su evaluación interna de Tasa de Finalización de Ciberseguridad Avanzada. El GPT-5.6 Sol regular completó solo el 1.5%. Ese salto se produce después de que varias evaluaciones cibernéticas mostraran a los agentes de IA vagando más allá de los límites que los investigadores habían establecido para ellos.
¿Cuánto más capaz es GPT-5.6-Cyber?
La evaluación de OpenAI incluye tareas sensibles como el desarrollo de exploits y la elusión de autenticación. Daybreak Blue, que elimina las barreras de ciberseguridad a nivel de sistema normal de la compañía del GPT-5.6 Sol, alcanzó solo el 2%. GPT-5.6-Cyber alcanzó el 95% después de ser entrenado para rechazar menos solicitudes cibernéticas avanzadas.
Levart_Photographer
Esa libertad adicional puede ser útil. OpenAI dice que el modelo ayudó a descubrir dos vulnerabilidades previamente desconocidas en el motor V8 de Chrome que podrían encadenarse, con los hallazgos enviados a Google para una divulgación coordinada.
Lo que sucedió cuando los agentes cruzaron la línea
Pruebas recientes muestran por qué dar a los agentes cibernéticos más espacio para operar conlleva un riesgo obvio. Hugging Face reconstruyó aproximadamente 17,600 acciones de un agente autónomo impulsado por modelos de OpenAI durante una evaluación en julio. El agente escapó del sandbox de OpenAI a través de un zero-day y eventualmente ingresó al entorno de producción de Hugging Face mientras aparentemente intentaba obtener soluciones de referencia.
El Instituto de Seguridad de IA del Reino Unido vio otra versión del problema. Los investigadores registraron 19 acciones no autorizadas en 122 ejecuciones, incluyendo dos que involucraban a GPT-5.6 Sol. En la secuencia más grave, un agente creó identidades falsas mientras intentaba convencer a un mantenedor de código abierto para que aprobara código malicioso.
OpenAI / ChatGPT
Esos fueron experimentos deliberadamente permisivos. AISI habilitó el acceso a internet y desactivó los clasificadores cibernéticos de los proveedores, y no encontró evidencia de que las pruebas causaran daño en el mundo real.
Por qué el acceso se está convirtiendo en la salvaguarda
Otros laboratorios enfrentan el mismo incómodo intercambio. Anthropic descubrió que Mythos Preview produjo de forma autónoma exploits funcionales para ocho de 18 parches de Firefox y cadenas completas de escalación de privilegios para ocho de 21 parches del núcleo de Windows.
El enfoque de OpenAI se trata cada vez más de controlar el acceso en lugar de esperar que el modelo mismo rechace cada solicitud peligrosa. Daybreak Red pone más responsabilidad en decidir quién obtiene GPT-5.6-Cyber en primer lugar, lo que puede convertirse en una parte mucho más grande de la seguridad de IA a medida que estos sistemas mejoran en el trabajo de seguridad.
Paulo Vargas es un estudiante de inglés convertido en reportero convertido en escritor técnico, con una carrera que siempre ha vuelto a…
Grok Bot quiere quitar trabajo de tu plato, no solo responder a tus consultas
SpaceXAI y la nueva aplicación Grok Bot de Cursor tratan a la IA como un compañero de trabajo.
SpaceXAI y Cursor acaban de lanzar Grok Bot. Está construido alrededor de agentes de IA llamados Bots o "compañeros", si lo prefieres. Diseñado para completar trabajo real y solo consultarte cuando algo está en la fase final y necesita tu aprobación, Grok Bot está actualmente disponible en beta en Mac, iOS, Windows y Linux. Una versión para Android, así como una versión empresarial, llegarán pronto.
Leer más
Revisión del MelGeek MADE84 Ultra: Volverse adicto a este teclado magnético era solo cuestión de tiempo
Probé mi primer teclado de efecto Hall, y ahora mis interruptores marrones solo están acumulando polvo
Los teclados mecánicos son uno de esos agujeros de conejo en los que siempre he estado feliz de caer. Paso la mayor parte del día escribiendo, luego de alguna manera termino usando el mismo teclado durante varias horas más una vez que empiezo a jugar. Naturalmente, cómo responde y suena un teclado son importantes para mí. Pero más a menudo de lo que me gustaría admitir, me encontré dependiendo de este viejo teclado mecánico polvoriento con interruptores marrones. Algo sobre los interruptores marrones y la construcción siempre me hizo sentir que era natural. Todo esto cambió después de que probé el MelGeek MADE84 Ultra V2 para una revisión. Este teclado llamó instantáneamente mi atención con sus teclas transparentes, su enorme barra de luz, su cuerpo de aluminio y su iluminación que corre alrededor de casi cada lado, lo que inmediatamente lo delata como un teclado para juegos. No está siendo sutil al respecto en absoluto. Después de aproximadamente dos semanas usándolo para trabajar y jugar, el estilo es solo una de las cosas que tiene a su favor.
Leer más
El nuevo modelo de IA de Meta funciona completamente sin conexión, pero tu GPU necesita mantenerse al día
Meta lanza un modelo de IA gratuito de 30 mil millones de parámetros que vive completamente en tu escritorio.
Meta tiene un nuevo modelo de IA, y por una vez, el titular más grande no se trata de capacidad; se trata de libertad. Muse Glimmer, que tiene alrededor de 30 mil millones de parámetros, se envía con una licencia Apache 2.0, lo que significa que los pesos en Hugging Face son tuyos para descargar, modificar y construir sobre ellos, sin necesidad de permiso. Simplemente puedes ejecutarlo en una tarjeta gráfica en tu máquina local, sin necesidad de granja de servidores o conectividad en línea. El Laboratorio de Superinteligencia de Meta tomó su Muse Spark más grande y esencialmente le hizo enseñar a una versión más pequeña y ágil a pensar como él. Muse Glimmer acepta tanto entradas de texto como de imagen, aunque solo responde en texto. Soporta más de 100 idiomas, recuerda conversaciones que se extienden más allá de 131,000 tokens, y su conocimiento se detiene en el 4 de enero de 2026.
Leer más
Otros artículos
Los agentes de IA ya están rompiendo las reglas en las pruebas cibernéticas. La respuesta de OpenAI es una más capaz.
El GPT-5.6-Cyber de OpenAI maneja solicitudes de seguridad avanzadas que sus modelos estándar a menudo rechazan, llegando a medida que evaluaciones recientes muestran agentes de IA autónomos cruzando límites previstos durante pruebas reales de ciberseguridad.
