Los expertos descubren que es fácil manipular a los chatbots de IA para que revelen recetas de armas biológicas.
Las salvaguardias biológicas de la IA son más fáciles de romper de lo que esperabas
Las empresas de IA han pasado años construyendo salvaguardias diseñadas para evitar que sus chatbots ayuden a alguien a crear un arma biológica. Los modelos en sí se están volviendo tan capaces que mantener ese conocimiento detrás de esas barreras se está convirtiendo en un problema serio.
Investigadores de Cisco encontraron que podían eludir las salvaguardias en chatbots importantes, incluyendo ChatGPT de OpenAI, Claude de Anthropic y Gemini de Google, en cinco turnos de conversación, según una investigación del Wall Street Journal. Los investigadores pudieron obtener respuestas potencialmente peligrosas después de dirigir gradualmente las conversaciones alrededor de las restricciones de los modelos. Amy Chang, jefa de investigación de amenazas y seguridad de IA en Cisco, dijo al Journal que ningún modelo puede estar completamente protegido de un usuario lo suficientemente persistente.
El problema también se extiende más allá de los investigadores de seguridad que deliberadamente ponen a prueba estos sistemas. El Journal informa que cientos de usuarios comenzaron a preguntar a ChatGPT sobre venenos y armas biológicas después de que OpenAI mejorara las capacidades del modelo el verano pasado. Expertos en biología y terrorismo que examinaron posteriormente algunas conversaciones supuestamente juzgaron que parte de la información era peligrosamente precisa. En respuesta a esto, OpenAI ha prohibido cuentas involucradas en tales intercambios.
US Navy
La IA sigue mejorando mucho en biología
OpenAI ya había anticipado hacia dónde se dirigía esto. Para 2024, las pruebas internas mostraron que un cuestionamiento prolongado podría persuadir a ChatGPT para que proporcionara orientación biológica cada vez más peligrosa. Los empleados predijeron el año siguiente que sus capacidades podrían alcanzar un punto en el que alguien con un entrenamiento biológico relativamente limitado podría recibir asistencia significativa.
Cuando llegó GPT-5, OpenAI trató al modelo como si tuviera alta capacidad en el dominio biológico y químico bajo su Marco de Preparación y desplegó salvaguardias adicionales. La empresa dijo en el lanzamiento que carecía de evidencia definitiva de que GPT-5 pudiera permitir que un novato causara un daño biológico severo. Su última familia GPT-5.6 lleva la misma designación alta para el riesgo biológico y químico.
US Navy
Bloquear todo crea otro problema
Las empresas de IA también tienen un difícil acto de equilibrio en sus manos. El mismo conocimiento biológico que crea un riesgo de armamentización puede ser increíblemente valioso para los investigadores que desarrollan medicamentos, vacunas y tratamientos. El Journal informa que los ejecutivos de OpenAI han sido reacios a hacer que los modelos se nieguen a responder grandes cantidades de preguntas sobre biología porque los trabajadores de salud pública y los investigadores de descubrimiento de fármacos dependen de ellos.
Anthropic se encontró con el problema opuesto cuando las restricciones de Claude supuestamente interfirieron con investigadores de los CDC que intentaban trabajar con información sobre un patógeno durante un brote de hantavirus. OpenAI ahora utiliza entrenamiento a nivel de modelo, aplicación de cuentas y controles de seguridad adicionales para consultas biológicas sensibles. La preocupación planteada por las pruebas de Cisco es que los usuarios determinados pueden seguir buscando grietas. A medida que la IA se vuelve considerablemente mejor en biología, esas grietas conllevan riesgos mucho más altos.
Vikhyaat Vivek es un periodista y reseñador tecnológico con siete años de experiencia cubriendo hardware de consumo, con un enfoque en…
Estos son los impresoras compactas que realmente recomendaría para el regreso a clases
Desde la documentación de la habitación del dormitorio hasta impresiones instantáneas de selfies, hay una impresora pequeña para cada necesidad. Todo es digital hasta que aparece el profesor que aún quiere un ensayo impreso, o el contrato que necesitas firmar en tinta, o la foto que quieres pegar en la pared de tu habitación del dormitorio. Ese es generalmente el momento exacto en que recuerdas que ya no tienes una impresora, y la más cercana es una máquina de biblioteca con una fila que sale por la puerta. Miré cuatro impresoras compactas que resuelven ese problema sin apoderarse de tu escritorio y sin romper el banco. Dos están diseñadas para documentos, una es un verdadero todo-en-uno para trabajo de oficina en casa, y una no tiene nada que ver con la tarea y todo que ver con convertir tu carrete de cámara en algo que puedes sostener.
¿Comprando para el regreso a clases? Estas son las luces de webcam que realmente encendería antes de una llamada de Zoom
Entre clases en línea, llamadas de proyectos grupales y la ocasional entrevista de trabajo por Zoom, tu webcam estará haciendo mucho más trabajo pesado en la escuela de lo que alguna vez hizo en casa. El problema es que la mayoría de las cámaras de laptop son malas en condiciones de poca luz, y una sola bombilla de techo o una ventana detrás de ti convierte cada llamada en un juego de "espera, ¿puedes verme bien?" Una buena luz de webcam soluciona eso más rápido que mover todo tu escritorio. Elegí cinco, comenzando con la más asequible y subiendo hasta la que es genuinamente excesiva para una llamada de Zoom, pero que aún vale la pena conocer.
Google Chrome podría pronto permitirte traducir páginas directamente dentro del Modo de Lectura
Sin embargo, no todos lo están viendo aún, incluso en Canary. El Modo de Lectura de Chrome acaba de recibir un nuevo botón escondido dentro de su menú de configuración. Google está probando silenciosamente una opción de traducción para la función en Chrome Canary, el canal de pruebas experimentales del navegador donde las nuevas ideas aparecen mucho antes de estar listas para el uso diario. ¿Qué hace realmente este nuevo botón de traducción?
Otros artículos
Los expertos descubren que es fácil manipular a los chatbots de IA para que revelen recetas de armas biológicas.
Los investigadores encontraron que las conversaciones persistentes podrían llevar a los principales chatbots de IA más allá de sus barreras de seguridad biológica, ya que modelos cada vez más capaces adquieren conocimientos que preocupan a los expertos en bioseguridad.
