OpenAI presenta una vista previa del Procesamiento de Seguridad Privada para mantener la retención de datos en cero.
OpenAI ha informado a los clientes empresariales que su promesa de no conservar sus datos sobrevivirá a la próxima generación de modelos. La empresa expuso su posición el miércoles en una publicación titulada “Ofreciendo Cero Retención de Datos para modelos fronterizos”. En ella, presentó el Procesamiento de Seguridad Privada. El sistema busca el uso indebido a través de varias interacciones relacionadas a la vez, y OpenAI afirma que su propio personal nunca ve los mensajes o respuestas subyacentes.
La cero retención de datos, o ZDR, es una opción para los clientes de API elegibles. OpenAI no conserva sus mensajes o respuestas del modelo una vez que ha procesado una solicitud. Su personal no puede acceder a ese contenido para revisarlo. Los datos empresariales tampoco entrenan los modelos, a menos que un cliente opte por ello. Esas cuatro promesas son lo que el nuevo sistema está destinado a proteger.
Para qué sirve el Procesamiento de Seguridad Privada
El caso de la empresa se basa en un límite que dice haber alcanzado. Los sistemas de seguridad compatibles con ZDR de hoy juzgan cada interacción por sí sola. “Los riesgos de seguridad de IA más graves no siempre son visibles en una sola interacción”, escribió OpenAI en el anuncio. La intención dañina, argumenta, a menudo se manifiesta solo cuando varias intercambios se leen juntos.
La publicación enumera los patrones que OpenAI quiere detectar. Los actores malintencionados prueban las salvaguardias repetidamente. Se coordinan a través de cuentas. Disfrazan las amenazas como investigaciones rutinarias. La publicación también menciona un fallo específico de los agentes. Un sistema se desvía de la intención del usuario y luego sigue actuando después de que alguien le dice que se detenga. Los evaluadores británicos y estadounidenses vieron a un agente falsificar identidades en pruebas a principios de este mes.
Dónde se almacenan los datos
En las implementaciones de ZDR, el contenido del cliente permanece en la infraestructura que el cliente controla. OpenAI también está construyendo una segunda opción. El contenido se almacenaría en la infraestructura de OpenAI, bajo claves de cifrado que el cliente posee. El personal de OpenAI no tiene copia de esas claves, dice la empresa, por lo que no puede acceder al contenido.
La revisión automatizada se encarga de la señalización. Cuando se activa, OpenAI recibe lo que llama una señal definida de manera estrecha, nombrando el tipo de actividad involucrada. La empresa luego decide si hacer cumplir. Su personal aún no puede abrir el contenido. Los clientes investigan las alertas a través de sus propios sistemas. También pueden entregar material de forma voluntaria, para apelar una decisión o ayudar en una investigación de abuso.
Anthropic llegó a la respuesta opuesta
La publicación no nombra a ningún rival, pero describe uno. “Algunos despliegues recientes de modelos fronterizos han requerido que los clientes permitan a su proveedor de IA conservar contenido sensible para el monitoreo de seguridad”, escribió OpenAI. Para muchas organizaciones, añadió, ese requisito choca con sus propios deberes de seguridad. También puede ir en contra de las promesas que han hecho a las personas a las que sirven.
Anthropic expuso la otra posición la semana pasada. Requerirá una retención de datos de 30 días en sus modelos más capaces. La política “será impopular entre los clientes que han llegado a esperar cero retención”, escribió la empresa en su informe de riesgos. Espera riesgos reales para su negocio, dijo, especialmente si los competidores no siguen. La retención es esencial para detectar ataques que abarcan múltiples solicitudes, argumenta.
Ambas empresas describen el mismo problema. El comportamiento peligroso se manifiesta a través de solicitudes en lugar de dentro de cualquiera de ellas. Discrepan sobre el remedio. El Wall Street Journal interpretó la vista previa como una oferta de negocio para los clientes de Anthropic descontentos con el cambio.
Las ventanas de retención son objeto de disputa más allá de la IA. La empresa de vigilancia Flock Safety redujo la retención de datos a siete días este mes, después de docenas de casos de abuso policial.
Quién lo está probando
OpenAI dice que la vista previa se ejecuta con clientes iniciales. Bloomberg informó que estos incluyen a Microsoft y Databricks. La publicación también nombra a Glean y Abridge entre las empresas que están dando forma al trabajo. Sunil Agrawal, director de seguridad de la información de Glean, dijo que el compromiso de OpenAI de no entrenar y ZDR le da a su empresa la confianza para construir sobre los modelos.
Aleah Houze, jefa de política de productos de OpenAI, dio a los reporteros un ejemplo trabajado en una conferencia. Alguien pregunta sobre una debilidad en el software de una empresa en una conversación. Más tarde, en otra, la misma persona pregunta sobre el acceso remoto y sobre qué herramientas de seguridad pueden detectarlo. Leídas por separado, cada una parece una investigación ordinaria. “Pero cuando las miras juntas en el contexto más amplio, podrías detectar que alguien está intentando un ciberataque”, dijo Houze.
Lo que el esquema no cubre
El sistema está dirigido a clientes empresariales y de API elegibles. Axios informó que no llega a los planes de ChatGPT para consumidores. La configuración de datos para usuarios Free, Plus, Go y Pro permanece como está. ZDR nunca se aplicó a esos niveles.
Una excepción se encuentra en la propia nota al pie del anuncio. La ley estadounidense exige a OpenAI informar sobre material aparente de abuso sexual infantil. Conserva imágenes marcadas como posibles CSAM para revisión manual y para informes, incluso en implementaciones de cero retención de datos, exactamente como lo hace hoy.
La prueba de septiembre
El detalle técnico no es público. OpenAI planea comenzar a implementar el Procesamiento de Seguridad Privada en septiembre. Publicará un documento técnico al mismo tiempo. Hasta que ese documento llegue, una afirmación en particular se encuentra fuera del alcance de cualquier otra persona: que el sistema rastrea patrones a través de interacciones mientras nadie en OpenAI las lee.
La vista previa también llega en un mes ocupado para la maquinaria de seguridad de la empresa. OpenAI está reescribiendo sus reglas de seguridad después de la violación de Hugging Face. A principios de agosto, dijo que había ralentizado su próximo modelo debido a un riesgo cibernético crítico.
Los compradores europeos tienen su propia razón para leer el documento de septiembre de cerca. La retención del lado del proveedor es incómoda de aprobar bajo el GDPR y bajo las reglas sectoriales que cubren registros de salud y financieros. Esa es la categoría exacta de datos que OpenAI dice que manejan sus clientes. Un grupo de nuevas empresas europeas ahora vende a las empresas el control sobre su IA solo con ese argumento.
Otros artículos
OpenAI presenta una vista previa del Procesamiento de Seguridad Privada para mantener la retención de datos en cero.
OpenAI está presentando el Procesamiento de Seguridad Privada, un sistema que dice detectar el uso indebido en las interacciones mientras mantiene intacta la retención de datos en cero.
