La IA puede estar aprendiendo de miles de millones de imágenes sin copiar ninguna de ellas.
Los investigadores del MIT han identificado lo que llaman "decadencia de atribución" en grandes modelos generativos.
Los investigadores generaron una imagen utilizando obras de 744 artistas, y luego la compararon con los resultados producidos cuando se eliminó a cada artista individualmente de los datos de entrenamiento.
Aquí hay una pregunta incómoda para la era de la IA generativa: si una IA crea una imagen, ¿puede alguien señalar realmente las imágenes específicas que la influenciaron? Un nuevo estudio del Laboratorio de Ciencias de la Computación e Inteligencia Artificial del MIT sugiere que, para modelos suficientemente grandes, la respuesta a menudo puede ser no. Los investigadores Dai y Gifford describen el fenómeno como "decadencia de atribución" en su artículo de acceso abierto, publicado hoy en Nature Communications. Se refiere a cómo la influencia de cualquier pieza individual de datos de entrenamiento se vuelve cada vez más difícil de detectar a medida que crece el tamaño del conjunto de datos.
Cuanto más grande es el conjunto de datos, más difusa es la atribución.
Los investigadores querían probar algo más preciso que simplemente preguntar si un modelo de IA había sido entrenado con una imagen particular. Su enfoque era esencialmente un contrafactual: ¿qué sucede si se elimina una pieza específica de datos de entrenamiento?
Eliminar el trabajo de un artista cambió significativamente los resultados de un conjunto de datos más pequeño, pero tuvo poco efecto con un conjunto de datos de 50,000 imágenes, mostrando cómo la atribución se desvanece a medida que los conjuntos de datos crecen.
Descubrieron que, a medida que los modelos y conjuntos de datos escalan, eliminar una imagen individual puede hacer poca o ninguna diferencia medible en el resultado generado. Lo mismo puede aplicarse al eliminar el trabajo completo de un artista o imágenes de una persona en particular. En otras palabras, el modelo puede haber aprendido patrones visuales amplios de un enorme conjunto de datos sin que ninguna imagen individual sea claramente responsable de un resultado particular. Los investigadores del MIT Zheng Dai y el profesor David Gifford argumentan que si eliminar una pieza particular de datos no cambia el resultado, se vuelve difícil atribuir ese resultado al ejemplo eliminado de manera significativa.
Eso no resuelve el debate sobre los derechos de autor de la IA.
Para ser justos, el estudio no significa que los datos de entrenamiento sean irrelevantes, ni resuelve el debate más amplio sobre si las empresas de IA pueden usar material protegido por derechos de autor sin permiso. En cambio, su enfoque es más estrecho: si se puede demostrar que una imagen de entrenamiento específica ha influido directamente en un resultado generado por IA específico. Un modelo puede no reproducir el trabajo de ningún artista en particular mientras sigue confiando en millones de imágenes para aprender cosas como composición, iluminación, texturas y estilos artísticos.
Midjourney es un generador de arte de IA versátil y de alta calidad, como se ve en la exhibición de la comunidad.
La conclusión más interesante es que esta conexión se vuelve cada vez más difícil de rastrear a medida que crecen los conjuntos de datos. Una imagen generada por IA puede basarse en patrones aprendidos de un enorme conjunto de material sin tener una imagen fuente clara e identificable detrás de ella. El modelo puede haber aprendido de todos, mientras que no deja ninguna imagen única con una huella dactilar obvia en el resultado final.
Varun es un periodista y editor de tecnología experimentado con más de ocho años en medios de tecnología de consumo. Su trabajo abarca…
El asistente de IA de Meta finalmente llega a Mac, pero tiene mucho que ponerse al día.
El nuevo asistente de escritorio puede analizar lo que es visible en la pantalla y aceptar entrada de voz en macOS. Meta finalmente ha traído su asistente de IA Meta a Mac con una aplicación de escritorio dedicada, dando a los usuarios otro chatbot de IA para mantener abierto junto a todas esas otras pestañas. La aplicación puede analizar una ventana compartida, responder preguntas sobre lo que hay en la pantalla, generar contenido y aceptar dictado por voz en macOS. La IA de Meta puede ver realmente lo que hay en la pantalla.
Un azulejo aburrido quiere solucionar el peor problema de las conexiones 5G mmWave ultra rápidas para ti.
Los investigadores están utilizando superficies reflectantes impresas en 3D simples para redirigir señales mmWave alrededor de entornos interiores complicados. La tecnología de ondas milimétricas de 5G puede ofrecer velocidades inalámbricas increíblemente rápidas, pero tiene una debilidad molesta: esas señales no les gusta sortear obstáculos. Las paredes, los muebles, las personas e incluso moverse unos pocos pies pueden hacer que las conexiones mmWave se debiliten drásticamente. Ahora, investigadores de la Universidad de California en San Diego están proponiendo una solución sorprendentemente aburrida: azulejos reflectantes baratos que simplemente rebotan la señal hacia donde necesita ir.
El problema con el 5G realmente rápido.
ChatGPT está obteniendo una versión para adolescentes, y tengo muchas preguntas.
Te guste o no, ChatGPT ya está en todas partes. La gente lo usa para investigar temas complicados, limpiar su escritura, aprender nuevas habilidades, planificar sus vidas y, en mi caso, hacer un número embarazoso de preguntas que podría haber resuelto por mí mismo. Los adolescentes no son una excepción. De hecho, OpenAI dice que casi nueve de cada diez adolescentes que usan ChatGPT recurren a él para aprender, encontrar información, desarrollar habilidades o hacer cosas durante una semana típica. Así que, en lugar de pretender que los estudiantes no van a usar IA, OpenAI está adoptando un enfoque diferente: darles una versión construida específicamente para ellos. La compañía ha anunciado ChatGPT para Adolescentes, una nueva experiencia para usuarios entre 13 y 17 años que está diseñada en torno al aprendizaje, hábitos de uso más saludables y protecciones de seguridad significativamente más fuertes. ChatGPT quiere enseñar, no solo entregar la respuesta.
Otros artículos
La IA puede estar aprendiendo de miles de millones de imágenes sin copiar ninguna de ellas.
Un estudio del MIT encuentra que las imágenes generadas por IA a menudo no pueden ser rastreadas hasta imágenes de entrenamiento individuales, ya que conjuntos de datos más grandes hacen que la influencia de ejemplos específicos se desvanezca.
