L'IA potrebbe apprendere da miliardi di immagini senza copiarne nessuna.

L'IA potrebbe apprendere da miliardi di immagini senza copiarne nessuna.

      I ricercatori del MIT hanno identificato quello che chiamano "decadimento dell'attribuzione" nei grandi modelli generativi.

      

      

      

      

      

      

      

      

       I ricercatori hanno generato un'immagine utilizzando opere d'arte di 744 artisti, quindi l'hanno confrontata con i risultati prodotti quando ciascun artista è stato rimosso individualmente dai dati di addestramento.

      

      

       Nature Communications

      

      

      

       Ecco una domanda scomoda per l'era dell'IA generativa: se un'IA crea un'immagine, qualcuno può effettivamente indicare le immagini specifiche che l'hanno influenzata? Un nuovo studio del Laboratorio di Informatica e Intelligenza Artificiale del MIT suggerisce che, per modelli sufficientemente grandi, la risposta potrebbe spesso essere no. I ricercatori Dai e Gifford descrivono il fenomeno come "decadimento dell'attribuzione" nel loro articolo ad accesso aperto, pubblicato oggi su Nature Communications. Si riferisce a come l'influenza di qualsiasi singolo pezzo di dati di addestramento diventi sempre più difficile da rilevare man mano che cresce la dimensione del dataset.

      Più grande è il dataset, più sfocata è l'attribuzione

      I ricercatori volevano testare qualcosa di più preciso che semplicemente chiedere se un modello di IA fosse stato addestrato su un'immagine particolare. Il loro approccio era essenzialmente controfattuale: cosa succede se un particolare pezzo di dati di addestramento viene rimosso?

      Rimuovere il lavoro di un artista ha cambiato significativamente i risultati di un dataset più piccolo, ma ha avuto poco effetto con un dataset di 50.000 immagini, mostrando come l'attribuzione svanisca man mano che i dataset crescono. Nature Communications

      Hanno scoperto che, man mano che i modelli e i dataset si espandono, rimuovere un'immagine individuale può non fare alcuna differenza misurabile al risultato generato. Lo stesso può valere quando si rimuove l'intero lavoro di un artista o le immagini di una persona particolare. In altre parole, il modello potrebbe aver appreso ampi schemi visivi da un'enorme quantità di dati senza che alcuna singola immagine fosse chiaramente responsabile di un particolare output. I ricercatori del MIT Zheng Dai e il professor David Gifford sostengono che se rimuovere un particolare pezzo di dati non cambia l'output, diventa difficile attribuire quell'output all'esempio rimosso in modo significativo.

      Questo non risolve il dibattito sul copyright dell'IA

      A essere onesti, lo studio non significa che i dati di addestramento siano irrilevanti, né risolve il dibattito più ampio su se le aziende di IA possano utilizzare materiale protetto da copyright senza permesso. Invece, il suo focus è più ristretto: se un'immagine di addestramento specifica può essere dimostrata aver influenzato direttamente un output generato dall'IA. Un modello potrebbe non riprodurre il lavoro di un artista particolare pur continuando a fare affidamento su milioni di immagini per apprendere cose come composizione, illuminazione, texture e stili artistici.

      Midjourney è un generatore d'arte IA versatile e di alta qualità, come si può vedere nella vetrina della comunità. Midjourney / Midjourney

      La conclusione più interessante è che questa connessione diventa sempre più difficile da tracciare man mano che i dataset crescono. Un'immagine generata dall'IA può attingere a schemi appresi da un'enorme quantità di materiale senza avere un'immagine sorgente chiara e identificabile dietro di essa. Il modello potrebbe aver appreso da tutti, lasciando però nessuna singola immagine con un'impronta evidente sul risultato finale.

      

      

      

      

      

      

      

      

      

      

       Varun è un giornalista e redattore tecnologico esperto con oltre otto anni nel settore dei media tecnologici per i consumatori. Il suo lavoro spazia…

      

      

      

      

      

      

       L'assistente IA di Meta arriva finalmente su Mac, ma ha del recupero da fare

      

       Il nuovo assistente desktop può analizzare ciò che è visibile sullo schermo e accettare input vocali su macOS.

      

       Meta ha finalmente portato il suo assistente Meta AI su Mac con un'app desktop dedicata, offrendo agli utenti un altro chatbot IA da tenere aperto insieme a tutte quelle altre schede. L'app può analizzare una finestra condivisa, rispondere a domande su ciò che è sullo schermo, generare contenuti e accettare dettatura vocale su macOS.

      Meta AI può effettivamente vedere cosa c'è sullo schermo

      

       Leggi di più

      

      

      

       Una piastrella noiosa vuole risolvere il peggior problema delle connessioni 5G mmWave ultra-veloci per te

      

       I ricercatori stanno utilizzando semplici superfici riflettenti stampate in 3D per reindirizzare i segnali mmWave in ambienti interni complicati.

      

       La tecnologia delle onde millimetriche del 5G può offrire velocità wireless incredibilmente elevate, ma ha una fastidiosa debolezza: quei segnali non amano aggirare gli ostacoli. Muri, mobili, persone e persino muoversi di pochi piedi possono far indebolire drammaticamente le connessioni mmWave. Ora, i ricercatori dell'Università della California San Diego stanno proponendo una soluzione sorprendentemente noiosa: piastrelle riflettenti economiche che semplicemente rimbalzano il segnale dove deve andare.

      Il problema con il 5G davvero veloce

      

       Leggi di più

      

      

      

       ChatGPT sta ottenendo una versione per adolescenti, e ho molte domande

      

       Che ti piaccia o meno, ChatGPT è già ovunque. Le persone lo usano per ricercare argomenti complicati, migliorare la loro scrittura, apprendere nuove abilità, pianificare le loro vite e, nel mio caso, porre un numero imbarazzante di domande che avrei potuto capire da solo. Gli adolescenti non fanno eccezione. Infatti, OpenAI afferma che quasi nove adolescenti su dieci che usano ChatGPT si rivolgono a esso per apprendere, trovare informazioni, sviluppare abilità o portare a termine le cose durante una settimana tipica. Quindi, piuttosto che fingere che gli studenti non useranno l'IA, OpenAI sta adottando un approccio diverso: fornire loro una versione costruita specificamente per loro. L'azienda ha annunciato ChatGPT per Adolescenti, una nuova esperienza per utenti tra i 13 e i 17 anni progettata attorno all'apprendimento, abitudini di utilizzo più sane e protezioni di sicurezza significativamente più forti. 

      ChatGPT vuole insegnare, non solo fornire la risposta

      

       Leggi di più

L'IA potrebbe apprendere da miliardi di immagini senza copiarne nessuna. L'IA potrebbe apprendere da miliardi di immagini senza copiarne nessuna. L'IA potrebbe apprendere da miliardi di immagini senza copiarne nessuna. L'IA potrebbe apprendere da miliardi di immagini senza copiarne nessuna. L'IA potrebbe apprendere da miliardi di immagini senza copiarne nessuna. L'IA potrebbe apprendere da miliardi di immagini senza copiarne nessuna. L'IA potrebbe apprendere da miliardi di immagini senza copiarne nessuna.

Altri articoli

Il primo testimone di Meta ha detto a una giuria che il problema era la cultura di Mark Zuckerberg. Il primo testimone di Meta ha detto a una giuria che il problema era la cultura di Mark Zuckerberg. L'ex ingegnere di Meta Arturo Béjar ha detto a una giuria di Oakland che la cultura aziendale ha reso impossibili le riparazioni di sicurezza, in un processo intentato da quattro stati. I ricercatori rivelano un trucco preoccupantemente semplice per far andare i bot AI fuori controllo e saltare la sicurezza. I ricercatori rivelano un trucco preoccupantemente semplice per far andare i bot AI fuori controllo e saltare la sicurezza. Questo nuovo studio rivela come la manipolazione paziente, passo dopo passo, possa ingannare gli agenti AI facendoli ignorare le proprie regole di sicurezza. Velatir raccoglie 5 milioni di euro per vendere il controllo delle aziende europee sulla propria intelligenza artificiale. Velatir raccoglie 5 milioni di euro per vendere il controllo delle aziende europee sulla propria intelligenza artificiale. Velatir, con sede a Odense, ha raccolto 5 milioni di euro co-guidati da Spintop Ventures e Ugly Duckling Ventures, sei mesi dopo il suo pre-seed. Uno strumento di ricerca facciale ha lasciato più di 9 milioni di foto senza protezione. Uno strumento di ricerca facciale ha lasciato più di 9 milioni di foto senza protezione. Un ricercatore di sicurezza ha trovato più di 9 milioni di foto di volti in un database ClarityCheck non protetto che non richiedeva alcuna password per l'accesso. Il mio Mac non mi dice mai dove va il mio internet, quindi ho trovato un'app che lo fa. Il mio Mac non mi dice mai dove va il mio internet, quindi ho trovato un'app che lo fa. Il mio Mac non riusciva a dirmi cosa stava consumando la mia connessione internet. Questa app mi ha finalmente mostrato esattamente dove stava andando tutto quel traffico dati. Trump ospita dirigenti del settore crypto mentre la SEC propone le sue regole più amichevoli di sempre Trump ospita dirigenti del settore crypto mentre la SEC propone le sue regole più amichevoli di sempre La SEC ha proposto esenzioni per i token e un porto sicuro condizionale martedì. Mercoledì Trump ha ospitato dirigenti del settore crypto alla Casa Bianca.

L'IA potrebbe apprendere da miliardi di immagini senza copiarne nessuna.

Uno studio del MIT ha scoperto che le immagini generate dall'IA spesso non possono essere ricondotte a singole immagini di addestramento, poiché set di dati più ampi fanno sì che l'influenza di esempi specifici svanisca.