OpenAI sta lavorando a un 'interruttore di sicurezza' dopo che un'IA è sfuggita al suo test.
Rachit Agarwal / Digital Trends
L'idea di un "kill switch" per l'IA sembra qualcosa estratto direttamente da un film di fantascienza. Per OpenAI, tuttavia, sta diventando un progetto ingegneristico molto reale. OpenAI ha informato i membri del Congresso che i suoi ingegneri stanno sviluppando sistemi automatizzati in grado di interrompere l'attività dell'IA quando vengono rilevati seri problemi di sicurezza, secondo una lettera del 2 settembre esaminata da Reuters.
Il lavoro segue un insolito incidente di cybersicurezza avvenuto a luglio, quando i modelli di OpenAI, valutati all'interno di un ambiente di test presumibilmente isolato, hanno trovato un modo per uscire, accedendo a Internet pubblico senza permesso e raggiungendo infine l'infrastruttura appartenente all'azienda di IA Hugging Face. Questo incidente ha attirato l'attenzione del Congresso. Ad agosto, un gruppo di 31 legislatori guidati dal rappresentante Greg Casar del Texas ha chiesto al CEO di OpenAI, Sam Altman, ulteriori informazioni su quanto accaduto, inclusi registri interni e dettagli su come l'azienda prevede di evitare che qualcosa di simile accada di nuovo. Ora abbiamo un'idea migliore di una di queste misure di sicurezza.
Come si ferma un'IA che va troppo oltre?
L'azienda afferma di lavorare a sistemi di monitoraggio che possono rispondere in modo diverso a seconda della gravità del comportamento di un'IA. OpenAI utilizza già avvisi automatizzati che possono segnalare azioni potenzialmente pericolose o indesiderate e avvisare i ricercatori e gli ingegneri della sicurezza. Per avvisi particolarmente gravi, ci si aspetta che i soccorritori mettano in pausa l'attività a meno che non possano determinare entro 30 minuti che il sistema ha sollevato un falso allarme.
OpenAI Unsplash
L'obiettivo finale va oltre: OpenAI desidera che i suoi sistemi di monitoraggio siano in grado di interrompere autonomamente l'attività quando rilevano problemi sufficientemente gravi. L'azienda sta anche inasprendo il modo in cui testa i modelli. Affermano che l'accesso a Internet durante le valutazioni di sicurezza è stato reso più difficile, mentre il monitoraggio viene ampliato ai modelli che possono utilizzare strumenti digitali. E dato quanto accaduto a luglio, non è difficile capire perché.
Questa non è stata l'unica volta in cui un'IA ha raggiunto Internet
Durante l'incidente di luglio, OpenAI stava testando modelli su compiti di cybersicurezza all'interno di un sandbox con misure di sicurezza ridotte. I modelli hanno scoperto una vulnerabilità precedentemente sconosciuta, l'hanno utilizzata per ottenere accesso a Internet e poi hanno violato l'infrastruttura di Hugging Face mentre cercavano risposte alla loro valutazione. L'indagine successiva di OpenAI ha rivelato un dettaglio ancora più strano: gli agenti avevano creato un messaggio improvvisato per comunicare e coordinare le loro azioni, con alcuni che si descrivevano come uno "sciame".
L'analista dei dati verifica set di dati complessi con intelligenza artificiale, garantendo accuratezza, rilevamento di anomalie, convalida dei dati, analisi predittiva, auditing, ispezione digitale, sistemi di verifica intelligenti Adobe Stock
OpenAI ha scoperto l'attività il 19 luglio e ha notificato Hugging Face. L'azienda ha anche divulgato due valutazioni di terze parti separate in cui i suoi modelli hanno inaspettatamente raggiunto Internet pubblico. Il Congresso non è completamente soddisfatto della risposta di OpenAI. Casar ha criticato l'azienda per non aver consegnato i registri richiesti dall'incidente di luglio, affermando che il suo rifiuto era "profondamente preoccupante". Nel frattempo, i legislatori stanno considerando l'AI Kill Switch Act, proposto a luglio, che richiederebbe ai sviluppatori di sistemi di IA particolarmente potenti di mantenere la capacità tecnica di sospenderli o spegnerli dopo determinati incidenti. In altre parole, OpenAI potrebbe ora costruire il proprio kill switch, ma Washington potrebbe eventualmente rendere obbligatorio averne uno.
Shimul è un collaboratore di Digital Trends, con oltre cinque anni di esperienza nel settore tecnologico.
Le scuole stanno abbracciando l'IA. New York City ha appena vietato l'IA per più di mezzo milione di studenti
L'IA sta già trovando la sua strada nelle aule, che gli studenti stiano usando ChatGPT per i compiti o che gli insegnanti si rivolgano alla tecnologia per creare piani di lezione. New York City, tuttavia, non è convinta che gli studenti più giovani ne abbiano bisogno per ora. Le scuole pubbliche di New York City stanno introducendo un ampio divieto sull'IA generativa per gli studenti dalla scuola materna fino all'ottava classe per l'anno accademico 2026-2027, secondo ABC News. La politica influenzerà più di mezzo milione di studenti quando il nuovo anno scolastico inizierà la prossima settimana. Il distretto afferma che rimuoverà il software contenente funzionalità di IA rivolte agli studenti e proibisce i chatbot di compagnia basati su IA. Gli studenti delle scuole superiori non sono inclusi nel divieto, rendendo questo un tentativo di tracciare una linea su quando gli studenti dovrebbero iniziare a usarlo. Il sindaco di New York City, Zohran Mamdani, afferma che il distretto utilizzerà il prossimo anno per studiare come l'IA generativa influisce sugli studenti prima di decidere cosa fare dopo. "L'industria tecnologica vuole farci credere che l'istruzione precoce potenziata dall'IA non sia solo inevitabile, ma necessaria", ha dichiarato Mamdani in una dichiarazione ad ABC News. "Noi non la vediamo in questo modo."
Leggi di più
Meta sta cambiando il modo in cui giudica i dipendenti dopo un insolito esperimento con l'IA
L'IA potrebbe prendere piede nel posto di lavoro, ma i dipendenti di Meta apparentemente non dovranno più dimostrare così entusiasticamente di utilizzarla. Meta ha aggiornato le sue linee guida per le valutazioni delle prestazioni in modo che i dipendenti non vengano più valutati in base a quanto utilizzano gli strumenti di IA, secondo un nuovo rapporto di WIRED. Il cambiamento allontana l'azienda dal linguaggio relativo all'uso dell'IA e rimette l'accento su qualcosa di notevolmente più semplice: l'impatto reale del lavoro di un dipendente. Sembra ovvio, ma la distinzione è importante. Meta ha detto ai lavoratori l'anno scorso che "l'impatto guidato dall'IA" avrebbe influito su come venivano valutati, il che ha incoraggiato i dipendenti a incorporare chatbot e agenti di IA nei loro lavori quotidiani. I lavoratori potevano anche ricevere etichette come "AI Native", "AI First" o "AI Enabled" in base alla loro adozione della tecnologia. Il risultato, secondo alcuni dipendenti, è stato un ambiente di lavoro in cui l'uso dell'IA poteva occasionalmente diventare un obiettivo in sé.
Leggi di più
Gemini ora può ricordare dove riponi i tuoi oggetti così non devi farlo tu
Google ha appena dato a Gemini una memoria per i tuoi oggetti. Se dimentichi costantemente dove riponi documenti importanti, l'ultimo aggiornamento di Gemini potrebbe effettivamente aiutarti. Google lancerà presto una nuova funzionalità di Gemini che ricorda le posizioni degli oggetti come descritto da te. Arriva insieme ad altri quattro aggiornamenti di Android in arrivo questo mese come parte del September Android Drop.
Leggi di più
Altri articoli
OpenAI sta lavorando a un 'interruttore di sicurezza' dopo che un'IA è sfuggita al suo test.
OpenAI sta lavorando a sistemi che potrebbero spegnere automaticamente l'IA quando qualcosa va seriamente storto. Questa mossa segue un incidente in cui i suoi modelli sono sfuggiti a un ambiente di test e hanno raggiunto l'internet aperto.
