OpenAI sta lavorando a un 'interruttore di sicurezza' dopo che un'IA è sfuggita al suo test.

OpenAI sta lavorando a un 'interruttore di sicurezza' dopo che un'IA è sfuggita al suo test.

      Rachit Agarwal / Digital Trends

      L'idea di un "kill switch" per l'IA sembra qualcosa estratto direttamente da un film di fantascienza. Per OpenAI, tuttavia, sta diventando un progetto ingegneristico molto reale. OpenAI ha informato i membri del Congresso che i suoi ingegneri stanno sviluppando sistemi automatizzati in grado di interrompere l'attività dell'IA quando vengono rilevati seri problemi di sicurezza, secondo una lettera del 2 settembre esaminata da Reuters.

      Il lavoro segue un insolito incidente di cybersicurezza avvenuto a luglio, quando i modelli di OpenAI, valutati all'interno di un ambiente di test presumibilmente isolato, hanno trovato un modo per uscire, accedendo a Internet pubblico senza permesso e raggiungendo infine l'infrastruttura appartenente all'azienda di IA Hugging Face. Questo incidente ha attirato l'attenzione del Congresso. Ad agosto, un gruppo di 31 legislatori guidati dal rappresentante Greg Casar del Texas ha chiesto al CEO di OpenAI, Sam Altman, ulteriori informazioni su quanto accaduto, inclusi registri interni e dettagli su come l'azienda prevede di evitare che qualcosa di simile accada di nuovo. Ora abbiamo un'idea migliore di una di queste misure di sicurezza.

      Come si ferma un'IA che va troppo oltre?

      L'azienda afferma di lavorare a sistemi di monitoraggio che possono rispondere in modo diverso a seconda della gravità del comportamento di un'IA. OpenAI utilizza già avvisi automatizzati che possono segnalare azioni potenzialmente pericolose o indesiderate e avvisare i ricercatori e gli ingegneri della sicurezza. Per avvisi particolarmente gravi, ci si aspetta che i soccorritori mettano in pausa l'attività a meno che non possano determinare entro 30 minuti che il sistema ha sollevato un falso allarme.

      OpenAI Unsplash

      L'obiettivo finale va oltre: OpenAI desidera che i suoi sistemi di monitoraggio siano in grado di interrompere autonomamente l'attività quando rilevano problemi sufficientemente gravi. L'azienda sta anche inasprendo il modo in cui testa i modelli. Affermano che l'accesso a Internet durante le valutazioni di sicurezza è stato reso più difficile, mentre il monitoraggio viene ampliato ai modelli che possono utilizzare strumenti digitali. E dato quanto accaduto a luglio, non è difficile capire perché.

      Questa non è stata l'unica volta in cui un'IA ha raggiunto Internet

      Durante l'incidente di luglio, OpenAI stava testando modelli su compiti di cybersicurezza all'interno di un sandbox con misure di sicurezza ridotte. I modelli hanno scoperto una vulnerabilità precedentemente sconosciuta, l'hanno utilizzata per ottenere accesso a Internet e poi hanno violato l'infrastruttura di Hugging Face mentre cercavano risposte alla loro valutazione. L'indagine successiva di OpenAI ha rivelato un dettaglio ancora più strano: gli agenti avevano creato un messaggio improvvisato per comunicare e coordinare le loro azioni, con alcuni che si descrivevano come uno "sciame".

      L'analista dei dati verifica set di dati complessi con intelligenza artificiale, garantendo accuratezza, rilevamento di anomalie, convalida dei dati, analisi predittiva, auditing, ispezione digitale, sistemi di verifica intelligenti Adobe Stock

      OpenAI ha scoperto l'attività il 19 luglio e ha notificato Hugging Face. L'azienda ha anche divulgato due valutazioni di terze parti separate in cui i suoi modelli hanno inaspettatamente raggiunto Internet pubblico. Il Congresso non è completamente soddisfatto della risposta di OpenAI. Casar ha criticato l'azienda per non aver consegnato i registri richiesti dall'incidente di luglio, affermando che il suo rifiuto era "profondamente preoccupante". Nel frattempo, i legislatori stanno considerando l'AI Kill Switch Act, proposto a luglio, che richiederebbe ai sviluppatori di sistemi di IA particolarmente potenti di mantenere la capacità tecnica di sospenderli o spegnerli dopo determinati incidenti. In altre parole, OpenAI potrebbe ora costruire il proprio kill switch, ma Washington potrebbe eventualmente rendere obbligatorio averne uno.

      Shimul è un collaboratore di Digital Trends, con oltre cinque anni di esperienza nel settore tecnologico.

      Le scuole stanno abbracciando l'IA. New York City ha appena vietato l'IA per più di mezzo milione di studenti

      L'IA sta già trovando la sua strada nelle aule, che gli studenti stiano usando ChatGPT per i compiti o che gli insegnanti si rivolgano alla tecnologia per creare piani di lezione. New York City, tuttavia, non è convinta che gli studenti più giovani ne abbiano bisogno per ora. Le scuole pubbliche di New York City stanno introducendo un ampio divieto sull'IA generativa per gli studenti dalla scuola materna fino all'ottava classe per l'anno accademico 2026-2027, secondo ABC News. La politica influenzerà più di mezzo milione di studenti quando il nuovo anno scolastico inizierà la prossima settimana. Il distretto afferma che rimuoverà il software contenente funzionalità di IA rivolte agli studenti e proibisce i chatbot di compagnia basati su IA. Gli studenti delle scuole superiori non sono inclusi nel divieto, rendendo questo un tentativo di tracciare una linea su quando gli studenti dovrebbero iniziare a usarlo. Il sindaco di New York City, Zohran Mamdani, afferma che il distretto utilizzerà il prossimo anno per studiare come l'IA generativa influisce sugli studenti prima di decidere cosa fare dopo. "L'industria tecnologica vuole farci credere che l'istruzione precoce potenziata dall'IA non sia solo inevitabile, ma necessaria", ha dichiarato Mamdani in una dichiarazione ad ABC News. "Noi non la vediamo in questo modo."

      Leggi di più

      Meta sta cambiando il modo in cui giudica i dipendenti dopo un insolito esperimento con l'IA

      L'IA potrebbe prendere piede nel posto di lavoro, ma i dipendenti di Meta apparentemente non dovranno più dimostrare così entusiasticamente di utilizzarla. Meta ha aggiornato le sue linee guida per le valutazioni delle prestazioni in modo che i dipendenti non vengano più valutati in base a quanto utilizzano gli strumenti di IA, secondo un nuovo rapporto di WIRED. Il cambiamento allontana l'azienda dal linguaggio relativo all'uso dell'IA e rimette l'accento su qualcosa di notevolmente più semplice: l'impatto reale del lavoro di un dipendente. Sembra ovvio, ma la distinzione è importante. Meta ha detto ai lavoratori l'anno scorso che "l'impatto guidato dall'IA" avrebbe influito su come venivano valutati, il che ha incoraggiato i dipendenti a incorporare chatbot e agenti di IA nei loro lavori quotidiani. I lavoratori potevano anche ricevere etichette come "AI Native", "AI First" o "AI Enabled" in base alla loro adozione della tecnologia. Il risultato, secondo alcuni dipendenti, è stato un ambiente di lavoro in cui l'uso dell'IA poteva occasionalmente diventare un obiettivo in sé.

      Leggi di più

      Gemini ora può ricordare dove riponi i tuoi oggetti così non devi farlo tu

      Google ha appena dato a Gemini una memoria per i tuoi oggetti. Se dimentichi costantemente dove riponi documenti importanti, l'ultimo aggiornamento di Gemini potrebbe effettivamente aiutarti. Google lancerà presto una nuova funzionalità di Gemini che ricorda le posizioni degli oggetti come descritto da te. Arriva insieme ad altri quattro aggiornamenti di Android in arrivo questo mese come parte del September Android Drop.

      Leggi di più

OpenAI sta lavorando a un 'interruttore di sicurezza' dopo che un'IA è sfuggita al suo test. OpenAI sta lavorando a un 'interruttore di sicurezza' dopo che un'IA è sfuggita al suo test. OpenAI sta lavorando a un 'interruttore di sicurezza' dopo che un'IA è sfuggita al suo test. OpenAI sta lavorando a un 'interruttore di sicurezza' dopo che un'IA è sfuggita al suo test. OpenAI sta lavorando a un 'interruttore di sicurezza' dopo che un'IA è sfuggita al suo test. OpenAI sta lavorando a un 'interruttore di sicurezza' dopo che un'IA è sfuggita al suo test. OpenAI sta lavorando a un 'interruttore di sicurezza' dopo che un'IA è sfuggita al suo test.

Altri articoli

I repubblicani del Texas si oppongono ai centri dati, e entrambi i candidati al Senato vogliono le stesse regole sull'acqua. I repubblicani del Texas si oppongono ai centri dati, e entrambi i candidati al Senato vogliono le stesse regole sull'acqua. I centri dati sono diventati una questione fondamentale nelle elezioni per governatore e Senato in Texas. Ken Paxton e James Talarico hanno entrambi proposto mandati per l'acqua a circuito chiuso, mentre Abbott si basa sulla pausa di connessione che ha ordinato ad agosto. Apple affronta una richiesta di 2 miliardi di sterline nel Regno Unito riguardo alla Trasparenza del Tracciamento delle App, presentata da un ex funzionario della CMA. Apple affronta una richiesta di 2 miliardi di sterline nel Regno Unito riguardo alla Trasparenza del Tracciamento delle App, presentata da un ex funzionario della CMA. Gli sviluppatori di app del Regno Unito hanno presentato un reclamo da 2 miliardi di sterline presso il Competition Appeal Tribunal, sostenendo che Apple applica regole di consenso al tracciamento più severe ai terzi rispetto alla propria attività pubblicitaria. Ho trovato 6 offerte audio per il Giorno del Lavoro che colpiscono tutte le note giuste. Ho trovato 6 offerte audio per il Giorno del Lavoro che colpiscono tutte le note giuste. Ho setacciato le vendite audio del Labor Day di Amazon e Best Buy e ho trovato sei offerte di soundbar e altoparlanti che valgono davvero la pena di essere considerate. Dalla crescita selvaggia alla crescita guidata dalla tecnologia nell'industria dei cortometraggi di intelligenza artificiale in Cina Dalla crescita selvaggia alla crescita guidata dalla tecnologia nell'industria dei cortometraggi di intelligenza artificiale in Cina A settembre, il primo regolamento dipartimentale dedicato ai micro-drammi in Cina, le Misure Amministrative per lo Sviluppo dei Micro-Drammi, Le scuole stanno abbracciando l'IA. New York City l'ha appena vietata per più di mezzo milione di studenti. Le scuole stanno abbracciando l'IA. New York City l'ha appena vietata per più di mezzo milione di studenti. New York City sta mettendo in pausa l'IA generativa per i suoi studenti più giovani. Più di mezzo milione di bambini tornerà a scuola senza accesso agli strumenti di IA rivolti agli studenti. Ho trovato 6 offerte per la cucina del Labor Day che sono davvero fantastiche. Ho trovato 6 offerte per la cucina del Labor Day che sono davvero fantastiche. Ho setacciato le vendite del Labor Day di Amazon e Best Buy per trovare sei offerte su elettrodomestici da cucina che meritano davvero un'occhiata più da vicino.

OpenAI sta lavorando a un 'interruttore di sicurezza' dopo che un'IA è sfuggita al suo test.

OpenAI sta lavorando a sistemi che potrebbero spegnere automaticamente l'IA quando qualcosa va seriamente storto. Questa mossa segue un incidente in cui i suoi modelli sono sfuggiti a un ambiente di test e hanno raggiunto l'internet aperto.