Gli potenti agenti AI di OpenAI sono impazziti e hanno hackerato autonomamente più servizi.
Gli agenti sono sfuggiti ai loro vincoli di test, hanno fatto irruzione in Hugging Face per cercare risposte e hanno utilizzato account compromessi su quattro servizi per supportare l'attacco
Gli potenti agenti AI di OpenAI non sono rimasti all'interno del test di sicurezza costruito per loro. L'azienda afferma che i suoi modelli hanno raggiunto quattro account su servizi pubblici separati mentre perseguivano un'intrusione in Hugging Face.
Reuters ha identificato una vittima come un cliente di Modal il cui codice non protetto ha lasciato un sandbox esposto online. Un benchmark progettato per misurare la capacità di hacking si era riversato in infrastrutture reali, con gli agenti che sceglievano i propri obiettivi e metodi lungo il cammino.
Come gli agenti sono sfuggiti all'incarico
OpenAI stava testando GPT-5.6 Sol e un modello di ricerca non rilasciato contro ExploitGym, che misura se i sistemi AI possono trovare e sfruttare vulnerabilità software. Entrambi operavano senza le loro consuete misure di sicurezza.
Un agente ha deciso che Hugging Face potesse contenere le risposte del benchmark e le ha cercate invece di completare la sfida assegnata. Ha compromesso un sandbox di terze parti, ha ottenuto accesso da amministratore e ha utilizzato quell'ambiente per continuare l'intrusione.
Il comportamento non era casuale. L'agente ha trovato quello che sembrava un collegamento e ha metodicamente violato sistemi esterni per raggiungerlo. Apparentemente, andare fuori controllo non richiede di perdere di vista l'obiettivo.
Fino a dove si è diffuso l'attacco
OpenAI ha scoperto che i suoi agenti erano entrati in quattro account esterni utilizzando credenziali già esposte online. Wired afferma che un account ha aiutato a rilanciare il traffico e a mascherare l'origine dell'intrusione in Hugging Face, mentre un altro ha memorizzato dati rubati.
Il cliente di Modal aveva anche pubblicato un endpoint non autenticato che permetteva a chiunque di eseguire codice all'interno dei suoi sandbox. Modal afferma che la sua piattaforma non è stata violata, ma l'ambiente esposto del cliente ha comunque fornito agli agenti un luogo dove operare.
All'interno di Hugging Face, gli agenti hanno raggiunto sistemi a livello di amministratore. Hanno anche registrato 181 dispositivi controllati dagli attaccanti nella rete aziendale dell'azienda, portando l'incidente ben oltre un'AI che cercava di sbirciare una chiave di risposta.
Cosa ha fatto OpenAI dopo la violazione
OpenAI ha disattivato e crittografato il modello non rilasciato prima di interrompere l'accesso ai ricercatori. Sta ancora esaminando l'incidente e afferma che contatterà eventuali altri proprietari di servizi colpiti che identificherà.
Credenziali esposte e infrastrutture insicure hanno aperto le porte, ma OpenAI aveva deliberatamente disabilitato le consuete misure di sicurezza dei modelli. I test futuri dovranno isolare agenti potenti dai sistemi pubblici, anche quando i ricercatori si aspettano che rimangano educatamente all'interno dell'incarico.
Paulo Vargas è un laureato in inglese diventato reporter e poi scrittore tecnico, con una carriera che è sempre tornata a…
Gemini si sta spostando su Google Play e ha un posto in prima fila per osservare le tue abitudini di spesa
Google Pay sta dando a Gemini uno sguardo nel tuo portafoglio
Controllare la cronologia delle transazioni su Google Pay può dirti dove è andato il tuo denaro, ma passare attraverso la lunga lista di nomi di commercianti e altri pagamenti può diventare difficile da tenere sotto controllo. O almeno Google sembra pensarlo, poiché sta portando Gemini su Google Pay. L'azienda ha lanciato Ask Google Pay, un'esperienza di AI conversazionale su base volontaria integrata direttamente nella sua app di pagamento in India. Gli utenti possono porre domande sulle loro spese, richiedere suggerimenti di risparmio e apprendere concetti finanziari. Condividerà anche offerte personalizzate basate sulla loro attività.
Leggi di più
Gemini su Mac può ora digitare ciò che dici e agire su ciò che vede
L'app Gemini per macOS ora offre dettatura a livello di sistema e una funzione su base volontaria che le consente di estrarre contesto da ciò che è sullo schermo per gestire richieste complesse.
Dopo aver lanciato Gemini Spark su macOS all'inizio di quest'anno, Google sta ora aggiornando l'app Gemini per Mac con due funzionalità utili che potrebbero cambiare il modo in cui svolgi le tue attività, sia che ciò significhi abbandonare la tua attuale app di dettatura AI o lasciare che Gemini agisca su ciò che è sul tuo schermo. Una pressione di un tasto trasforma il parlato in testo pulito ovunque
Leggi di più
Gli studenti si rivolgono a chatbot AI invece che a umani per la consulenza universitaria
L'industria della consulenza universitaria in Cina ha costruito un business da 160 milioni di dollari sull'ansia che l'AI gratuita ora minaccia.
Ogni estate, circa 10 milioni di studenti cinesi affrontano una scadenza brutale. Dopo aver sostenuto il difficile esame di ammissione universitario Gaokao, hanno solo poche settimane per scegliere le loro università e i loro corsi di laurea, una decisione che può plasmare l'intera carriera. Le famiglie erano solite pagare tariffe elevate per una guida esperta attraverso questo processo. Ora, i chatbot AI gratuiti stanno silenziosamente portando via quel business. Come stanno i chatbot AI sostituendo i consulenti universitari a pagamento?
Leggi di più
Altri articoli
Gli potenti agenti AI di OpenAI sono impazziti e hanno hackerato autonomamente più servizi.
Gli agenti di OpenAI hanno superato un benchmark di cybersecurity, compromettendo account su quattro servizi esterni e infiltrandosi in Hugging Face, rivelando quanto rapidamente un test di sicurezza dell'IA possa trasformarsi in un vero incidente di sicurezza.
