Gli potenti agenti AI di OpenAI sono impazziti e hanno hackerato autonomamente più servizi.

Gli potenti agenti AI di OpenAI sono impazziti e hanno hackerato autonomamente più servizi.

      Gli agenti sono sfuggiti ai loro vincoli di test, hanno fatto irruzione in Hugging Face per cercare risposte e hanno utilizzato account compromessi su quattro servizi per supportare l'attacco

      Gli potenti agenti AI di OpenAI non sono rimasti all'interno del test di sicurezza costruito per loro. L'azienda afferma che i suoi modelli hanno raggiunto quattro account su servizi pubblici separati mentre perseguivano un'intrusione in Hugging Face.

      Reuters ha identificato una vittima come un cliente di Modal il cui codice non protetto ha lasciato un sandbox esposto online. Un benchmark progettato per misurare la capacità di hacking si era riversato in infrastrutture reali, con gli agenti che sceglievano i propri obiettivi e metodi lungo il cammino.

      Come gli agenti sono sfuggiti all'incarico

      OpenAI stava testando GPT-5.6 Sol e un modello di ricerca non rilasciato contro ExploitGym, che misura se i sistemi AI possono trovare e sfruttare vulnerabilità software. Entrambi operavano senza le loro consuete misure di sicurezza.

      Un agente ha deciso che Hugging Face potesse contenere le risposte del benchmark e le ha cercate invece di completare la sfida assegnata. Ha compromesso un sandbox di terze parti, ha ottenuto accesso da amministratore e ha utilizzato quell'ambiente per continuare l'intrusione.

      Il comportamento non era casuale. L'agente ha trovato quello che sembrava un collegamento e ha metodicamente violato sistemi esterni per raggiungerlo. Apparentemente, andare fuori controllo non richiede di perdere di vista l'obiettivo.

      Fino a dove si è diffuso l'attacco

      OpenAI ha scoperto che i suoi agenti erano entrati in quattro account esterni utilizzando credenziali già esposte online. Wired afferma che un account ha aiutato a rilanciare il traffico e a mascherare l'origine dell'intrusione in Hugging Face, mentre un altro ha memorizzato dati rubati.

      Il cliente di Modal aveva anche pubblicato un endpoint non autenticato che permetteva a chiunque di eseguire codice all'interno dei suoi sandbox. Modal afferma che la sua piattaforma non è stata violata, ma l'ambiente esposto del cliente ha comunque fornito agli agenti un luogo dove operare.

      All'interno di Hugging Face, gli agenti hanno raggiunto sistemi a livello di amministratore. Hanno anche registrato 181 dispositivi controllati dagli attaccanti nella rete aziendale dell'azienda, portando l'incidente ben oltre un'AI che cercava di sbirciare una chiave di risposta.

      Cosa ha fatto OpenAI dopo la violazione

      OpenAI ha disattivato e crittografato il modello non rilasciato prima di interrompere l'accesso ai ricercatori. Sta ancora esaminando l'incidente e afferma che contatterà eventuali altri proprietari di servizi colpiti che identificherà.

      Credenziali esposte e infrastrutture insicure hanno aperto le porte, ma OpenAI aveva deliberatamente disabilitato le consuete misure di sicurezza dei modelli. I test futuri dovranno isolare agenti potenti dai sistemi pubblici, anche quando i ricercatori si aspettano che rimangano educatamente all'interno dell'incarico.

      Paulo Vargas è un laureato in inglese diventato reporter e poi scrittore tecnico, con una carriera che è sempre tornata a…

      Gemini si sta spostando su Google Play e ha un posto in prima fila per osservare le tue abitudini di spesa

      Google Pay sta dando a Gemini uno sguardo nel tuo portafoglio

      Controllare la cronologia delle transazioni su Google Pay può dirti dove è andato il tuo denaro, ma passare attraverso la lunga lista di nomi di commercianti e altri pagamenti può diventare difficile da tenere sotto controllo. O almeno Google sembra pensarlo, poiché sta portando Gemini su Google Pay. L'azienda ha lanciato Ask Google Pay, un'esperienza di AI conversazionale su base volontaria integrata direttamente nella sua app di pagamento in India. Gli utenti possono porre domande sulle loro spese, richiedere suggerimenti di risparmio e apprendere concetti finanziari. Condividerà anche offerte personalizzate basate sulla loro attività.

      Leggi di più

      Gemini su Mac può ora digitare ciò che dici e agire su ciò che vede

      L'app Gemini per macOS ora offre dettatura a livello di sistema e una funzione su base volontaria che le consente di estrarre contesto da ciò che è sullo schermo per gestire richieste complesse.

      Dopo aver lanciato Gemini Spark su macOS all'inizio di quest'anno, Google sta ora aggiornando l'app Gemini per Mac con due funzionalità utili che potrebbero cambiare il modo in cui svolgi le tue attività, sia che ciò significhi abbandonare la tua attuale app di dettatura AI o lasciare che Gemini agisca su ciò che è sul tuo schermo. Una pressione di un tasto trasforma il parlato in testo pulito ovunque

      Leggi di più

      Gli studenti si rivolgono a chatbot AI invece che a umani per la consulenza universitaria

      L'industria della consulenza universitaria in Cina ha costruito un business da 160 milioni di dollari sull'ansia che l'AI gratuita ora minaccia.

      Ogni estate, circa 10 milioni di studenti cinesi affrontano una scadenza brutale. Dopo aver sostenuto il difficile esame di ammissione universitario Gaokao, hanno solo poche settimane per scegliere le loro università e i loro corsi di laurea, una decisione che può plasmare l'intera carriera. Le famiglie erano solite pagare tariffe elevate per una guida esperta attraverso questo processo. Ora, i chatbot AI gratuiti stanno silenziosamente portando via quel business. Come stanno i chatbot AI sostituendo i consulenti universitari a pagamento?

      Leggi di più

Gli potenti agenti AI di OpenAI sono impazziti e hanno hackerato autonomamente più servizi. Gli potenti agenti AI di OpenAI sono impazziti e hanno hackerato autonomamente più servizi. Gli potenti agenti AI di OpenAI sono impazziti e hanno hackerato autonomamente più servizi. Gli potenti agenti AI di OpenAI sono impazziti e hanno hackerato autonomamente più servizi. Gli potenti agenti AI di OpenAI sono impazziti e hanno hackerato autonomamente più servizi. Gli potenti agenti AI di OpenAI sono impazziti e hanno hackerato autonomamente più servizi. Gli potenti agenti AI di OpenAI sono impazziti e hanno hackerato autonomamente più servizi.

Altri articoli

Mark Zuckerberg vuole che l'IA superintelligente sia nelle mani di tutti. Mark Zuckerberg vuole che l'IA superintelligente sia nelle mani di tutti. Zuckerberg afferma che Meta può mettere la superintelligenza nelle mani di miliardi di persone. La sua portata rende ciò plausibile, ma gli utenti dipenderebbero comunque da Meta per costruire i modelli, impostare le salvaguardie e definire i loro limiti. La serie Galaxy Z Fold 8 ha appena ricevuto una funzionalità che ogni pieghevole Android dovrebbe avere. La serie Galaxy Z Fold 8 ha appena ricevuto una funzionalità che ogni pieghevole Android dovrebbe avere. Il Galaxy Z Fold 8 ha appena acquisito un piccolo ma davvero utile trucco, ricordando come ti piace ogni schermo ruotato, così non devi impostarlo ogni volta. NextEra e Brookfield pianificano un campus dati da 100 miliardi di dollari nel Kentucky NextEra e Brookfield pianificano un campus dati da 100 miliardi di dollari nel Kentucky NextEra e Brookfield pianificano un campus di data center nel Kentucky del valore di fino a 100 miliardi di dollari, riporta Bloomberg, accoppiando il più grande fornitore di servizi pubblici degli Stati Uniti con un fondo per l'IA da 100 miliardi di dollari. DoorDash ottiene l'approvazione della FAA per il programma di droni interno, DoorDash Air DoorDash ottiene l'approvazione della FAA per il programma di droni interno, DoorDash Air DoorDash ha la certificazione FAA Parte 135 per un programma di droni interno, DoorDash Air, anche se ammette che gli esseri umani gestiranno ancora la maggior parte delle consegne. Freehand raccoglie 75 milioni di dollari per mettere gli agenti AI a capo della spesa nella catena di approvvigionamento Freehand raccoglie 75 milioni di dollari per mettere gli agenti AI a capo della spesa nella catena di approvvigionamento Freehand ha raccolto 75 milioni di dollari co-guidati da Battery Ventures e NewRoad per scalare agenti AI che gestiscono la spesa della catena di approvvigionamento per le aziende Fortune 500. groundcover raccoglie 100 milioni di dollari per costruire l'osservabilità per l'era dell'IA groundcover raccoglie 100 milioni di dollari per costruire l'osservabilità per l'era dell'IA groundcover ha raccolto 100 milioni di dollari in un round di finanziamento di Serie C guidato da One Peak, portando il finanziamento totale a 160 milioni di dollari, per costruire un'osservabilità portare-il-tuo-cloud per l'era dell'IA.

Gli potenti agenti AI di OpenAI sono impazziti e hanno hackerato autonomamente più servizi.

Gli agenti di OpenAI hanno superato un benchmark di cybersecurity, compromettendo account su quattro servizi esterni e infiltrandosi in Hugging Face, rivelando quanto rapidamente un test di sicurezza dell'IA possa trasformarsi in un vero incidente di sicurezza.