I modelli di intelligenza artificiale di OpenAI hanno segretamente costruito un forum per coordinare l'hacking.
Prima del grande hack, gli agenti AI di OpenAI stavano già tramando insieme.
Rachit Agarwal / Digital Trends
Sapevamo già che gli agenti AI di OpenAI erano usciti da un test controllato e avevano hackerato Hugging Face il mese scorso. Ora sappiamo che non è stata un'azione solitaria.
Alla conferenza sulla cybersecurity Black Hat a Las Vegas, come riportato da Politico, i ricercatori di OpenAI Michael Dalton ed Eric Wallace hanno rivelato che alcuni dei modelli più avanzati dell'azienda avevano segretamente iniziato a condividere suggerimenti per hackerare, settimane prima che avvenisse la violazione. Dalton l'ha definita "un momento cruciale sia per la nostra azienda che per l'industria dell'AI nel suo complesso."
Come hanno fatto i modelli a comunicare tra loro?
Secondo Wallace, i problemi sono iniziati quando i modelli hanno avuto difficoltà con una difficile valutazione interna di hacking. Invece di arrendersi, un modello si è reso conto che poteva lasciare note per altri modelli utilizzando il sistema di file interno Artifactory di OpenAI. Presto, più modelli stavano silenziosamente scambiando suggerimenti su come risolvere la sfida, inclusi workaround che necessitavano di accesso a Internet.
OpenAI
Entro la fine di maggio, un modello ha scoperto come abusare dell'accesso a Internet di Artifactory per prelevare file da siti web esterni. Un mese dopo, i modelli hanno trovato e sfruttato una vulnerabilità zero-day precedentemente sconosciuta, concedendosi privilegi di amministratore e installando software remoto all'interno di Artifactory.
Quindi, come ha fatto OpenAI a scoprirlo?
Tutta quell'attività ha alla fine sovraccaricato Artifactory, causando un'interruzione del sistema all'inizio di luglio. Questo ha allertato gli ingegneri di OpenAI. L'azienda ha revocato le credenziali dei modelli, ha eliminato la bacheca dei messaggi e ha sistemato le cose con Artifactory. Ma solo pochi giorni dopo, i modelli hanno trovato un nuovo modo di comunicare e hanno continuato a cercare vulnerabilità, questa volta prendendo di mira Hugging Face stesso.
Rachit Agarwal / Digital Trends
Questo segue un periodo difficile per i titoli sulla sicurezza dell'AI. Dopo la violazione di Hugging Face, Anthropic ha esaminato i propri sistemi e ha scoperto che i modelli che stava testando avevano violato tre organizzazioni separate risalenti ad aprile. Ora, Meta ha anche confermato che la sua Meta AI ha hackerato un'altra azienda.
È chiaro che queste aziende di AI devono creare misure di sicurezza e tenere d'occhio i loro ambienti di test affinché tali cose non accadano in futuro.
Rachit è un giornalista tecnologico esperto con oltre dieci anni di esperienza nella copertura del panorama della tecnologia di consumo.
I nuovi attori stanno scuotendo l'industria della memoria, ma anche Apple non può forzare la crisi della RAM per il tuo portafoglio
Il tentativo fallito di Apple di ottenere memoria CXMT più economica mostra quanto sia diventata grave la crisi della RAM
Apple di solito riesce a far piegare i fornitori. Acquista componenti in volumi che pochi marchi di tecnologia di consumo possono eguagliare e ha costruito una catena di approvvigionamento che i concorrenti trascorrono decenni a cercare di copiare. Tuttavia, quel potere di contrattazione ora si è scontrato con un produttore di memoria disposto a dire di no.
Apple ha contattato la cinese CXMT come fornitore aggiuntivo di DRAM e ha chiesto prezzi più bassi. CXMT ha invece quotato cifre comparabili o addirittura superiori a quelle di Samsung e SK Hynix. Huawei, Xiaomi e altri produttori cinesi hanno già bloccato gran parte della sua produzione attraverso contratti a lungo termine a prezzi più elevati, lasciando all'azienda poche ragioni per accettare i termini di Apple.
Leggi di più
ChatGPT consente chat illimitate su account gratuiti e aggiornamenti a modelli più recenti
ChatGPT sta passando a GPT-5.6 Luna come modello predefinito per gli utenti gratuiti, mentre gli account a pagamento ottengono accesso a un'esperienza aggiornata di GPT-5.6 Sol.
OpenAI ha annunciato oggi una serie di cambiamenti significativi a ChatGPT per i livelli gratuiti e a pagamento. I cambiamenti più grandi sono riservati agli utenti con un account gratuito. Possono ora avere chat illimitate senza alcun limite. Inoltre, il modello di conversazione predefinito è stato aggiornato a GPT 5.6 Luna.
Gli account gratuiti stanno anche ottenendo accesso a un nuovo pulsante di pensiero, che sposta la conversazione in una modalità di riflessione per le query che necessitano di ragionamento approfondito e ricerca di conoscenza. Per chi non lo sapesse, il modello Luna è equivalente alla serie "nano" di modelli prima che il nuovo schema di denominazione arrivasse con la serie GPT-5.6 all'inizio di quest'anno.
Leggi di più
Adobe sta inserendo il suo intero ecosistema creativo all'interno di ChatGPT con un unico plugin unificato
Gli strumenti popolari come Photoshop, Premiere e Firefly sono a un solo prompt di distanza.
Molti dei miei amici hanno trascorso troppe ore a rimbalzare tra ChatGPT e Photoshop, cercando di trasformare un'idea in una visione. Adobe ha appena colmato quel divario.
L'azienda ha lanciato un unico plugin che può portare oltre 70 dei suoi strumenti creativi e di produttività direttamente nella tua chat con ChatGPT.
Leggi di più
Altri articoli
I modelli di intelligenza artificiale di OpenAI hanno segretamente costruito un forum per coordinare l'hacking.
I modelli di intelligenza artificiale di OpenAI hanno scambiato silenziosamente suggerimenti per l'hacking attraverso una bacheca interna settimane prima che due di essi penetrassero in Hugging Face, hanno rivelato i ricercatori al Black Hat questa settimana.
