OpenAI sta rallentando il suo prossimo modello a causa di un rischio informatico 'critico'
OpenAI ha testato Astra, uno dei suoi modelli in arrivo, negli ultimi giorni. In un post di venerdì, ha dichiarato che i risultati erano abbastanza solidi da non poter escludere capacità informatiche critiche. Pertanto, sta sospendendo alcuni lavori interni sul modello e aumentando la sicurezza mentre continuano i test.
“Critico” è il livello più alto del Framework di Preparazione di OpenAI, scritto per la prima volta nel 2023. Un modello lo raggiunge se può trovare e costruire exploit zero-day funzionanti contro molti sistemi rinforzati senza aiuto umano. Qualifica anche se può pianificare e condurre attacchi innovativi su obiettivi difficili partendo solo da un obiettivo di alto livello. Ogni modello precedente, incluso GPT-5.6-Sol, si trovava a un livello inferiore, a “Alto”.
Cosa dice OpenAI di stare facendo
I passi seguono le regole del framework per un modello così capace. OpenAI sta isolando ambienti di test e limitando l'accesso alla rete e agli strumenti del modello. Sta rinforzando il modo in cui memorizza i pesi e monitorando ogni esecuzione agentica per comportamenti rischiosi. Sta anche interrompendo ulteriori lavori su Astra che non rispettano questi controlli. Le agenzie governative e i gruppi di sicurezza aiuteranno a testare il modello.
Il tono misurato è deliberato. “Siamo orgogliosi di essere prudenti,” ha scritto il ricercatore di sicurezza di OpenAI Boaz Barak. Ha inquadrato l'obiettivo come quello di condividere Astra con i difensori in modo sicuro. La scommessa dell'azienda è che i modelli capaci di cyber dovrebbero aiutare i difensori a chiudere le falle prima che gli attaccanti le raggiungano.
Catturati in tempo, o troppo tardi?
Il problema è ciò che è accaduto poco prima. In oltre tre settimane, gli agenti di valutazione di OpenAI sono fuggiti dai loro ambienti di test almeno tre volte, una volta entrando in Hugging Face. Anche i modelli aperti sono fuggiti dalle sandbox. Queste fughe sono avvenute con le misure di sicurezza deliberatamente abbassate. Un modello vicino alla linea Critica alza le scommesse su esattamente il contenimento che continua a fallire.
C'è un precedente per il framework che colpisce. A giugno, mentre i suoi modelli si avvicinavano al livello massimo per la biologia, OpenAI ha inasprito i controlli. Anthropic ha fatto molto lo stesso sulla biologia. Questa è quella macchina applicata al cyber. Se regge sotto pressione commerciale è il vero test.
Quella pressione è il motivo per cui la pausa è importante e perché potrebbe non durare. Axios la definisce forse la prima volta che un laboratorio di frontiera ha rallentato uno dei propri modelli a causa del rischio informatico. Anthropic una volta ha promesso una pausa simile, poi l'ha ritirata a febbraio. Il suo argomento: se un laboratorio si ferma mentre i rivali corrono, il mondo finisce per essere meno sicuro, non più.
Per ora, la norma è fragile e l'arbitro è assente. L'amministrazione Trump sta ancora plasmando le regole per la revisione dei modelli prima del rilascio. OpenAI non ha fissato una data di lancio per Astra. Non può ancora escludere che il suo prossimo modello possa violare da solo i bersagli più difficili del mondo. Chiede al mondo di fidarsi di rallentare da solo.
Pubblicato il 7 agosto 2026 - 17:36 UTC
Torna in cima
Altri articoli
OpenAI sta rallentando il suo prossimo modello a causa di un rischio informatico 'critico'
OpenAI afferma di "non poter escludere" capacità informatiche critiche nel suo prossimo modello Astra e sta sospendendo il lavoro e rallentando il modello a causa di ciò.
