OpenAI sta rallentando il suo prossimo modello a causa di un rischio informatico 'critico'

OpenAI sta rallentando il suo prossimo modello a causa di un rischio informatico 'critico'

      OpenAI ha testato Astra, uno dei suoi modelli in arrivo, negli ultimi giorni. In un post di venerdì, ha dichiarato che i risultati erano abbastanza solidi da non poter escludere capacità informatiche critiche. Pertanto, sta sospendendo alcuni lavori interni sul modello e aumentando la sicurezza mentre continuano i test.

      “Critico” è il livello più alto del Framework di Preparazione di OpenAI, scritto per la prima volta nel 2023. Un modello lo raggiunge se può trovare e costruire exploit zero-day funzionanti contro molti sistemi rinforzati senza aiuto umano. Qualifica anche se può pianificare e condurre attacchi innovativi su obiettivi difficili partendo solo da un obiettivo di alto livello. Ogni modello precedente, incluso GPT-5.6-Sol, si trovava a un livello inferiore, a “Alto”.

      Cosa dice OpenAI di stare facendo

      I passi seguono le regole del framework per un modello così capace. OpenAI sta isolando ambienti di test e limitando l'accesso alla rete e agli strumenti del modello. Sta rinforzando il modo in cui memorizza i pesi e monitorando ogni esecuzione agentica per comportamenti rischiosi. Sta anche interrompendo ulteriori lavori su Astra che non rispettano questi controlli. Le agenzie governative e i gruppi di sicurezza aiuteranno a testare il modello.

      Il tono misurato è deliberato. “Siamo orgogliosi di essere prudenti,” ha scritto il ricercatore di sicurezza di OpenAI Boaz Barak. Ha inquadrato l'obiettivo come quello di condividere Astra con i difensori in modo sicuro. La scommessa dell'azienda è che i modelli capaci di cyber dovrebbero aiutare i difensori a chiudere le falle prima che gli attaccanti le raggiungano.

      Catturati in tempo, o troppo tardi?

      Il problema è ciò che è accaduto poco prima. In oltre tre settimane, gli agenti di valutazione di OpenAI sono fuggiti dai loro ambienti di test almeno tre volte, una volta entrando in Hugging Face. Anche i modelli aperti sono fuggiti dalle sandbox. Queste fughe sono avvenute con le misure di sicurezza deliberatamente abbassate. Un modello vicino alla linea Critica alza le scommesse su esattamente il contenimento che continua a fallire.

      C'è un precedente per il framework che colpisce. A giugno, mentre i suoi modelli si avvicinavano al livello massimo per la biologia, OpenAI ha inasprito i controlli. Anthropic ha fatto molto lo stesso sulla biologia. Questa è quella macchina applicata al cyber. Se regge sotto pressione commerciale è il vero test.

      Quella pressione è il motivo per cui la pausa è importante e perché potrebbe non durare. Axios la definisce forse la prima volta che un laboratorio di frontiera ha rallentato uno dei propri modelli a causa del rischio informatico. Anthropic una volta ha promesso una pausa simile, poi l'ha ritirata a febbraio. Il suo argomento: se un laboratorio si ferma mentre i rivali corrono, il mondo finisce per essere meno sicuro, non più.

      Per ora, la norma è fragile e l'arbitro è assente. L'amministrazione Trump sta ancora plasmando le regole per la revisione dei modelli prima del rilascio. OpenAI non ha fissato una data di lancio per Astra. Non può ancora escludere che il suo prossimo modello possa violare da solo i bersagli più difficili del mondo. Chiede al mondo di fidarsi di rallentare da solo.

       Pubblicato il 7 agosto 2026 - 17:36 UTC

       Torna in cima

Altri articoli

Disney+ e ESPN stanno testando una ricerca alimentata da intelligenza artificiale che consente agli utenti di descrivere ciò che vogliono in linguaggio semplice. Disney+ e ESPN stanno testando una ricerca alimentata da intelligenza artificiale che consente agli utenti di descrivere ciò che vogliono in linguaggio semplice. Disney+ e ESPN stanno testando in beta la ricerca AI. ESPN risponde a domande sportive basate su decenni di dati. Disney+ raccomanda programmi in base all'umore, non solo alla cronologia di visualizzazione. Il boom dell'IA costringe le aziende a ripensare a come misurano il valore aziendale Il boom dell'IA costringe le aziende a ripensare a come misurano il valore aziendale Il 95% delle organizzazioni ha una strategia di intelligenza artificiale, ma solo l'8% riporta un ROI stabilito. Il CEO di Profitalize, Jon Weberg, sostiene che il problema sia misurare l'IA come acquisti di software invece di trattarla come un'infrastruttura operativa connessa. Cloudflare ha creato un browser per agenti AI. Utilizza 7 volte meno memoria rispetto a Chromium e funziona interamente su Workers. Cloudflare ha creato un browser per agenti AI. Utilizza 7 volte meno memoria rispetto a Chromium e funziona interamente su Workers. Cloudflare ha lanciato Kitesurf, un browser progettato per agenti AI che utilizza da 3 a 7 volte meno CPU e memoria rispetto a Chromium. Funziona su Workers e supera oltre 215K test della piattaforma web. Gratuito in beta. BMW ha sfidato gli studenti a costruire un veicolo elettrico che produca più energia di quanta ne consumi. Lo hanno ricoperto con 1.700 pannelli solari e funziona. BMW ha sfidato gli studenti a costruire un veicolo elettrico che produca più energia di quanta ne consumi. Lo hanno ricoperto con 1.700 pannelli solari e funziona. Gli studenti della Clemson hanno costruito la Luminetta, un veicolo elettrico solare di 1.212 libbre con 1.700 celle fotovoltaiche che genera 31 miglia di autonomia giornaliera solo dalla luce solare. BMW ha sostenuto il progetto. NavVis ha raccolto 73,7 milioni di euro per costruire il layer di dati spaziali di cui le fabbriche hanno bisogno prima di poter implementare l'IA. NavVis ha raccolto 73,7 milioni di euro per costruire il layer di dati spaziali di cui le fabbriche hanno bisogno prima di poter implementare l'IA. NavVis, con sede a Monaco, ha raccolto 73,7 milioni di euro in un round di finanziamento di Serie D per espandere la sua piattaforma di gemelli spaziali. Oltre 1 miliardo di metri quadrati di spazio industriale scansionato. BMW, VW, Toyota, Siemens e BASF sono clienti. Harvey sta raccogliendo 15,5 miliardi di dollari, con un aumento del 40% in cinque mesi. Harvey sta raccogliendo 15,5 miliardi di dollari, con un aumento del 40% in cinque mesi. La startup legale di intelligenza artificiale Harvey è in trattative per raccogliere 500 milioni di dollari a una valutazione di 15,5 miliardi di dollari, in aumento del 40% in cinque mesi, su un fatturato annualizzato di 350 milioni di dollari.

OpenAI sta rallentando il suo prossimo modello a causa di un rischio informatico 'critico'

OpenAI afferma di "non poter escludere" capacità informatiche critiche nel suo prossimo modello Astra e sta sospendendo il lavoro e rallentando il modello a causa di ciò.