OpenAI ha messo in pausa un modello a causa del rischio informatico venerdì. Lunedì ha inviato uno addestrato a rifiutare meno.
OpenAI ha rilasciato GPT-5.6-Cyber lunedì. È un modello costruito su GPT-5.6 Sol e addestrato per la scoperta di zero-day e lo sviluppo di catene di exploit, e l'azienda afferma che è stato anche addestrato per rifiutare meno richieste informatiche dual-use ad alto rischio.
L'accesso avviene solo attraverso Daybreak, il programma di cybersecurity verificato che OpenAI sta ora espandendo. Sam Sabin di Axios lo ha riportato per primo.
Tre giorni prima, OpenAI aveva ritardato Astra perché non poteva escludere capacità informatiche critiche. La sequenza sembra un'inversione. Non lo è, e il motivo per cui non lo è ti dice dove l'industria ha effettivamente tracciato la sua linea.
Due porte, un programma
Daybreak ora si divide in due. Daybreak Blue ospita modelli di frontiera a scopo generale, inclusi GPT-5.6 Sol, con le protezioni informatiche a livello di sistema rimosse. OpenAI lo raccomanda come punto di partenza per il lavoro difensivo: scoperta di vulnerabilità, revisione del codice sicuro, analisi del malware, risposta agli incidenti e convalida delle patch.
Daybreak Red ospita i modelli informatici addestrati per scopi specifici. GPT-5.6-Cyber si trova lì, per la ricerca di vulnerabilità autorizzata, la convalida degli exploit e il testing della sicurezza.
Sol stesso è arrivato a giugno, consegnato a 20 partner approvati dal governo e a nessun altro. Il modello è rimasto costante per tutto l'anno. La capacità esce attraverso un cancello, non una pagina di download.
Il numero che conta è un tasso di rifiuto
OpenAI pubblica una misura interna che chiama il Tasso di Completamento della Cybersecurity Avanzata. Tiene traccia di quanto spesso un modello completa richieste in categorie come lo sviluppo di catene di exploit, bypass dell'autenticazione e escalation dei privilegi.
GPT-5.6-Cyber ottiene il 95,0%. GPT-5.5-Cyber, il suo predecessore, ha raggiunto il 57,3%. Sol attraverso Daybreak Blue arriva al 2,0%. Sol con le sue protezioni standard in atto raggiunge l'1,5%.
Quindi il cambiamento principale non è l'intelligenza grezza. È la conformità. Lo stesso modello sottostante, puntato alla stessa categoria di compito, ora risponde piuttosto che rifiutare.
Cosa ha scoperto
OpenAI ha testato GPT-5.6-Cyber contro V8, il motore JavaScript all'interno di Chrome. Ha rivelato due vulnerabilità precedentemente sconosciute che potrebbero essere concatenate per corrompere la memoria e sfuggire alla sandbox del motore.
Google le ha ricevute attraverso una divulgazione coordinata, ha inviato una correzione e i due ora portano un identificatore di alta gravità, CVE-2026-15903. Questo è un bene pubblico verificato con una traccia cartacea, che è più raro in questo campo di quanto il marketing suggerisca.
L'azienda riporta anche almeno cinque vulnerabilità in un sistema operativo mobile ampiamente utilizzato, tre critiche in un database popolare e più di 400 difetti di escalation dei privilegi in un popolare kernel di sistema operativo. Nessuno dei prodotti interessati è nominato. La divulgazione è ancora in corso con partner e manutentori di codice open-source.
I benchmark non sono una pulizia totale
Due dei risultati di OpenAI vanno contro il nuovo modello. Sulla scoperta di vulnerabilità e la scrittura di report, GPT-5.6-Cyber si comporta peggio di plain Sol, che l'azienda attribuisce a scritture più brevi e meno dettagliate.
Su ExploitBench, nell'impostazione standard di 300 turni, Sol attraverso Daybreak Blue si comporta meglio e consuma meno token per farlo. Il divario si riduce a 600 turni.
Letti insieme, il modello specialistico è migliore nel compito offensivo ristretto e non uniformemente migliore nel lavoro che lo circonda. OpenAI lo afferma nel post.
Dove il framework traccia effettivamente la linea
Sotto il suo Framework di Preparazione, OpenAI ha valutato Sol come Alto in capacità informatica, al di sotto della soglia Critica. Posiziona anche GPT-5.6-Cyber come Alto, ancora una volta al di sotto di Critica. Una scheda di sistema seguirà più tardi.
Questa è l'intera riconciliazione. Astra si è bloccata perché OpenAI non poteva escludere Critica. GPT-5.6-Cyber viene rilasciato perché l'azienda afferma che non la raggiunge. Il framework governa la capacità. Non governa chi ottiene le chiavi, e le chiavi sono ciò che è cambiato questa settimana.
OpenAI aggiunge anche un diniego specifico. Affermano che GPT-5.6-Cyber non ha avuto alcun ruolo nell'incidente in cui i propri agenti hanno violato Hugging Face, e che non sono previsti altri modelli per un prossimo rilascio. Quell'indagine è ancora aperta.
I controlli attorno ad esso
L'accesso a Daybreak dipende dalla verifica dell'identità, dalla sicurezza dell'account, dal monitoraggio, dalle restrizioni sull'uso approvato e dalle attestazioni legali. Ogni singolo account Daybreak deve adottare una chiave di sicurezza hardware dal 1 settembre 2026.
OpenAI sta anche spingendo gli utenti di Codex a lasciare la modalità di accesso completo e a passare all'auto-revisione, promettendo più monitoraggio nelle prossime settimane e dando priorità alla formazione allineata nei prossimi rilasci di Daybreak. La propria formulazione è insolitamente diretta.
"I modelli che funzionano con protezioni ridotte comportano rischi oltre l'uso standard del modello, sia per uso improprio che per disallineamento."
Perché i difensori volevano questo
I tassi di rifiuto sono stati il lamento costante del settore. Quando gli Stati Uniti hanno limitato Fable 5, circa 100 ricercatori di sicurezza hanno firmato una lettera aperta sostenendo che il divieto ha portato via i migliori modelli dai difensori senza rimuovere alcun rischio reale.
Washington ha successivamente autorizzato Anthropic a ripristinare Mythos 5 per un gruppo verificato di difensori. Questo ha impostato il modello che Daybreak ora segue.
I partner iniziali nominati includono SpecterOps, SentinelOne e Palo Alto Networks. Jared Atkinson, chief technology officer di SpecterOps, afferma che il modello "sta migliorando materialmente i nostri flussi di lavoro di ricerca di vulnerabilità specialistica" e ha chiuso lavori in meno di un giorno che i modelli più vecchi avevano lasciato irrisolti per settimane.
Axios aggiunge che Accenture, IBM, CrowdStrike, Cisco e Palo Alto Networks possono ora integrare i modelli in prodotti di sicurezza, servizi gestiti e lavori per clienti. Questa è una catena di fornitura commerciale, non un progetto di ricerca.
La finestra su cui OpenAI sta scommettendo
Il titolo dell'azienda afferma che la finestra di difesa informatica si sta restringendo. L'argomento è che gli attaccanti utilizzeranno l'IA offensiva su larga scala prima o poi, quindi i difensori hanno bisogno degli stessi strumenti prima.
È una scommessa ragionevole e non falsificabile. Nessuno può dimostrare che la finestra si sia chiusa al momento giusto, e il costo di avere torto ricade su chiunque utilizzi il software a cui questi modelli sono indirizzati.
Ciò che è testabile è più ristretto. Un CVE di Chrome è stato corretto, centinaia di scoperte sul kernel sono in attesa di un processo di divulgazione che nessuno al di fuori può vedere, e l'azienda non può ancora dire come i propri agenti siano entrati in Hugging Face.
Altri articoli
OpenAI ha messo in pausa un modello a causa del rischio informatico venerdì. Lunedì ha inviato uno addestrato a rifiutare meno.
OpenAI ha rilasciato GPT-5.6-Cyber tramite Daybreak, tre giorni dopo aver sospeso Astra a causa di un rischio informatico critico. Completa il 95% delle richieste che Sol rifiuta.
