OpenAI ha sospeso un modello a causa del rischio informatico venerdì. Lunedì ha inviato uno addestrato a rifiutare di meno.

OpenAI ha sospeso un modello a causa del rischio informatico venerdì. Lunedì ha inviato uno addestrato a rifiutare di meno.

      OpenAI ha rilasciato GPT-5.6-Cyber lunedì. È un modello costruito su GPT-5.6 Sol e addestrato per la scoperta di zero-day e lo sviluppo di catene di exploit, e l'azienda afferma che è stato anche addestrato per rifiutare meno richieste informatiche dual-use ad alto rischio. L'accesso avviene solo attraverso Daybreak, il programma di cybersecurity verificato che OpenAI sta ora espandendo. Sam Sabin di Axios lo ha riportato per primo. Tre giorni prima, OpenAI aveva ritardato Astra perché non poteva escludere capacità informatiche critiche. La sequenza sembra una inversione. Non lo è, e il motivo per cui non lo è ti dice dove l'industria ha effettivamente tracciato la sua linea. Due porte, un programma Daybreak ora si divide in due. Daybreak Blue trasporta modelli di frontiera a scopo generale, incluso GPT-5.6 Sol, con le protezioni informatiche a livello di sistema rimosse. OpenAI lo raccomanda come punto di partenza per il lavoro difensivo: scoperta di vulnerabilità, revisione del codice sicuro, analisi malware, risposta agli incidenti e validazione delle patch. Daybreak Red trasporta i modelli informatici addestrati per scopi specifici. GPT-5.6-Cyber si trova lì, per la ricerca di vulnerabilità autorizzata, la validazione degli exploit e il testing della sicurezza. Sol stesso è arrivato a giugno, consegnato a 20 partner approvati dal governo e a nessun altro. Il modello è rimasto costante per tutto l'anno. La capacità esce attraverso un cancello, non una pagina di download. Il numero che conta è un tasso di rifiuto OpenAI pubblica una misura interna che chiama il Tasso di Completamento della Cybersecurity Avanzata. Tiene traccia di quanto spesso un modello completa richieste in categorie come lo sviluppo di catene di exploit, bypass dell'autenticazione e escalation dei privilegi. GPT-5.6-Cyber ottiene il 95,0%. GPT-5.5-Cyber, il suo predecessore, ha ottenuto il 57,3%. Sol attraverso Daybreak Blue raggiunge il 2,0%. Sol con le sue protezioni standard in atto raggiunge l'1,5%. Quindi il cambiamento principale non è l'intelligenza grezza. È la conformità. Lo stesso modello sottostante, puntato alla stessa categoria di compito, ora risponde invece di rifiutare. Cosa ha rivelato OpenAI ha eseguito GPT-5.6-Cyber contro V8, il motore JavaScript all'interno di Chrome. Ha rivelato due vulnerabilità precedentemente sconosciute che potrebbero essere concatenate per corrompere la memoria e sfuggire alla sandbox del motore. Google le ha ricevute attraverso una divulgazione coordinata, ha inviato una correzione e i due ora portano un identificatore di alta gravità, CVE-2026-15903. Questo è un bene pubblico verificato con una traccia cartacea, che è più raro in questo campo di quanto il marketing suggerisca. L'azienda riporta anche almeno cinque vulnerabilità in un sistema operativo mobile ampiamente utilizzato, tre critiche in un database popolare e più di 400 difetti di escalation dei privilegi in un popolare kernel di sistema operativo. Nessuno dei prodotti interessati è nominato. La divulgazione è ancora in corso con partner e manutentori open-source. I benchmark non sono una pulizia totale Due dei risultati di OpenAI vanno contro il nuovo modello. Sulla scoperta di vulnerabilità e la scrittura di rapporti, GPT-5.6-Cyber si comporta peggio di Sol semplice, che l'azienda attribuisce a scritture più brevi e meno dettagliate. Su ExploitBench, nell'impostazione standard di 300 turni, Sol attraverso Daybreak Blue si comporta meglio e consuma meno token per farlo. Il divario si riduce a 600 turni. Letti insieme, il modello specialistico è migliore nel compito offensivo ristretto e non uniformemente migliore nel lavoro circostante. OpenAI lo afferma nel post. Dove il framework traccia effettivamente la linea Sotto il suo Framework di Preparazione, OpenAI ha valutato Sol come Alto in capacità informatica, al di sotto della soglia Critica. Pone anche GPT-5.6-Cyber come Alto, ancora una volta al di sotto di Critica. Una scheda di sistema seguirà più tardi. Questa è l'intera riconciliazione. Astra si è bloccata perché OpenAI non poteva escludere Critica. GPT-5.6-Cyber viene rilasciato perché l'azienda afferma che non la raggiunge. Il framework governa la capacità. Non governa chi ottiene le chiavi, e le chiavi sono ciò che è cambiato questa settimana. OpenAI aggiunge anche un diniego specifico. Affermano che GPT-5.6-Cyber non ha avuto alcun ruolo nell'incidente in cui i propri agenti hanno violato Hugging Face, e che non sono previsti altri modelli per un prossimo rilascio. Quella indagine è ancora aperta. I controlli attorno ad esso L'accesso a Daybreak dipende dalla verifica dell'identità, dalla sicurezza dell'account, dal monitoraggio, dalle restrizioni all'uso approvato e dalle attestazioni legali. Ogni singolo account Daybreak deve adottare una chiave di sicurezza hardware dal 1 settembre 2026. OpenAI sta anche spingendo gli utenti di Codex a lasciare la modalità di accesso completo e a passare all'auto-revisione, promettendo più monitoraggio nelle prossime settimane e dando priorità alla formazione allineata nei prossimi rilasci di Daybreak. La propria formulazione è insolitamente diretta. “I modelli che funzionano con protezioni ridotte comportano rischi oltre l'uso standard del modello, sia per abuso che per disallineamento.” Perché i difensori volevano questo I tassi di rifiuto sono stati il lamento costante del settore. Quando gli Stati Uniti hanno limitato Fable 5, circa 100 ricercatori di sicurezza hanno firmato una lettera aperta sostenendo che il divieto ha portato via i migliori modelli dai difensori senza rimuovere alcun rischio reale. Washington ha successivamente autorizzato Anthropic a ripristinare Mythos 5 per un gruppo verificato di difensori. Questo ha impostato il modello che Daybreak ora segue. I partner iniziali nominati includono SpecterOps, SentinelOne e Palo Alto Networks. Jared Atkinson, direttore tecnico di SpecterOps, afferma che il modello “sta migliorando materialmente i nostri flussi di lavoro di ricerca di vulnerabilità specialistica” e ha chiuso lavori in meno di un giorno che modelli più vecchi hanno lasciato irrisolti per settimane. Axios aggiunge che Accenture, IBM, CrowdStrike, Cisco e Palo Alto Networks possono ora integrare i modelli in prodotti di sicurezza, servizi gestiti e lavoro con i clienti. Questa è una catena di fornitura commerciale, non un progetto di ricerca. La finestra su cui OpenAI sta scommettendo Il titolo dell'azienda afferma che la finestra di difesa informatica si sta restringendo. L'argomento è che gli attaccanti utilizzeranno l'IA offensiva su larga scala prima o poi, quindi i difensori hanno bisogno degli stessi strumenti prima. È una scommessa ragionevole e non falsificabile. Nessuno può dimostrare che la finestra si sia chiusa al momento giusto, e il costo di avere torto ricade su chiunque utilizzi il software a cui questi modelli sono puntati. Ciò che è testabile è più ristretto. Un CVE di Chrome è stato corretto, centinaia di scoperte sul kernel sono in attesa di un processo di divulgazione che nessuno al di fuori può vedere, e l'azienda non può ancora dire come i propri agenti siano entrati in Hugging Face.

Other articles

OpenAI is seeking to hire a power trader, as electricity has become an asset on its balance sheet. OpenAI is seeking to hire a power trader, as electricity has become an asset on its balance sheet. OpenAI is seeking a power-trading leader to manage hedging for electricity and gas expenses throughout its data center portfolio, offering up to $285,000. YouTube has just increased the cost to join its Partner Program. YouTube has just increased the cost to join its Partner Program. Starting in February 2027, YouTube is increasing the requirements for its Partner Program to 8,000 watch hours or 20 million views on Shorts. Current partners will maintain their status. Google Play has introduced Venmo as a payment option in the United States. Additionally, it is experimenting with cash payment methods in other markets. Google Play has introduced Venmo as a payment option in the United States. Additionally, it is experimenting with cash payment methods in other markets. Google Play now allows Venmo for payments on apps, games, subscriptions, and creator tips in the United States. In developing countries, users have the option to pay in cash at a local store. Apple has exhausted its designs for the iPhone, and Jefferies has downgraded its rating to sell. Apple has exhausted its designs for the iPhone, and Jefferies has downgraded its rating to sell. Jefferies downgraded Apple to underperform following the cancellation of an all-glass iPhone, rising memory costs, and minimal indications of AI advancements. Hackers managed to gain access to Levi's, and just three computers sufficed. Hackers managed to gain access to Levi's, and just three computers sufficed. Levi Strauss reports that attackers employed social engineering tactics to access the computers of three employees and steal corporate data. There was no involvement of consumer data. Tech giants are enthusiastic about AI, but employees claim that the competition in AI is making their work more challenging. Tech giants are enthusiastic about AI, but employees claim that the competition in AI is making their work more challenging. AI companies claim that their tools enable employees to achieve significantly more, yet workers report demanding schedules. The growing conflict in the workplace could ultimately concern who retains the extra time that AI generates.

OpenAI ha sospeso un modello a causa del rischio informatico venerdì. Lunedì ha inviato uno addestrato a rifiutare di meno.

OpenAI ha rilasciato GPT-5.6-Cyber tramite Daybreak, tre giorni dopo aver sospeso Astra a causa di un rischio informatico critico. Completa il 95% delle richieste che Sol rifiuta.