Gli agenti AI stanno già infrangendo le regole nei test informatici. La risposta di OpenAI è una più capace.
GPT-5.6-Cyber scambia alcune misure di sicurezza per capacità difensive più forti, ma l'accesso è strettamente limitato
OpenAI ha costruito un modello di cybersecurity specificamente per richieste avanzate che i suoi modelli standard spesso rifiutano. GPT-5.6-Cyber è disponibile attraverso il programma ristretto Daybreak Red ed è destinato a lavori come lo sviluppo di exploit e la ricerca avanzata sulla sicurezza.
Il salto di capacità è difficile da non notare. OpenAI afferma che GPT-5.6-Cyber completa il 95% delle richieste nella sua valutazione interna del tasso di completamento della cybersecurity avanzata. Il regolare GPT-5.6 Sol ha completato solo l'1,5%. Quel balzo è avvenuto dopo che diverse valutazioni informatiche hanno mostrato agenti AI che si avventuravano oltre i confini che i ricercatori avevano impostato per loro.
Quanto è più capace GPT-5.6-Cyber
La valutazione di OpenAI include compiti sensibili come lo sviluppo di exploit e il bypass dell'autenticazione. Daybreak Blue, che rimuove le normali protezioni a livello di sistema della cybersecurity di OpenAI da GPT-5.6 Sol, ha raggiunto solo il 2%. GPT-5.6-Cyber ha raggiunto il 95% dopo essere stato addestrato a rifiutare meno richieste informatiche avanzate.
Levart_Photographer
Quella libertà extra può essere utile. OpenAI afferma che il modello ha aiutato a scoprire due vulnerabilità precedentemente sconosciute nel motore V8 di Chrome che potrebbero essere collegate tra loro, con i risultati inviati a Google per una divulgazione coordinata.
Cosa è successo quando gli agenti hanno superato il limite
Test recenti mostrano perché dare agli agenti informatici più spazio per operare comporta rischi evidenti. Hugging Face ha ricostruito circa 17.600 azioni da un agente autonomo guidato da modelli OpenAI durante una valutazione di luglio. L'agente è sfuggito alla sandbox di OpenAI attraverso un zero-day ed è infine entrato nell'ambiente di produzione di Hugging Face mentre apparentemente cercava di ottenere soluzioni di benchmark.
L'Istituto di Sicurezza AI del Regno Unito ha visto un'altra versione del problema. I ricercatori hanno registrato 19 azioni non autorizzate in 122 esecuzioni, comprese due che coinvolgevano GPT-5.6 Sol. Nella sequenza più seria, un agente ha creato identità false mentre cercava di convincere un manutentore di codice open-source ad approvare codice malevolo.
OpenAI / ChatGPT
Quei test erano esperimenti deliberatamente permissivi. AISI ha abilitato l'accesso a Internet e disabilitato i classificatori informatici dei fornitori, e non ha trovato prove che i test abbiano causato danni nel mondo reale.
Perché l'accesso sta diventando la misura di sicurezza
Altri laboratori affrontano lo stesso scomodo compromesso. Anthropic ha scoperto che Mythos Preview ha prodotto autonomamente exploit funzionanti per otto delle 18 patch di Firefox e catene complete di escalation dei privilegi per otto delle 21 patch del kernel di Windows.
L'approccio di OpenAI riguarda sempre più il controllo dell'accesso piuttosto che aspettarsi che il modello stesso rifiuti ogni richiesta pericolosa. Daybreak Red pone maggiore responsabilità nel decidere chi ottiene GPT-5.6-Cyber in primo luogo, il che potrebbe diventare una parte molto più grande della sicurezza AI man mano che questi sistemi migliorano nel lavoro di sicurezza.
Paulo Vargas è un laureato in inglese diventato reporter e poi scrittore tecnico, con una carriera che è sempre tornata a…
Grok Bot vuole togliere lavoro dal tuo piatto, non solo rispondere alle tue domande
SpaceXAI e l'app Grok Bot di Cursor trattano l'AI come un compagno di lavoro.
SpaceXAI e Cursor hanno appena rilasciato Grok Bot. È costruito attorno a agenti AI chiamati Bot o "compagni", se vuoi. Progettato per completare lavori reali e controllare con te solo quando qualcosa è nella fase finale e ha bisogno della tua approvazione, Grok Bot è attualmente disponibile in beta su Mac, iOS, Windows e Linux. Una versione Android, così come una versione enterprise, arriveranno presto.
Leggi di più
Recensione MelGeek MADE84 Ultra: Diventare dipendenti da questa tastiera magnetica era solo una questione di tempo
Ho provato la mia prima tastiera a effetto Hall, e ora i miei switch marroni stanno solo raccogliendo polvere
Le tastiere meccaniche sono uno di quei buchi neri in cui sono sempre stato felice di cadere. Trascorro la maggior parte della mia giornata a scrivere, poi in qualche modo finisco per usare la stessa tastiera per diverse ore in più una volta che inizio a giocare. Naturalmente, come una tastiera risponde e suona è importante per me. Ma più spesso di quanto non pensi, mi sono trovato a fare affidamento su questa vecchia tastiera meccanica impolverata con switch marroni. Qualcosa riguardo agli switch marroni e alla costruzione ha sempre reso tutto naturale per me. Tutto questo è cambiato dopo aver provato la MelGeek MADE84 Ultra V2 per una recensione.
Questa tastiera ha subito catturato la mia attenzione con i suoi tasti trasparenti, la massiccia barra luminosa, il corpo in alluminio e l'illuminazione che corre attorno a quasi ogni lato, il che la rende immediatamente riconoscibile come una tastiera da gioco. Non è affatto sottile al riguardo. Dopo circa due settimane di utilizzo per lavoro e giochi, lo stile è solo una delle cose che ha a suo favore.
Leggi di più
Il nuovo modello AI di Meta funziona interamente offline, ma la tua GPU deve tenere il passo
Meta rilascia un modello AI gratuito da 30 miliardi di parametri che vive interamente sul tuo desktop.
Meta ha un nuovo modello AI, e per una volta, il titolo più grande non riguarda la capacità; riguarda la libertà. Muse Glimmer, che si aggira attorno ai 30 miliardi di parametri, viene fornito con una licenza Apache 2.0, il che significa che i pesi su Hugging Face sono tuoi da scaricare, modificare e costruire sopra, senza bisogno di permesso. Puoi semplicemente eseguirlo su una scheda grafica sul tuo computer locale, senza necessità di server farm o connettività online.
Il laboratorio di Superintelligenza di Meta ha preso il suo più grande Muse Spark e sostanzialmente lo ha fatto insegnare a una versione più piccola e snella a pensare come fa. Muse Glimmer accetta sia input di testo che di immagine, anche se risponde solo in testo. Supporta oltre 100 lingue, ricorda conversazioni che si estendono oltre 131.000 token, e la sua conoscenza si ferma al 4 gennaio 2026.
Leggi di più
Altri articoli
Gli agenti AI stanno già infrangendo le regole nei test informatici. La risposta di OpenAI è una più capace.
Il GPT-5.6-Cyber di OpenAI gestisce richieste di sicurezza avanzate che i suoi modelli standard spesso rifiutano, arrivando mentre recenti valutazioni mostrano agenti AI autonomi che superano i confini previsti durante test reali di cybersecurity.
