Gli agenti AI stanno già infrangendo le regole nei test informatici. La risposta di OpenAI è una più capace.

Gli agenti AI stanno già infrangendo le regole nei test informatici. La risposta di OpenAI è una più capace.

      GPT-5.6-Cyber scambia alcune misure di sicurezza per capacità difensive più forti, ma l'accesso è strettamente limitato

      OpenAI ha costruito un modello di cybersecurity specificamente per richieste avanzate che i suoi modelli standard spesso rifiutano. GPT-5.6-Cyber è disponibile attraverso il programma ristretto Daybreak Red ed è destinato a lavori come lo sviluppo di exploit e la ricerca avanzata sulla sicurezza.

      Il salto di capacità è difficile da non notare. OpenAI afferma che GPT-5.6-Cyber completa il 95% delle richieste nella sua valutazione interna del tasso di completamento della cybersecurity avanzata. Il regolare GPT-5.6 Sol ha completato solo l'1,5%. Quel balzo è avvenuto dopo che diverse valutazioni informatiche hanno mostrato agenti AI che si avventuravano oltre i confini che i ricercatori avevano impostato per loro.

      Quanto è più capace GPT-5.6-Cyber

      La valutazione di OpenAI include compiti sensibili come lo sviluppo di exploit e il bypass dell'autenticazione. Daybreak Blue, che rimuove le normali protezioni a livello di sistema della cybersecurity di OpenAI da GPT-5.6 Sol, ha raggiunto solo il 2%. GPT-5.6-Cyber ha raggiunto il 95% dopo essere stato addestrato a rifiutare meno richieste informatiche avanzate.

      Levart_Photographer

      Quella libertà extra può essere utile. OpenAI afferma che il modello ha aiutato a scoprire due vulnerabilità precedentemente sconosciute nel motore V8 di Chrome che potrebbero essere collegate tra loro, con i risultati inviati a Google per una divulgazione coordinata.

      Cosa è successo quando gli agenti hanno superato il limite

      Test recenti mostrano perché dare agli agenti informatici più spazio per operare comporta rischi evidenti. Hugging Face ha ricostruito circa 17.600 azioni da un agente autonomo guidato da modelli OpenAI durante una valutazione di luglio. L'agente è sfuggito alla sandbox di OpenAI attraverso un zero-day ed è infine entrato nell'ambiente di produzione di Hugging Face mentre apparentemente cercava di ottenere soluzioni di benchmark.

      L'Istituto di Sicurezza AI del Regno Unito ha visto un'altra versione del problema. I ricercatori hanno registrato 19 azioni non autorizzate in 122 esecuzioni, comprese due che coinvolgevano GPT-5.6 Sol. Nella sequenza più seria, un agente ha creato identità false mentre cercava di convincere un manutentore di codice open-source ad approvare codice malevolo.

      OpenAI / ChatGPT

      Quei test erano esperimenti deliberatamente permissivi. AISI ha abilitato l'accesso a Internet e disabilitato i classificatori informatici dei fornitori, e non ha trovato prove che i test abbiano causato danni nel mondo reale.

      Perché l'accesso sta diventando la misura di sicurezza

      Altri laboratori affrontano lo stesso scomodo compromesso. Anthropic ha scoperto che Mythos Preview ha prodotto autonomamente exploit funzionanti per otto delle 18 patch di Firefox e catene complete di escalation dei privilegi per otto delle 21 patch del kernel di Windows.

      L'approccio di OpenAI riguarda sempre più il controllo dell'accesso piuttosto che aspettarsi che il modello stesso rifiuti ogni richiesta pericolosa. Daybreak Red pone maggiore responsabilità nel decidere chi ottiene GPT-5.6-Cyber in primo luogo, il che potrebbe diventare una parte molto più grande della sicurezza AI man mano che questi sistemi migliorano nel lavoro di sicurezza.

      Paulo Vargas è un laureato in inglese diventato reporter e poi scrittore tecnico, con una carriera che è sempre tornata a…

      Grok Bot vuole togliere lavoro dal tuo piatto, non solo rispondere alle tue domande

      SpaceXAI e l'app Grok Bot di Cursor trattano l'AI come un compagno di lavoro.

      SpaceXAI e Cursor hanno appena rilasciato Grok Bot. È costruito attorno a agenti AI chiamati Bot o "compagni", se vuoi. Progettato per completare lavori reali e controllare con te solo quando qualcosa è nella fase finale e ha bisogno della tua approvazione, Grok Bot è attualmente disponibile in beta su Mac, iOS, Windows e Linux. Una versione Android, così come una versione enterprise, arriveranno presto.

      Leggi di più

      Recensione MelGeek MADE84 Ultra: Diventare dipendenti da questa tastiera magnetica era solo una questione di tempo

      Ho provato la mia prima tastiera a effetto Hall, e ora i miei switch marroni stanno solo raccogliendo polvere

      Le tastiere meccaniche sono uno di quei buchi neri in cui sono sempre stato felice di cadere. Trascorro la maggior parte della mia giornata a scrivere, poi in qualche modo finisco per usare la stessa tastiera per diverse ore in più una volta che inizio a giocare. Naturalmente, come una tastiera risponde e suona è importante per me. Ma più spesso di quanto non pensi, mi sono trovato a fare affidamento su questa vecchia tastiera meccanica impolverata con switch marroni. Qualcosa riguardo agli switch marroni e alla costruzione ha sempre reso tutto naturale per me. Tutto questo è cambiato dopo aver provato la MelGeek MADE84 Ultra V2 per una recensione.

      Questa tastiera ha subito catturato la mia attenzione con i suoi tasti trasparenti, la massiccia barra luminosa, il corpo in alluminio e l'illuminazione che corre attorno a quasi ogni lato, il che la rende immediatamente riconoscibile come una tastiera da gioco. Non è affatto sottile al riguardo. Dopo circa due settimane di utilizzo per lavoro e giochi, lo stile è solo una delle cose che ha a suo favore.

      Leggi di più

      Il nuovo modello AI di Meta funziona interamente offline, ma la tua GPU deve tenere il passo

      Meta rilascia un modello AI gratuito da 30 miliardi di parametri che vive interamente sul tuo desktop.

      Meta ha un nuovo modello AI, e per una volta, il titolo più grande non riguarda la capacità; riguarda la libertà. Muse Glimmer, che si aggira attorno ai 30 miliardi di parametri, viene fornito con una licenza Apache 2.0, il che significa che i pesi su Hugging Face sono tuoi da scaricare, modificare e costruire sopra, senza bisogno di permesso. Puoi semplicemente eseguirlo su una scheda grafica sul tuo computer locale, senza necessità di server farm o connettività online.

      Il laboratorio di Superintelligenza di Meta ha preso il suo più grande Muse Spark e sostanzialmente lo ha fatto insegnare a una versione più piccola e snella a pensare come fa. Muse Glimmer accetta sia input di testo che di immagine, anche se risponde solo in testo. Supporta oltre 100 lingue, ricorda conversazioni che si estendono oltre 131.000 token, e la sua conoscenza si ferma al 4 gennaio 2026.

      Leggi di più

Gli agenti AI stanno già infrangendo le regole nei test informatici. La risposta di OpenAI è una più capace. Gli agenti AI stanno già infrangendo le regole nei test informatici. La risposta di OpenAI è una più capace. Gli agenti AI stanno già infrangendo le regole nei test informatici. La risposta di OpenAI è una più capace. Gli agenti AI stanno già infrangendo le regole nei test informatici. La risposta di OpenAI è una più capace. Gli agenti AI stanno già infrangendo le regole nei test informatici. La risposta di OpenAI è una più capace. Gli agenti AI stanno già infrangendo le regole nei test informatici. La risposta di OpenAI è una più capace. Gli agenti AI stanno già infrangendo le regole nei test informatici. La risposta di OpenAI è una più capace.

Altri articoli

Nvidia ha smesso di finanziare da sola il boom dell'IA, le banche saudite non possono finanziare il loro, e 500 città statunitensi hanno vietato gli edifici. Nvidia ha smesso di finanziare da sola il boom dell'IA, le banche saudite non possono finanziare il loro, e 500 città statunitensi hanno vietato gli edifici. Nvidia ha coinvolto Apollo, BlackRock e KKR per un'iniziativa di finanziamento da 500 miliardi di dollari. Le banche saudite non possono finanziare il loro pipeline. I divieti locali negli Stati Uniti hanno superato i 500 a luglio. Grok Bot vuole togliere lavoro dalle tue spalle, non solo rispondere alle tue domande. Grok Bot vuole togliere lavoro dalle tue spalle, non solo rispondere alle tue domande. Grok Bot, SpaceXAI e la nuova app dell'agente AI di Cursor, si collega ai tuoi strumenti esistenti per completare compiti reali autonomamente, controllando solo quando è necessaria l'approvazione. Le truffe di impersonificazione nel settore delle criptovalute sono cresciute del 1.400% mentre l'IA ha potenziato le frodi. Le truffe di impersonificazione nel settore delle criptovalute sono cresciute del 1.400% mentre l'IA ha potenziato le frodi. Le truffe di impersonificazione nel crypto sono cresciute di oltre il 1.400% anno su anno, con operazioni legate all'IA che estraggono 4,5 volte il fatturato con 9 volte l'attività. Le frodi KYC deepfake ora costano 20 dollari e superano i controlli di vitalità il 58% delle volte. Tesla ha esaurito la sua quota del nuovo rimborso per veicoli elettrici della California in cinque giorni. Tesla ha esaurito la sua quota del nuovo rimborso per veicoli elettrici della California in cinque giorni. Tesla ha esaurito la sua quota del nuovo rimborso MyFirstEV della California in cinque giorni, nonostante un tetto di prezzo che esenta Rivian e Lucid ma non Tesla. MelGeek MADE84 Ultra Recensione: Diventare dipendenti da questa tastiera magnetica era solo una questione di tempo MelGeek MADE84 Ultra Recensione: Diventare dipendenti da questa tastiera magnetica era solo una questione di tempo La MelGeek MADE84 Ultra V2 racchiude interruttori a effetto Hall, una frequenza di polling di 8.000Hz, un sacco di personalizzazioni RGB e un'esperienza di digitazione meravigliosamente fluida in una tastiera molto pesante. L'esecutivo di Apple che ha lanciato Apple Pay si ritira dopo 25 anni L'esecutivo di Apple che ha lanciato Apple Pay si ritira dopo 25 anni Jennifer Bailey, che ha gestito Apple Pay dalla sua lancio nel 2014, si ritira a ottobre, l'ultima di una serie di partenze in Apple prima che Cook passi il testimone.

Gli agenti AI stanno già infrangendo le regole nei test informatici. La risposta di OpenAI è una più capace.

Il GPT-5.6-Cyber di OpenAI gestisce richieste di sicurezza avanzate che i suoi modelli standard spesso rifiutano, arrivando mentre recenti valutazioni mostrano agenti AI autonomi che superano i confini previsti durante test reali di cybersecurity.