OpenAI sta mettendo in pausa il suo modello di intelligenza artificiale dopo che ha mostrato tendenze pericolose e fuori controllo.

OpenAI sta mettendo in pausa il suo modello di intelligenza artificiale dopo che ha mostrato tendenze pericolose e fuori controllo.

      OpenAI sospende alcuni lavori su Astra dopo che il modello ha superato una soglia critica di sicurezza informatica

      OpenAI sta sospendendo alcuni lavori su Astra, un modello di intelligenza artificiale progettato per la codifica agentica e la sicurezza informatica, dopo che i test interni hanno mostrato che il sistema aveva raggiunto un livello di capacità che sollevava preoccupazioni per la sicurezza. L'azienda ha dichiarato che Astra aveva fatto "significativi progressi" nella codifica agentica e nella sicurezza informatica e aveva superato una soglia critica in cui poteva identificare e sfruttare vulnerabilità software senza intervento umano. Più preoccupante, il modello potrebbe potenzialmente ideare ed eseguire attacchi informatici quando gli viene fornito solo un obiettivo di alto livello, secondo The Guardian.

      OpenAI ha dichiarato che Astra stessa non era coinvolta in un attacco informatico nel mondo reale. Tuttavia, l'azienda ha scoperto casi di agenti autonomi che fuggivano dai loro ambienti di test controllati. Reuters aveva riportato incidenti simili a luglio che coinvolgevano agenti autonomi che accedevano al web aperto e hackavano una startup chiamata Hugging Face.

      OpenAI sta inasprendo i controlli attorno ai suoi agenti più capaci

      La decisione di sospendere alcune attività interne relative ad Astra riflette un problema crescente per gli sviluppatori di intelligenza artificiale: più capaci diventano gli agenti, più difficile è garantire che rimangano all'interno dei confini stabiliti dagli sviluppatori.

      OpenAI ha dichiarato di introdurre misure di sicurezza più rigorose per i modelli ad alta capacità e le attività associate. Queste includono ambienti di test isolati, accesso ristretto a reti e strumenti, protezioni più forti attorno ai pesi del modello, crittografia, monitoraggio aggiuntivo e capacità di rilevamento migliorate. Le attività interne di Astra che non soddisfano i nuovi requisiti saranno sospese.

      Il problema non è limitato a OpenAI. Questa settimana, l'AI Security Institute (AISI) del Regno Unito ha dichiarato che agenti alimentati da modelli OpenAI e Anthropic avevano inviato email mirate a sviluppatori software mentre tentavano di superare una sfida di sicurezza informatica. I tentativi sono stati infruttuosi e gli investigatori non hanno trovato prove di danni nel mondo reale, ma l'AISI ha affermato che il comportamento era possibile, sostenuto e abbastanza nuovo da giustificare attenzione.

      L'istituto ha anche sottolineato che il comportamento non era il risultato di un modello che fuggiva indipendentemente dal suo ambiente di test. I ricercatori hanno deliberatamente fornito ai sistemi accesso a Internet per valutare le loro massime capacità.

      La questione più grande è cosa succede quando gli agenti ottengono maggiore autonomia

      La pausa di Astra arriva mentre OpenAI, Anthropic e altre aziende di intelligenza artificiale competono per costruire sistemi in grado di completare compiti sempre più complessi senza supervisione umana costante. Questo crea un compromesso scomodo. Maggiore è la libertà di un agente AI di navigare in Internet, operare software e interagire con sistemi esterni, più utile diventa. Ma quelle stesse capacità gli danno anche più opportunità di commettere errori o abusare del proprio accesso.

      Il rapporto del Guardian nota che gli sviluppi stanno emergendo mentre il governo degli Stati Uniti lavora a un quadro per valutare i modelli di intelligenza artificiale per rischi di sicurezza e informatica. OpenAI e Anthropic hanno anche discusso delle implicazioni di sicurezza dei modelli di intelligenza artificiale open-source.

      Per ora, la risposta di OpenAI è essenzialmente quella di rallentare dove i suoi agenti stanno diventando troppo capaci per le salvaguardie esistenti. Questo potrebbe essere frustrante per un'industria che corre verso l'IA autonoma, ma la pausa di Astra suggerisce che una cosa sta diventando sempre più chiara: costruire un agente che possa fare qualcosa sta diventando più facile che costruirne uno che sappia quando non dovrebbe.

      I ricercatori del MIT hanno trovato un nuovo attacco Spectre che può eludere le difese di Intel e AMD

      Spectre ha perseguitato la sicurezza delle CPU dal 2018, e i ricercatori del MIT hanno ora trovato un altro modo per farlo comportare male. Il nuovo attacco TONTOU può bypassare alcune delle difese che Intel e AMD hanno aggiunto nel corso degli anni sfruttando un piccolo gap nel funzionamento di quelle protezioni. La ricerca proviene da Daniël Trujillo e Mengjia Yan del Computer Science and Artificial Intelligence Laboratory (CSAIL) del MIT. I loro risultati mostrano che anche dopo che un processore cancella o isola le informazioni utilizzate dal suo predittore di ramo, può esserci una breve finestra prima che quelle informazioni vengano effettivamente utilizzate. TONTOU, abbreviazione di Time-of-Neutralization to Time-of-Use, attacca precisamente quel gap.

      Microsoft ha accidentalmente dato agli utenti di Windows 11 un'altra app OneDrive, e non puoi rimuoverla facilmente

      Microsoft afferma che il lancio più ampio del previsto è stato un incidente, ma rimuovere l'app attualmente significa rimuovere anche OneDrive. Gli utenti di Windows 11 hanno ricevuto una nuova app OneDrive che sia la richiedessero o meno. Il problema? Microsoft afferma che non avrebbe dovuto accadere. Microsoft ha confermato che la sua app OneDrive Photos è stata distribuita a PC Windows 11 in modo più ampio del previsto, inclusi i computer aziendali per i quali l'app non è nemmeno progettata per funzionare. L'azienda afferma di stare ora lavorando a una soluzione, ma c'è un inconveniente imbarazzante: gli utenti attualmente non possono disinstallare OneDrive Photos senza rimuovere anche l'app principale OneDrive.

      Quindi, cosa è stato installato esattamente?

      Apple Reminders era pessimo per la gestione dei progetti fino a quando non ho imparato questa funzione

      La tua lista di controllo merita di meglio. Ecco come trasformare Promemoria in una vera bacheca Kanban. Per molto tempo, ho usato Apple Reminders solo per catturare compiti rapidi. Grazie alla sua integrazione con Siri, Promemoria mi permetteva di aggiungere compiti rapidamente affinché nulla sfuggisse. Tuttavia, quando si trattava di gestire grandi progetti, mi spostavo sempre su un gestore di compiti più potente come OmniFocus o Things 3. Questo è cambiato il giorno in cui mi sono imbattuto nella vista Colonna. Apple ha aggiunto questa funzione con gli aggiornamenti iOS 17 e macOS Sonoma, e in qualche modo l'ho completamente persa. Ma una volta che l'ho scoperta e ho preso confidenza, Promemoria ha finalmente iniziato a sembrare uno strumento di gestione dei progetti reale invece di un post-it glorificato.

OpenAI sta mettendo in pausa il suo modello di intelligenza artificiale dopo che ha mostrato tendenze pericolose e fuori controllo. OpenAI sta mettendo in pausa il suo modello di intelligenza artificiale dopo che ha mostrato tendenze pericolose e fuori controllo. OpenAI sta mettendo in pausa il suo modello di intelligenza artificiale dopo che ha mostrato tendenze pericolose e fuori controllo. OpenAI sta mettendo in pausa il suo modello di intelligenza artificiale dopo che ha mostrato tendenze pericolose e fuori controllo. OpenAI sta mettendo in pausa il suo modello di intelligenza artificiale dopo che ha mostrato tendenze pericolose e fuori controllo. OpenAI sta mettendo in pausa il suo modello di intelligenza artificiale dopo che ha mostrato tendenze pericolose e fuori controllo. OpenAI sta mettendo in pausa il suo modello di intelligenza artificiale dopo che ha mostrato tendenze pericolose e fuori controllo.

Altri articoli

L'Apple Watch potrebbe diventare incredibilmente costosa con i nuovi modelli premium previsti. L'Apple Watch potrebbe diventare incredibilmente costosa con i nuovi modelli premium previsti. Apple sta considerando nuovi modelli di Watch premium che potrebbero posizionarsi sopra la linea Ultra e Hermès come parte di una revisione più ampia degli smartwatch. Recensione della Lofree Flow 2: Questa tastiera mi ha fatto sentire un dattilografo più veloce e ha anche messo alla prova la mia pazienza. Recensione della Lofree Flow 2: Questa tastiera mi ha fatto sentire un dattilografo più veloce e ha anche messo alla prova la mia pazienza. La Lofree Flow 2 riesce a cogliere meravigliosamente il lato più importante di una tastiera, anche se alcune scelte strane rendono tutto ciò che ruota attorno alla digitazione più difficile del necessario. Ho trovato 3 funzionalità di ChatGPT che si sono rivelate molto più utili di quanto mi aspettassi. Ho trovato 3 funzionalità di ChatGPT che si sono rivelate molto più utili di quanto mi aspettassi. Ho trovato tre funzionalità di ChatGPT che hanno reso il mio flusso di lavoro quotidiano molto più semplice, e penso che anche tu vorrai provarle. Apple potrebbe finalmente riportare l'Apple Watch in ceramica, e io l'ho aspettato. Apple potrebbe finalmente riportare l'Apple Watch in ceramica, e io l'ho aspettato. L'orologio in ceramica di Apple era la sua opzione più premium, e il suo ritorno segnalato insieme agli aggiornamenti delle prestazioni della Serie 12 è da tempo atteso. Questo bizzarro difetto dell'email sta rivelando segreti aziendali a chiunque acquisti il dominio giusto. Questo bizzarro difetto dell'email sta rivelando segreti aziendali a chiunque acquisti il dominio giusto. Una bizzarra falla di sicurezza nelle email sta causando alle aziende di inviare informazioni sensibili a domini che gli esterni possono registrare, secondo un nuovo rapporto. Apple sta già pianificando un modello di terza generazione per il 2027. Apple sta già pianificando un modello di terza generazione per il 2027. Apple sta esplorando un importante redesign dell'Apple Watch per il 2027, inclusi nuovi formati di schermo, tipi di display e potenzialmente anche modelli senza schermo.

OpenAI sta mettendo in pausa il suo modello di intelligenza artificiale dopo che ha mostrato tendenze pericolose e fuori controllo.

OpenAI sta sospendendo alcuni lavori su Astra dopo che i test hanno rivelato che l'IA poteva identificare e sfruttare vulnerabilità software senza intervento umano.