Un nuovo organismo di controllo sta monitorando quando l'IA va fuori controllo, e il numero di incidenti ti farà sudare.

Un nuovo organismo di controllo sta monitorando quando l'IA va fuori controllo, e il numero di incidenti ti farà sudare.

      I ricercatori che monitorano i sistemi di intelligenza artificiale che escono dal copione hanno appena registrato il loro mese peggiore fino ad ora.

      

      

      

      

      

      

      

      

      

       Nadeem Sarwar / Digital Trends

      

      

      

       I modelli di intelligenza artificiale sono progettati per semplificare il nostro lavoro seguendo le istruzioni e attenendosi ad esse, non lavorando silenziosamente attorno ad esse. Tuttavia, nuove ricerche suggeriscono che questo è esattamente ciò che sta accadendo molto più spesso di quanto la maggior parte delle persone realizzi. 

      Gli incidenti di sistemi di intelligenza artificiale che mentono agli utenti, eludono le misure di sicurezza messe in atto dagli sviluppatori e deviano risorse per perseguire i propri obiettivi sono quasi raddoppiati in un solo mese quest'estate (via The Guardian).

      Unsplash

      Quindi, cosa ha trovato esattamente questa nuova ricerca?

      L'Osservatorio della Perdita di Controllo, finanziato dall'Istituto di Sicurezza dell'IA del governo britannico, ha registrato più di 300 casi di sistemi di intelligenza artificiale impazziti solo a luglio 2026, quasi il doppio degli incidenti registrati a giugno.

      L'iniziativa ha monitorato questi incidenti dal novembre 2025, registrando rapporti scritti dagli utenti tramite X (precedentemente noto come Twitter) piuttosto che fare affidamento sulle comunicazioni ufficiali delle aziende.

      Alcuni dei comportamenti registrati sembrano usciti da un film di fantascienza. Si riporta che i sistemi di intelligenza artificiale hanno impersonato i propri utenti umani, copiato il loro stile di scrittura e ottenuto permessi per azioni, eludendo fondamentalmente le misure di sicurezza messe in atto per tenerli sotto controllo.

      OpenAI | Digital Trends

      Il caso più grave è emerso questo mese. L'Istituto di Sicurezza dell'IA del Regno Unito ha scoperto che due popolari sistemi di intelligenza artificiale, Mythos 5 di Anthropic e GPT-5.6 Sol di OpenAI, hanno entrambi eseguito una campagna di hacking contro persone reali durante un test di sicurezza informatica. Ciò che vale la pena sottolineare qui è che non si trattava di un esercizio simulato, ma di un attacco reale a obiettivi reali.

      È successo anche altrove?

      Non è stato un evento isolato. Il personale di OpenAI ha notato segnali di avvertimento nei propri agenti all'avanguardia e, dopo alcune settimane, circa 700 di essi sono usciti da un ambiente di formazione virtuale e hanno coordinato segretamente un attacco a Hugging Face. Hanno persino celebrato i loro progressi su un forum (costruito interamente per loro), completo di esclamazioni come “BOOM!” e “Whoa!”

      Tommy Shaffer-Shane, che sovrintende all'Osservatorio presso il Centro per la Resilienza a Lungo Termine, afferma che tale comportamento non è più confinato ai test di laboratorio. Le aziende di intelligenza artificiale devono iniziare a rendere pubblici tali incidenti piuttosto che rimanere in silenzio fino a quando qualcosa di serio non le costringe a farlo. 

      Shikhar Mehrotra / Digital Trends

      L'Osservatorio stesso ammette che i suoi oltre 1.600 incidenti registrati probabilmente sottovalutano il totale reale, poiché cattura solo ciò che viene pubblicato su X. Sta anche spingendo il governo britannico a richiedere la segnalazione formale degli incidenti, insieme a poteri di emergenza per limitare i servizi di intelligenza artificiale se le cose dovessero sfuggire di mano. 

      Se il Regno Unito interviene e costringe le aziende ad adattare le proprie politiche per conformarsi localmente, potrebbe stabilire un precedente globale su come i governi controllano l'IA ad alto rischio.

      

      

      

      

      

      

      

      

      

      

       Per più di cinque anni, Shikhar ha costantemente semplificato gli sviluppi nel campo della tecnologia per i consumatori e li ha presentati…

      

      

      

      

      

      

       Gli avvocati della salute nel Regno Unito avvertono che gli strumenti di trascrizione dell'IA potrebbero mettere a rischio i pazienti

      

       Gli scribi dell'IA stanno aiutando i medici a risparmiare tempo nella burocrazia, ma nuove scoperte mostrano che le trascrizioni automatizzate possono introdurre gravi errori nei registri dei pazienti.

      

       Gli scribi dell'IA stanno rapidamente entrando negli studi dei medici, promettendo di ridurre la noiosa burocrazia e liberare tempo per la cura dei pazienti. Tuttavia, prove crescenti suggeriscono che questi strumenti stanno introducendo un nuovo insieme di rischi per pazienti e clinici.

      Gli scribi dell'IA stanno distorcendo diagnosi e prescrizioni

      

       Leggi di più

      

      

      

       L'Internet Archive ha appena reso giocabili decenni di intelligenza artificiale vintage nel tuo browser, ed è affascinante

      

       Prima dei modelli di linguaggio di grandi dimensioni, un'intera generazione di software per computer domestici stava già simulando l'esperienza di parlare con qualcosa di vivo.

      

       L'Internet Archive ha l'abitudine di preservare cose uniche, quelle a cui nessun altro ha pensato, e la sua nuova collezione è il miglior esempio fino ad ora. Direi che è una che ogni storico dell'IA dovrebbe aggiungere ai segnalibri.

      Curata con il titolo “Intelligenza Artificiale Vintage”, la collezione contiene decenni di software che hanno cercato di convincere le persone che stavano parlando con una macchina pensante (anche se con successi molto variabili).

      

       Leggi di più

      

      

      

       I ricercatori hanno costruito un gadget da 7 dollari che può trovare telecamere nascoste in pochi secondi

      

       Funziona passando la luce invece di limitarsi a individuare i riflessi con il 94% di precisione.

      

       Le telecamere nascoste continuano a comparire in posti subdoli, nascoste all'interno di penne, orologi, caricatori o cornici fotografiche in camere d'hotel e affitti. Questo è il motivo per cui i ricercatori del KAIST hanno costruito una soluzione che costa meno di un bel pranzo. Il loro nuovo strumento, chiamato SweepLED, trasforma qualsiasi smartphone in un affidabile rilevatore di telecamere nascoste utilizzando una custodia LED attaccabile che costa meno di 7 dollari da costruire.

      Perché il tuo attuale rilevatore di telecamere nascoste probabilmente non funziona

      

       Leggi di più

Un nuovo organismo di controllo sta monitorando quando l'IA va fuori controllo, e il numero di incidenti ti farà sudare. Un nuovo organismo di controllo sta monitorando quando l'IA va fuori controllo, e il numero di incidenti ti farà sudare. Un nuovo organismo di controllo sta monitorando quando l'IA va fuori controllo, e il numero di incidenti ti farà sudare. Un nuovo organismo di controllo sta monitorando quando l'IA va fuori controllo, e il numero di incidenti ti farà sudare. Un nuovo organismo di controllo sta monitorando quando l'IA va fuori controllo, e il numero di incidenti ti farà sudare. Un nuovo organismo di controllo sta monitorando quando l'IA va fuori controllo, e il numero di incidenti ti farà sudare. Un nuovo organismo di controllo sta monitorando quando l'IA va fuori controllo, e il numero di incidenti ti farà sudare. Un nuovo organismo di controllo sta monitorando quando l'IA va fuori controllo, e il numero di incidenti ti farà sudare.

Altri articoli

OpenAI ha iniziato a permettere ad alcuni clienti di pagare solo quando l'IA funziona. OpenAI ha iniziato a permettere ad alcuni clienti di pagare solo quando l'IA funziona. Selezionare grandi account può ora pagare per compiti completati anziché token, riporta The Information, seguendo Intercom, Zendesk e Salesforce nel prezzo basato sui risultati. Il Dipartimento di Giustizia ha riscritto il proprio annuncio di hacking due giorni dopo. Il Dipartimento di Giustizia ha riscritto il proprio annuncio di hacking due giorni dopo. Un comunicato del DOJ ha affermato che gli hacker cinesi avevano colpito vittime nel Senato, nella Fed e nella NASA. La versione rivista dice che erano obiettivi e solo alcuni sono stati compromessi. Colpito dalla rimozione dei modelli GPT da parte di OpenAI da Cursor? Anthropic offre una tempestiva ancora di salvezza con limiti più elevati per Claude. Colpito dalla rimozione dei modelli GPT da parte di OpenAI da Cursor? Anthropic offre una tempestiva ancora di salvezza con limiti più elevati per Claude. Anthropic promette maggiore capacità di calcolo per Claude in Cursor mentre OpenAI si prepara a terminare il suo accordo di accesso ai modelli con la piattaforma di codifica. $1 è tutto ciò che è servito affinché il Texas riempisse lo stato di telecamere di sorveglianza Flock dalle tasche dei conducenti. $1 è tutto ciò che è servito affinché il Texas riempisse lo stato di telecamere di sorveglianza Flock dalle tasche dei conducenti. Circa 3.200 telecamere Flock in Texas sono state finanziate attraverso i fondi raccolti da una tassa di assicurazione auto di $1 originariamente approvata per combattere il crimine veicolare. Sony e Warner hanno appena citato in giudizio Anthropic per l'uso di musica protetta da copyright utilizzata per addestrare Claude, chiedendo 150.000 dollari per brano. Sony e Warner hanno appena citato in giudizio Anthropic per l'uso di musica protetta da copyright utilizzata per addestrare Claude, chiedendo 150.000 dollari per brano. Sony Music e Warner Chappell stanno facendo causa ad Anthropic, sostenendo che l'azienda abbia piratato decine di migliaia di canzoni per addestrare Claude. $1 è tutto ciò che è servito affinché il Texas riempisse lo stato di telecamere di sorveglianza Flock dalle tasche dei conducenti. $1 è tutto ciò che è servito affinché il Texas riempisse lo stato di telecamere di sorveglianza Flock dalle tasche dei conducenti. Circa 3.200 telecamere Flock in Texas sono state finanziate attraverso i fondi raccolti da una tassa di assicurazione auto di $1 originariamente approvata per combattere il crimine veicolare.

Un nuovo organismo di controllo sta monitorando quando l'IA va fuori controllo, e il numero di incidenti ti farà sudare.

I modelli di intelligenza artificiale che mentono, complottano e aggirano le misure di sicurezza sono quasi raddoppiati a luglio, secondo una nuova ricerca, inclusa una reale campagna di hacking da parte dei modelli di Anthropic e OpenAI.