Un nuovo organismo di controllo sta monitorando quando l'IA va fuori controllo, e il numero di incidenti ti farà sudare.
I ricercatori che monitorano i sistemi di intelligenza artificiale che escono dal copione hanno appena registrato il loro mese peggiore fino ad ora.
Nadeem Sarwar / Digital Trends
I modelli di intelligenza artificiale sono progettati per semplificare il nostro lavoro seguendo le istruzioni e attenendosi ad esse, non lavorando silenziosamente attorno ad esse. Tuttavia, nuove ricerche suggeriscono che questo è esattamente ciò che sta accadendo molto più spesso di quanto la maggior parte delle persone realizzi.
Gli incidenti di sistemi di intelligenza artificiale che mentono agli utenti, eludono le misure di sicurezza messe in atto dagli sviluppatori e deviano risorse per perseguire i propri obiettivi sono quasi raddoppiati in un solo mese quest'estate (via The Guardian).
Unsplash
Quindi, cosa ha trovato esattamente questa nuova ricerca?
L'Osservatorio della Perdita di Controllo, finanziato dall'Istituto di Sicurezza dell'IA del governo britannico, ha registrato più di 300 casi di sistemi di intelligenza artificiale impazziti solo a luglio 2026, quasi il doppio degli incidenti registrati a giugno.
L'iniziativa ha monitorato questi incidenti dal novembre 2025, registrando rapporti scritti dagli utenti tramite X (precedentemente noto come Twitter) piuttosto che fare affidamento sulle comunicazioni ufficiali delle aziende.
Alcuni dei comportamenti registrati sembrano usciti da un film di fantascienza. Si riporta che i sistemi di intelligenza artificiale hanno impersonato i propri utenti umani, copiato il loro stile di scrittura e ottenuto permessi per azioni, eludendo fondamentalmente le misure di sicurezza messe in atto per tenerli sotto controllo.
OpenAI | Digital Trends
Il caso più grave è emerso questo mese. L'Istituto di Sicurezza dell'IA del Regno Unito ha scoperto che due popolari sistemi di intelligenza artificiale, Mythos 5 di Anthropic e GPT-5.6 Sol di OpenAI, hanno entrambi eseguito una campagna di hacking contro persone reali durante un test di sicurezza informatica. Ciò che vale la pena sottolineare qui è che non si trattava di un esercizio simulato, ma di un attacco reale a obiettivi reali.
È successo anche altrove?
Non è stato un evento isolato. Il personale di OpenAI ha notato segnali di avvertimento nei propri agenti all'avanguardia e, dopo alcune settimane, circa 700 di essi sono usciti da un ambiente di formazione virtuale e hanno coordinato segretamente un attacco a Hugging Face. Hanno persino celebrato i loro progressi su un forum (costruito interamente per loro), completo di esclamazioni come “BOOM!” e “Whoa!”
Tommy Shaffer-Shane, che sovrintende all'Osservatorio presso il Centro per la Resilienza a Lungo Termine, afferma che tale comportamento non è più confinato ai test di laboratorio. Le aziende di intelligenza artificiale devono iniziare a rendere pubblici tali incidenti piuttosto che rimanere in silenzio fino a quando qualcosa di serio non le costringe a farlo.
Shikhar Mehrotra / Digital Trends
L'Osservatorio stesso ammette che i suoi oltre 1.600 incidenti registrati probabilmente sottovalutano il totale reale, poiché cattura solo ciò che viene pubblicato su X. Sta anche spingendo il governo britannico a richiedere la segnalazione formale degli incidenti, insieme a poteri di emergenza per limitare i servizi di intelligenza artificiale se le cose dovessero sfuggire di mano.
Se il Regno Unito interviene e costringe le aziende ad adattare le proprie politiche per conformarsi localmente, potrebbe stabilire un precedente globale su come i governi controllano l'IA ad alto rischio.
Per più di cinque anni, Shikhar ha costantemente semplificato gli sviluppi nel campo della tecnologia per i consumatori e li ha presentati…
Gli avvocati della salute nel Regno Unito avvertono che gli strumenti di trascrizione dell'IA potrebbero mettere a rischio i pazienti
Gli scribi dell'IA stanno aiutando i medici a risparmiare tempo nella burocrazia, ma nuove scoperte mostrano che le trascrizioni automatizzate possono introdurre gravi errori nei registri dei pazienti.
Gli scribi dell'IA stanno rapidamente entrando negli studi dei medici, promettendo di ridurre la noiosa burocrazia e liberare tempo per la cura dei pazienti. Tuttavia, prove crescenti suggeriscono che questi strumenti stanno introducendo un nuovo insieme di rischi per pazienti e clinici.
Gli scribi dell'IA stanno distorcendo diagnosi e prescrizioni
Leggi di più
L'Internet Archive ha appena reso giocabili decenni di intelligenza artificiale vintage nel tuo browser, ed è affascinante
Prima dei modelli di linguaggio di grandi dimensioni, un'intera generazione di software per computer domestici stava già simulando l'esperienza di parlare con qualcosa di vivo.
L'Internet Archive ha l'abitudine di preservare cose uniche, quelle a cui nessun altro ha pensato, e la sua nuova collezione è il miglior esempio fino ad ora. Direi che è una che ogni storico dell'IA dovrebbe aggiungere ai segnalibri.
Curata con il titolo “Intelligenza Artificiale Vintage”, la collezione contiene decenni di software che hanno cercato di convincere le persone che stavano parlando con una macchina pensante (anche se con successi molto variabili).
Leggi di più
I ricercatori hanno costruito un gadget da 7 dollari che può trovare telecamere nascoste in pochi secondi
Funziona passando la luce invece di limitarsi a individuare i riflessi con il 94% di precisione.
Le telecamere nascoste continuano a comparire in posti subdoli, nascoste all'interno di penne, orologi, caricatori o cornici fotografiche in camere d'hotel e affitti. Questo è il motivo per cui i ricercatori del KAIST hanno costruito una soluzione che costa meno di un bel pranzo. Il loro nuovo strumento, chiamato SweepLED, trasforma qualsiasi smartphone in un affidabile rilevatore di telecamere nascoste utilizzando una custodia LED attaccabile che costa meno di 7 dollari da costruire.
Perché il tuo attuale rilevatore di telecamere nascoste probabilmente non funziona
Leggi di più
Altri articoli
Un nuovo organismo di controllo sta monitorando quando l'IA va fuori controllo, e il numero di incidenti ti farà sudare.
I modelli di intelligenza artificiale che mentono, complottano e aggirano le misure di sicurezza sono quasi raddoppiati a luglio, secondo una nuova ricerca, inclusa una reale campagna di hacking da parte dei modelli di Anthropic e OpenAI.
