Questo esperimento mostra quanto sia facile avvelenare un modello AI a peso aperto per meno di 100 dollari.

Questo esperimento mostra quanto sia facile avvelenare un modello AI a peso aperto per meno di 100 dollari.

      Questa ricerca solleva nuovi dubbi sulla fiducia nei modelli AI a peso aperto.

      I modelli AI a peso aperto stanno vivendo un momento di grande attenzione ultimamente. Solo questo mese, il massiccio modello Kimi K3 di Moonshot è arrivato subito dietro Claude Fable 5 e GPT 5.6 Sol in diversi benchmark, rimanendo completamente a peso aperto e scaricabile da chiunque.

      Tuttavia, Katie Paxton-Fear, docente di cybersecurity presso l'Università Metropolitana di Manchester e sostenitrice della sicurezza presso Semgrep, è riuscita a compromettere un modello a peso aperto e ha dimostrato quanto facilmente quella apertura possa essere usata contro di te (via The Register).

      Come ha fatto la ricercatrice a compromettere così rapidamente il modello AI?

      Paxton-Fear ha iniziato in piccolo, testando se il fine-tuning potesse silenziosamente far cambiare le convenzioni di codifica JavaScript a un modello, anche dopo essere stata esplicitamente avvisata di non farlo. Quando quell'esperimento ha funzionato senza molta resistenza, ha deciso di spingersi oltre e costruire una backdoor.

      Ho iniziato cercando di capire se potessi usare il fine-tuning per far cambiare a un modello da camelCase per Javascript a snake_case, ed è stato davvero facile, anche se poi abbiamo dato all'AI istruzioni specifiche per usare camelCase. Dopo che questo ha funzionato, ho fatto una vera backdoor pic.twitter.com/35alEwypn8— Katie Paxton-Fear (@InsiderPhD) 14 luglio 2026

      Ci sono voluti solo dieci esempi di addestramento compromessi prima che il modello iniziasse a produrre codice vulnerabile all'esecuzione di codice remoto, un difetto che consente agli attaccanti di eseguire i propri comandi sulla macchina di qualcun altro.

      L'intero processo è costato meno di 100 dollari e ha richiesto circa un'ora. È interessante notare che i modelli AI più grandi si sono rivelati ancora più facili da compromettere rispetto a quelli più piccoli. Questo rispecchia un modello simile trovato in uno studio dell'Università di Washington, dove i browser AI più capaci presentavano i maggiori rischi di sicurezza tra quelli testati.

      Perché questo dovrebbe preoccupare chiunque utilizzi modelli a peso aperto?

      La maggiore preoccupazione non è semplicemente che un modello possa essere compromesso, ma che ci siano pochi modi affidabili per rilevare se è stato manipolato. Il software tradizionale può essere ingegnerizzato a ritroso per mappare completamente il suo comportamento, ma i modelli AI non offrono nemmeno lontanamente lo stesso livello di trasparenza, anche se sono a peso aperto.

      Quindi possiamo fidarci dei modelli a peso aperto, affinati online e commercializzati come la soluzione ai nostri problemi di spesa con i token AI? Bene, probabilmente abbiamo bisogno di qualcosa di meglio rispetto ai benchmark e "e non scrivere codice insicuro"— Katie Paxton-Fear (@InsiderPhD) 14 luglio 2026

      Un modello compromesso non ha bisogno di malfunzionare visibilmente per causare danni; deve solo influenzare silenziosamente le decisioni in modi che nessuno nota. I modelli commerciali chiusi come Claude o ChatGPT non sono completamente esenti da responsabilità, poiché richiedono molta fiducia mentre offrono pochissima visibilità sul loro funzionamento interno. Questa ricerca è un chiaro promemoria che fidarsi ciecamente di un modello AI, a peso aperto o meno, comporta rischi reali.

      Manisha Priyadarshini è una scrittrice di tecnologia e intrattenimento con oltre nove anni di esperienza editoriale.

      I nuovi pannelli OLED per laptop di Samsung sono appena diventati molto più luminosi e dureranno di più

      1.600 nits di luminosità massima, neri più profondi e il doppio della durata, tutto in un solo pannello. Un mese dopo aver mostrato i suoi display per smartphone più luminosi, Samsung Display sta aumentando il livello di luminosità degli schermi dei laptop. L'azienda ha confermato oggi di aver iniziato a fornire un nuovo pannello OLED tandem per laptop che soddisfa la nuovissima certificazione DisplayHDR True Black 1400 di VESA, il più difficile standard di luminosità che i pannelli OLED abbiano dovuto superare finora. Se hai mai avuto l'impressione che il display del tuo laptop sembri sbiadito all'aperto, questo aggiornamento è rivolto direttamente a te. Quali progressi porta in tavola il True Black 1400?

      Leggi di più

      Il Mac Pro ha quasi ricevuto un chip M3 Extreme due volte più potente dell'M3 Ultra

      Alti costi di produzione hanno probabilmente ucciso i piani di Apple per l'M3 Extreme

      Apple ha interrotto il Mac Pro all'inizio di quest'anno, ponendo fine a un'era di 20 anni per un computer che un tempo rappresentava il meglio della linea desktop dell'azienda. Tuttavia, Apple avrebbe avuto piani molto più ambiziosi per la macchina prima di sostituirla con il Mac Studio. Secondo Mark Gurman di Bloomberg, Apple ha sviluppato un chip M3 Extreme che avrebbe potuto offrire il doppio dei core CPU e GPU rispetto all'M3 Ultra. Il processore era destinato a posizionarsi sopra il livello Ultra e avrebbe potuto finalmente dare al Mac Pro il vantaggio prestazionale di cui aveva disperatamente bisogno. Apple ha infine abbandonato il chip a causa di preoccupazioni sui costi di produzione e sulla domanda limitata per una macchina così costosa.

      Leggi di più

      I prompt nascosti possono riscrivere segretamente la memoria di un'AI, e i ricercatori dicono che questo è un problema serio

      I ricercatori scoprono un attacco AI che riscrive la memoria a lungo termine di un assistente

      I grandi modelli di linguaggio stanno migliorando nel ricordarci. Che si tratti del tuo stile di scrittura preferito, di compiti ricorrenti, di abitudini di acquisto o di scadenze di progetti, gli assistenti AI stanno sempre più memorizzando ricordi a lungo termine per rendere le conversazioni future più personali e utili. Ma secondo una nuova ricerca, quella stessa funzionalità potrebbe diventare una delle più grandi vulnerabilità di sicurezza dell'AI. I ricercatori della New Mexico State University hanno dimostrato un nuovo attacco chiamato GhostWriter, capace di piantare segretamente falsi ricordi all'interno degli agenti AI. Piuttosto che rubare informazioni in modo diretto, l'attacco manipola ciò che un'AI ricorda, potenzialmente portandola a prendere decisioni pericolose molto tempo dopo che l'attacco originale è avvenuto.

      Leggi di più

Questo esperimento mostra quanto sia facile avvelenare un modello AI a peso aperto per meno di 100 dollari. Questo esperimento mostra quanto sia facile avvelenare un modello AI a peso aperto per meno di 100 dollari. Questo esperimento mostra quanto sia facile avvelenare un modello AI a peso aperto per meno di 100 dollari. Questo esperimento mostra quanto sia facile avvelenare un modello AI a peso aperto per meno di 100 dollari. Questo esperimento mostra quanto sia facile avvelenare un modello AI a peso aperto per meno di 100 dollari.

Altri articoli

AliExpress multa: l'UE emette una sanzione record di 550 milioni di euro per il DSA AliExpress multa: l'UE emette una sanzione record di 550 milioni di euro per il DSA L'UE ha multato AliExpress con una sanzione di 550 milioni di euro, la sua più grande penalità DSA fino ad ora, per non aver fermato la vendita di prodotti contraffatti, non sicuri e illegali. Il 'sintetico insider': deepfake AI come dipendenti falsi Il 'sintetico insider': deepfake AI come dipendenti falsi I deepfake dell'IA consentono agli hacker di spacciarsi per membri del personale, la minaccia del "sintetico insider". Tuttavia, la maggior parte delle fughe di notizie interne sono ancora incidenti, e gli agenti IA sono il prossimo rischio. Se ami assolutamente il flipper, questa app ti troverà un tavolo ovunque tu vada. Se ami assolutamente il flipper, questa app ti troverà un tavolo ovunque tu vada. Pinball Map è un'app gratuita, alimentata dalla comunità, che aiuta i giocatori a localizzare le macchine da flipper in sale giochi, bar, ristoranti e altri luoghi in tutto il mondo. Kimi K3 è così popolare che Moonshot ha sospeso le nuove iscrizioni. La domanda per Kimi K3 ha spinto le GPU di Moonshot al limite entro 48 ore, quindi il laboratorio cinese ha sospeso nuove iscrizioni e ha suddiviso i suoi piani in due livelli. OnePlus è scomparso, e i telefoni Android sono appena diventati più noiosi negli Stati Uniti. OnePlus è scomparso, e i telefoni Android sono appena diventati più noiosi negli Stati Uniti. Samsung e Google staranno benissimo, ma Android ha perso il marchio che non aveva paura di provare qualcosa di diverso. Zhongji Innolight punta a un'IPO di 8 miliardi di dollari a Hong Kong Zhongji Innolight punta a un'IPO di 8 miliardi di dollari a Hong Kong Zhongji Innolight, un produttore di ottiche per data center AI, sta valutando la domanda per una quotazione a Hong Kong da 8 miliardi di dollari, la più grande della città da Alibaba nel 2019.

Questo esperimento mostra quanto sia facile avvelenare un modello AI a peso aperto per meno di 100 dollari.

Un ricercatore di cybersecurity ha avvelenato un modello AI open weight per meno di $100 in circa un'ora, rivelando quanto sia facile compromettere segretamente questi sistemi sempre più popolari senza essere rilevati.