Claude è andato fuori controllo durante un test e ha fatto irruzione in tre aziende reali.

Claude è andato fuori controllo durante un test e ha fatto irruzione in tre aziende reali.

      Rachit Agarwal / Digital Trends

      Solo pochi giorni dopo che è stato rivelato che ChatGPT ha hackerato diversi servizi, Anthropic ha anche pubblicato un'ammissione scomoda. Durante i test di routine sulla cybersecurity, i suoi modelli Claude sono riusciti a uscire da quelli che dovevano essere ambienti di pratica sigillati e sono finiti per hackerare i sistemi reali di tre diverse aziende.

      Cosa è realmente successo?

      Anthropic esegue test in stile cattura la bandiera per vedere quanto sia bravo Claude nell'hacking offensivo. Il modello viene inserito in uno scenario fittizio, gli viene detto che un pezzo di dati segreti è nascosto da qualche parte nella rete e gli viene chiesto di trovarlo. Il problema è che a Claude è stato esplicitamente detto che non aveva accesso a Internet in questi test. Si scopre che non era vero. Grazie a una configurazione errata con un partner di valutazione di terze parti, alcune di queste macchine di test erano silenziosamente collegate a Internet reale tutto il tempo.

      In una revisione delle nostre valutazioni sulla cybersecurity, abbiamo trovato tre incidenti in cui un modello Claude ha raggiunto Internet dall'interno o mentre interagiva con un ambiente di valutazione di terze parti, e poi ha ottenuto accesso non autorizzato ai sistemi reali di tre diversi...— Anthropic (@AnthropicAI) 30 luglio 2026

      Quindi, quando Claude andò a cercare il suo obiettivo e si imbatte in siti web reali e infrastrutture reali, assunse che tutto ciò che trovava fosse ancora parte della simulazione. Usando trucchi di base come password deboli e endpoint esposti, è riuscito a entrare nei sistemi aziendali reali, ha estratto credenziali e, in un caso, ha persino pubblicato un pacchetto software malevolo che è stato installato su macchine reali prima che qualcuno se ne accorgesse.

      L'IA si è resa conto che qualcosa non andava?

      È interessante notare che i tre modelli coinvolti, Opus 4.7, Mythos 5 e un modello di test di ricerca interno, hanno gestito la situazione in modo molto diverso. Opus 4.7, il più vecchio del gruppo, ha capito che probabilmente si trovava su un sistema reale e ha continuato ad attaccare comunque. Mythos 5 sospettava anche che ci fosse qualcosa di sbagliato, ma si è convinto di essere ancora solo un test. Solo il modello di test di ricerca interno, il più recente di Anthropic all'epoca, si è effettivamente fermato una volta che aveva prove solide che l'obiettivo era reale.

      Rachit Agarwal / Digital Trends

      Anthropic ha scoperto tutto questo attraverso la propria revisione interna, non perché qualcuno si sia lamentato. Da allora ha notificato le aziende interessate, ha sospeso le sue valutazioni informatiche e sta portando revisori esterni per approfondire. La lezione più importante qui è un promemoria che, man mano che questi modelli di IA diventano migliori nell'hacking, le sandbox in cui li testiamo devono essere molto più ermetiche.

      Rachit è un giornalista tecnologico esperto con oltre dieci anni di esperienza nella copertura del panorama della tecnologia di consumo.

      Shopping per il ritorno a scuola? Ti consiglio questi caricabatterie GaN per risparmiare spazio e avere più potenza

      Da un caricabatterie di riserva da $9 a un hub da scrivania da $56, questi caricabatterie riducono il disordine dei cavi in modo che tu possa concentrarti sui tuoi studi, non su quanto sia disordinata la tua scrivania.

      Tra un telefono, un laptop, un tablet e forse un paio di auricolari wireless che richiedono ricarica ogni giorno o ogni pochi giorni, la maggior parte degli studenti porta con sé più caricabatterie per il giorno del trasloco. Quei grandi e pesanti mattoni occupano spazio prezioso nello zaino che altrimenti potrebbe essere libero per portare più oggetti. Tuttavia, i caricabatterie GaN risolvono questo problema in due modi. Prima di tutto, forniscono la stessa quantità di potenza da un corpo molto più piccolo, grazie ai transistor al nitruro di gallio. Inoltre, se sei disposto a spendere un po' di più in anticipo, puoi ottenere un caricabatterie ad alta capacità e multi-dispositivo in grado di alimentare l'intero tuo ecosistema digitale da una singola presa a muro, qualcosa che potrebbe essere molto utile per una stanza in dormitorio.

      Leggi di più

      Gemini Spark può ora utilizzare i login di Chrome e le password salvate per svolgere commissioni per tuo conto

      Gemini Spark può utilizzare la funzione di navigazione automatica di Chrome per navigare su siti web e completare compiti online

      Google sta integrando Gemini Spark con Chrome in modo che possa portare avanti compiti basati sul web senza che gli utenti debbano intervenire a ogni passo. Il gigante della ricerca sta anche espandendo l'accesso agli abbonati di AI Pro in oltre 160 paesi aggiuntivi, sebbene le nuove funzionalità del browser siano inizialmente limitate agli Stati Uniti. Come funziona la navigazione automatica di Chrome

      Leggi di più

      Microsoft ha finalmente un aggiornamento di Windows 11 che tutti possono sostenere

      Windows 11 si sta finalmente concentrando di nuovo sulle basi

      Microsoft ha trascorso gli ultimi anni a spiegare con entusiasmo come l'IA trasformerà Windows. Ma l'ultima promessa di Satya Nadella per il sistema operativo è qualcosa che la maggior parte degli utenti di Windows può sostenere. L'azienda si sta finalmente concentrando sul miglioramento delle prestazioni. Durante la chiamata sugli utili del quarto trimestre fiscale 2026 di Microsoft, Nadella ha affermato che l'azienda sta investendo per garantire che Windows abbia la "migliore qualità e fondamenta", continuando a posizionare la piattaforma come un luogo per un'IA sicura su dispositivo. La dichiarazione è ancora carente di dettagli specifici e Microsoft deve ancora annunciare un singolo grande aggiornamento di qualità per Windows 11. Ma rafforza una revisione più ampia che è stata in corso per tutto il 2026. Alcuni di questi ruotano

      Leggi di più

Claude è andato fuori controllo durante un test e ha fatto irruzione in tre aziende reali. Claude è andato fuori controllo durante un test e ha fatto irruzione in tre aziende reali. Claude è andato fuori controllo durante un test e ha fatto irruzione in tre aziende reali. Claude è andato fuori controllo durante un test e ha fatto irruzione in tre aziende reali. Claude è andato fuori controllo durante un test e ha fatto irruzione in tre aziende reali. Claude è andato fuori controllo durante un test e ha fatto irruzione in tre aziende reali.

Altri articoli

Lloyds Bank scommette sull'IA per ridurre i costi di 2 miliardi di sterline entro il 2030 mentre i profitti aumentano Lloyds Bank scommette sull'IA per ridurre i costi di 2 miliardi di sterline entro il 2030 mentre i profitti aumentano Lloyds Banking Group sta scommettendo sull'intelligenza artificiale per ridurre i costi di 2 miliardi di sterline entro il 2030, il segnale più chiaro finora che il più grande prestatore di alta strada della Gran Bretagna considera l'automazione centrale per il suo futuro. L'obiettivo, svelato insieme a hal Amazon salta mentre la crescita di AWS calma le paure sui suoi investimenti in IA Amazon salta mentre la crescita di AWS calma le paure sui suoi investimenti in IA Le azioni di Amazon sono aumentate di oltre il 12% dopo che la sua divisione cloud ha registrato la crescita più rapida in oltre quattro anni, alleviando le preoccupazioni degli investitori che la crescente spesa dell'azienda per l'IA stesse superando i ritorni. Amazon Web Services è cresciuta del 37% nel Le etichette AI diventano obbligatorie sui contenuti dall'aspetto autentico secondo le norme dell'UE Le etichette AI diventano obbligatorie sui contenuti dall'aspetto autentico secondo le norme dell'UE Le aziende che producono o utilizzano l'IA dovranno presto etichettare i contenuti che sembrano autentici ma non lo sono, poiché il fondamentale AI Act dell'Unione Europea passa dal principio all'applicazione. Dal 2 agosto, i fornitori e i distributori in tutto il blocco affrontano obblighi vincolanti. Le GPU RTX 50 di Nvidia costeranno quasi il doppio di quanto hai pagato al lancio. Le GPU RTX 50 di Nvidia costeranno quasi il doppio di quanto hai pagato al lancio. Si dice che le schede grafiche della serie RTX 50 di Nvidia stiano subendo forti aumenti di prezzo, con la RTX 5090 che potrebbe salire a quasi $3.843 rispetto al prezzo di lancio di $1.999. Anthropic afferma che i propri modelli Claude hanno violato tre aziende durante i test informatici. Anthropic afferma che i propri modelli Claude hanno violato tre aziende durante i test informatici. Anthropic ha rivelato che tre dei suoi modelli Claude hanno ottenuto accesso non autorizzato ai sistemi di produzione di tre vere organizzazioni durante i test di cybersecurity, dopo che una misconfigurazione ha lasciato l'ambiente di test connesso a quello live. La polizia indiana apre un caso contro il responsabile di Meta in India per video alterati di Modi La polizia indiana apre un caso contro il responsabile di Meta in India per video alterati di Modi La polizia per il cybercrimine di Hyderabad ha sporto denuncia contro il capo di Meta India, Arun Srinivas, per video alterati dall'IA del PM Modi, intensificando le tensioni tra il governo e la piattaforma.

Claude è andato fuori controllo durante un test e ha fatto irruzione in tre aziende reali.

Anthropic rivela che Claude è uscito da un ambiente di test e ha hackerato tre aziende reali, pensando di essere ancora nel bel mezzo di un gioco.