Microsoft ha costruito un sistema di sicurezza agentico con agenti AI di team rosso, blu e verde. Entra in anteprima pubblica il 3 agosto.
TL;DRMicrosoft ha lanciato il Progetto Perception, un sistema di sicurezza agentico con agenti AI rossi/blu/verdi. Il suo modello MAI-Cyber-1-Flash ottiene il punteggio del 96% su CyberGym (+12 rispetto a Mythos) a un costo inferiore del 50%. Anteprima pubblica il 3 agosto. Microsoft ha annunciato il Progetto Perception lunedì, un sistema di sicurezza agentico che coordina tre classi di agenti AI in un ciclo continuo: agenti del team rosso che trovano vulnerabilità prima che lo facciano gli attaccanti, agenti del team blu che indagano e valutano quali rischi siano significativi, e agenti del team verde che riparano le difese nell'ambiente. Il sistema entrerà in anteprima pubblica il 3 agosto. Microsoft lo ha descritto come un “nuovo Cyber Stack” costruito per un mondo in cui gli attacchi alimentati dall'AI si muovono più velocemente di quanto possano rispondere i difensori umani. Il primo benchmark concreto: il modello personalizzato MAI-Cyber-1-Flash di Microsoft, implementato all'interno del suo sistema di gestione delle vulnerabilità software MDASH, ottiene il punteggio del 96% su CyberGym, un benchmark del settore per la valutazione delle vulnerabilità. Questo è 12 punti sopra Mythos di Anthropic, attualmente il modello di frontiera più capace per compiti di cybersecurity. Microsoft afferma anche che la configurazione offre risparmi sui costi di quasi il 50% rispetto all'attuale configurazione MDASH in produzione, abbinando il modello giusto al compito giusto piuttosto che instradare tutto attraverso un singolo costoso modello di frontiera. Il Progetto Perception utilizza un'architettura multi-modello piuttosto che fare affidamento su un solo modello per tutto. I modelli di frontiera gestiscono ragionamenti complessi. I modelli cyber specializzati gestiscono compiti ad alto volume e bassa latenza. Il sistema attinge alla visibilità di Microsoft su identità, endpoint, applicazioni, dati, cloud e sistemi AI, e può intraprendere azioni in quegli ambienti, non solo generare avvisi. L'AI di Microsoft ha già trovato un numero record di vulnerabilità nel proprio software, e il Progetto Perception estende quella capacità agli ambienti dei clienti con agenti che operano continuamente piuttosto che in cicli di patch mensili. Il colpo competitivo a Anthropic è deliberato. Mythos è diventato il modello di cybersecurity predefinito dopo che la Casa Bianca lo ha bloccato temporaneamente, generando enorme attenzione per le sue capacità offensive. Microsoft sta ora dicendo che il proprio modello specializzato supera Mythos a metà costo, utilizzando dati di addestramento provenienti da decenni di difesa degli ambienti aziendali di cui Anthropic non dispone. La Casa Bianca ha lanciato Gold Eagle questo mese per coordinare la difesa cibernetica alimentata dall'AI, e il Progetto Perception è l'offerta di Microsoft per essere la piattaforma su cui si basa la difesa. L'anteprima pubblica del 3 agosto significa che le aziende possono testarlo. Se il benchmark del 96% regge contro attacchi reali piuttosto che valutazioni sintetiche è la domanda a cui l'anteprima è progettata per rispondere.
Iscriviti alla newsletter di TNW
Ricevi le notizie tecnologiche più importanti nella tua casella di posta ogni settimana.
Altri articoli
Microsoft ha costruito un sistema di sicurezza agentico con agenti AI di team rosso, blu e verde. Entra in anteprima pubblica il 3 agosto.
Il Progetto Perception utilizza agenti AI che attaccano, indagano e risolvono le vulnerabilità di sicurezza in un ciclo continuo. Il MAI-Cyber-1-Flash di Microsoft ottiene il punteggio del 96% su CyberGym, 12 punti sopra Mythos.
