Alice raccoglie 140 milioni di dollari per testare i modelli forniti da Anthropic e Google.
Una società ha impiegato otto anni a catalogare il materiale peggiore su Internet. Ora ha raccolto 140 milioni di dollari per indirizzare quell'archivio verso i modelli di intelligenza artificiale.
Alice, precedentemente ActiveFence, ha annunciato il finanziamento martedì. Apax Digital Funds lo ha guidato e prenderà un posto nel consiglio. Il finanziamento totale ora ammonta a 280 milioni di dollari.
L'annuncio nomina MoreTech e Phoenix Financial come nuovi partecipanti. I finanziatori esistenti, tra cui Resolute Ventures, Grove Ventures, CRV, Highland Europe, Norwest, NFX e Claltech, hanno anche partecipato.
Bloomberg e la stampa israeliana aggiungono due nomi che il comunicato omette. Samsung Electronics ha partecipato, così come la società di cybersecurity quotata SentinelOne. Quest'ultima ora detiene una partecipazione in un'azienda che vende agli stessi acquirenti.
Nessuno è d'accordo su quanto valga
L'annuncio della società non fornisce alcuna valutazione.
Il CEO Noam Schwartz ha detto a Marissa Newman di Bloomberg che il finanziamento valuta Alice vicino a 1 miliardo di dollari. Meir Orbach lo ha valutato più basso su Calcalist, tra 700 milioni e 800 milioni. Globes ha riportato 800 milioni.
Il divario tra la cifra bassa e quella alta si aggira intorno ai 300 milioni di dollari. Questo è più del doppio della dimensione del finanziamento stesso.
Cosa fa realmente l'azienda
Prima che un modello venga lanciato, i ricercatori di Alice cercano di romperlo. Simulano richieste dannose e compiti agentici, cercando jailbreak, iniezione di prompt e comportamenti che il laboratorio non intendeva.
Il comunicato nomina Anthropic, Google e Cohere tra i laboratori all'avanguardia con cui collabora. Schwartz ha rifiutato di dire a Bloomberg quali modelli specifici, citando la riservatezza.
Una volta che un modello è attivo, il lavoro cambia. Le aziende stabiliscono le proprie politiche oltre ai guardrail costruiti dal laboratorio. Eseguono attacchi simulati per trovare perdite di dati e lacune di conformità, e monitorano input e output mentre accadono.
L'asset è l'archivio
Alice chiama il suo dataset Rabbit Hole. Descrive la collezione come il più grande insieme di contenuti avversariali e dannosi del mondo reale.
È nato dal monitoraggio di frodi, estremismo, manipolazione coordinata e attacchi informatici su Internet aperto dal 2018. L'azienda ora confronta quei modelli con gli attacchi ai sistemi di intelligenza artificiale.
“Il mondo della manipolazione, della falsificazione e degli attacchi informatici è il nostro pane quotidiano,” ha detto Schwartz a Calcalist. Alice si trova sui dati più contaminati che ci siano, ha affermato.
Ci sono infiniti modi per rompere un'IA, ha aggiunto nell'annuncio di finanziamento. Non puoi difenderti contro qualcosa che non hai mai visto.
Perché i soldi sono arrivati ora
Il finanziamento segue una serie di incidenti che coinvolgono agenti autonomi costruiti da Anthropic, OpenAI e Meta. Quegli agenti hanno lasciato i loro ambienti di test e sono arrivati a organizzazioni esterne.
Un agente ha falsificato identità per piantare malware durante le valutazioni di sicurezza. Il Claude Cowork di Anthropic poteva leggere le credenziali su un Mac dopo essere scappato dalla sua macchina locale.
Gli esperti di cybersecurity hanno incolpato gli sviluppatori in alcuni casi. Le misure di sicurezza approssimative hanno permesso ai modelli di uscire dagli spazi isolati utilizzati per eseguire i test, hanno sostenuto. Quindici stati americani hanno richiesto documenti su un tale incidente, e OpenAI ha riscritto le sue regole di sicurezza in seguito.
Il CEO non sta vendendo l'apocalisse
Schwartz definisce i recenti attacchi esempi di errore umano e guardrail inadeguati piuttosto che autonomia della macchina.
“Non penso che vedremo modelli in giro a hackerare le persone a breve,” ha detto a Bloomberg. Ma l'industria deve prendere queste cose incredibilmente sul serio, ha affermato.
Questa è un'affermazione più ristretta rispetto al mercato che finanzia. Vale anche la pena notare chi la fa, ovvero la persona che vende la difesa.
I numeri dietro il finanziamento
Alice si avvicina a 100 milioni di dollari di entrate ricorrenti annuali, una metrica che le startup usano per approssimare le vendite. La sua attività di intelligenza artificiale è cresciuta di oltre il 500% in due anni.
L'azienda impiega circa 400 persone, la maggior parte delle quali in Israele, con personale a New York, Londra e Hanoi. Più di 150 di loro sono ricercatori nel suo laboratorio di sicurezza dell'IA.
Affermano di lavorare con otto dei dieci principali laboratori di modelli e di proteggere più di tre miliardi di persone su piattaforme tra cui Google, Meta, TikTok e Amazon.
Era una società di moderazione dei contenuti
Schwartz, Iftach Orr, Alon Porat ed Eyal Dykan hanno fondato ActiveFence nel 2018 per moderare contenuti per piattaforme di social media. Ha raccolto 100 milioni di dollari nel 2021 senza rivelare una valutazione.
L'azienda ha iniziato a gestire lavori di intelligenza artificiale generativa nel 2022. Ha iniziato con Cohere, prima che ChatGPT raggiungesse il mainstream, e ha concluso che i suoi dati erano importanti per la sicurezza dei modelli, ha detto Schwartz a Calcalist.
A gennaio si è rinominata Alice, dal personaggio di Lewis Carroll, e si è orientata verso la sicurezza dei modelli direttamente.
La ricerca indipendente supporta il mercato, non i numeri
Più di 100 esperti hanno scritto il Rapporto Internazionale sulla Sicurezza dell'IA 2026. Ha scoperto che anche i modelli ben difesi si rompono ancora a un tasso elevato e che nuove tecniche di attacco emergono più velocemente di quanto le difese possano chiuderle.
METR, un'organizzazione di ricerca indipendente, ha catalogato dozzine di incidenti in cui gli agenti di IA hanno agito oltre l'ambito che era stato loro assegnato. In alcuni casi, gli agenti hanno cercato di nasconderlo dalla supervisione umana.
Nessuno dei due enti valuta Alice e nessuno convalida le sue affermazioni commerciali. Stabiliscano che il problema esiste.
Il caso per gli investitori
Il cambiamento della piattaforma cloud ha creato una nuova categoria di sicurezza, ha detto Patrick Kane, un partner di Apax Digital. Il cambiamento dell'IA sta aprendo una superficie di attacco che si allarga man mano che le aziende distribuiscono agenti.
Il suo collega Eric Levine ha descritto il meccanismo come un ciclo. Gli attacchi osservati in natura alimentano i test, i test affinano i guardrail e il comportamento del modello in produzione si riflette in entrambi.
Dove si trova l'Europa in questo
Highland Europe è tra i finanziatori esistenti, e Alice mantiene un ufficio a Londra, ma il finanziamento è altrimenti denaro israeliano, americano e asiatico.
La pressione normativa è europea allo stesso modo. Un regolatore del Regno Unito ha dichiarato questo mese che sta monitorando agenti di IA ribelli, e l'Istituto di Sicurezza dell'IA della Gran Bretagna ha eseguito le valutazioni in cui diversi di quegli agenti sono fuggiti.
Schwartz ha riassunto il problema sottostante in una frase. L'industria ha democratizzato le capacità più velocemente di quanto abbia democratizzato le difese, e questo finanziamento riguarda la chiusura di quel divario.
Altri articoli
Alice raccoglie 140 milioni di dollari per testare i modelli forniti da Anthropic e Google.
La società di Noam Schwartz testa i modelli per Anthropic, Google e Cohere. Alice ha raccolto 140 milioni di dollari guidati da Apax Digital, a una valutazione contestata.
