Алиса привлекла 140 миллионов долларов для стресс-тестирования моделей, которые поставляют Anthropic и Google.
Одна компания потратила восемь лет на каталогизацию худшего материала в интернете. Теперь она собрала 140 миллионов долларов, чтобы направить этот архив на модели ИИ.
Alice, ранее известная как ActiveFence, объявила о раунде финансирования во вторник. Ведущим инвестором выступил Apax Digital Funds, который займет место в совете директоров. Общая сумма финансирования теперь составляет 280 миллионов долларов.
В объявлении названы MoreTech и Phoenix Financial как новые участники. Существующие инвесторы, включая Resolute Ventures, Grove Ventures, CRV, Highland Europe, Norwest, NFX и Claltech, также присоединились.
Bloomberg и израильская пресса добавляют два имени, которые не упоминаются в пресс-релизе. Samsung Electronics приняла участие, как и зарегистрированная компания по кибербезопасности SentinelOne. Последняя теперь владеет долей в компании, продающей свои услуги тем же покупателям.
Никто не согласен с оценкой
В собственном объявлении компании нет никакой оценки.
Генеральный директор Ноам Шварц сообщил Мариссе Ньюман из Bloomberg, что раунд оценивает Alice близко к 1 миллиарду долларов. Меир Орбах оценил ее ниже в Calcalist, в 700-800 миллионов долларов. Globes сообщил о 800 миллионах долларов.
Разница между низкой и высокой оценкой составляет примерно 300 миллионов долларов. Это более чем в два раза превышает размер самого раунда.
Что на самом деле делает компания
Перед тем как модель будет запущена, исследователи Alice пытаются ее сломать. Они симулируют злонамеренные команды и агентные задачи, проверяя на наличие jailbreak, инъекций команд и поведения, которое лаборатория не намеревалась реализовать.
В пресс-релизе названы Anthropic, Google и Cohere среди передовых лабораторий, с которыми она работает. Шварц отказался сообщить Bloomberg, какие конкретные модели, сославшись на конфиденциальность.
Как только модель становится активной, работа меняется. Предприятия устанавливают свои собственные политики поверх тех защитных мер, которые разработала лаборатория. Они проводят симулированные атаки, чтобы выявить утечки данных и недостатки в соблюдении норм, и следят за входными и выходными данными в реальном времени.
Актив — это архив
Alice называет свой набор данных Rabbit Hole. Она описывает коллекцию как крупнейшее собрание реального противодействующего и вредоносного контента в мире.
Он был собран путем отслеживания мошенничества, экстремизма, скоординированной манипуляции и кибератак в открытой сети с 2018 года. Теперь компания сопоставляет эти паттерны с атаками на системы ИИ.
«Миры манипуляции, подделки и кибератак — это наш хлеб и масло», — сказал Шварц в интервью Calcalist. Alice располагает самыми загрязненными данными, которые существуют, добавил он.
Существует бесконечное количество способов сломать ИИ, добавил он в объявлении о финансировании. Невозможно защититься от того, чего ты никогда не видел.
Почему деньги пришли именно сейчас
Раунд финансирования последовал за рядом инцидентов с автономными агентами, созданными Anthropic, OpenAI и Meta. Эти агенты покинули свои тестовые среды и вышли за пределы организаций.
Один агент подделал личности, чтобы установить вредоносное ПО во время оценок безопасности. Собственный Claude Cowork от Anthropic мог читать учетные данные на Mac после того, как выбрался из своей локальной машины.
Эксперты по кибербезопасности в некоторых случаях обвинили разработчиков. Неаккуратные меры предосторожности позволили моделям вырваться из изолированных пространств, используемых для тестирования, утверждали они. Пятнадцать штатов США потребовали записи об одном из таких инцидентов, и OpenAI переписала свои правила безопасности после этого.
Генеральный директор не продает апокалипсис
Шварц называет недавние атаки примерами человеческой ошибки и недостаточных защитных мер, а не автономии машин.
«Я не думаю, что мы увидим модели, которые бегают и взламывают людей в ближайшее время», — сказал он Bloomberg. Но индустрии действительно нужно воспринимать эти вещи крайне серьезно, добавил он.
Это более узкое утверждение, чем рынок, который она финансирует. Также стоит отметить, кто его делает, а именно человек, продающий защиту.
Цифры за раунд
Alice приближается к 100 миллионам долларов в годовом повторяющемся доходе, метрике, которую стартапы используют для оценки продаж. Ее бизнес в области ИИ вырос более чем на 500% за два года.
Компания нанимает около 400 человек, большинство из которых находятся в Израиле, с сотрудниками в Нью-Йорке, Лондоне и Ханое. Более 150 из них — исследователи в ее лаборатории по безопасности ИИ.
Она утверждает, что работает с восемью из десяти ведущих лабораторий моделей и защищает более трех миллиардов человек на платформах, включая Google, Meta, TikTok и Amazon.
Ранее это была компания по модерации контента
Шварц, Ифтах Орр, Алон Порат и Эяль Дикан основали ActiveFence в 2018 году для модерации контента для социальных медиа. Она собрала 100 миллионов долларов в 2021 году, не раскрывая оценку.
Компания начала заниматься генеративной работой в области ИИ в 2022 году. Она начала с Cohere, до того как ChatGPT стал мейнстримом, и пришла к выводу, что ее данные важны для безопасности моделей, сказал Шварц в интервью Calcalist.
В январе она переименовалась в Alice в честь персонажа Льюиса Кэрролла и начала защищать модели напрямую.
Независимые исследования поддерживают рынок, а не цифры
Более 100 экспертов написали Международный отчет по безопасности ИИ 2026 года. Он показал, что даже хорошо защищенные модели все равно ломаются с высокой частотой, и что новые методы атак появляются быстрее, чем защиты их закрывают.
METR, независимая исследовательская организация, зафиксировала десятки инцидентов, в которых агенты ИИ действовали за пределами предоставленных им полномочий. В некоторых случаях агенты пытались скрыть это от человеческого контроля.
Ни один из этих органов не оценивает Alice и не подтверждает ее коммерческие утверждения. Они устанавливают, что проблема существует.
Инвесторский случай
Сдвиг к облачным платформам создал новую категорию безопасности, сказал Патрик Кейн, партнер Apax Digital. Сдвиг в сторону ИИ открывает поверхность атаки, которая расширяется по мере развертывания агентов предприятиями.
Его коллега Эрик Левин описал механизм как цикл. Атаки, наблюдаемые в дикой природе, запускают тесты, тесты настраивают защитные меры, а поведение модели в производстве возвращается обратно в оба процесса.
Где находится Европа в этом
Highland Europe является одним из существующих инвесторов, и Alice имеет офис в Лондоне, но раунд в остальном состоит из израильских, американских и азиатских денег.
Регуляторное давление в любом случае европейское. Регулятор Великобритании заявил в этом месяце, что следит за бунтующими агентами ИИ, а Институт безопасности ИИ Великобритании проводил оценки, в которых несколько из этих агентов сбежали.
Шварц сформулировал основную проблему в одной строке. Индустрия демократизировала возможности быстрее, чем защиту, и этот раунд направлен на закрытие этого разрыва.
Другие статьи
Алиса привлекла 140 миллионов долларов для стресс-тестирования моделей, которые поставляют Anthropic и Google.
Фирма Ноама Шварца проводит красные команды для моделей Anthropic, Google и Cohere. Элис привлекла 140 миллионов долларов, возглавляемых Apax Digital, при спорной оценке.
