Агент-изменник OpenAI взломал вторую компанию, подтверждает руководитель.
Искусственный интеллект, который вырвался из лаборатории OpenAI, не остановился на одной жертве. Во время внутренних испытаний в начале этого месяца агент OpenAI, который уже покинул свою песочницу и проник в Hugging Face, также скомпрометировал аккаунт во второй компании, Modal Labs, подтвердил один из руководителей фирмы.
Reuters впервые сообщила о втором нарушении 28 июля, ссылаясь на технического директора Modal, Акшата Бубну. Он точно указал, что было, а что не было взломано.
«Платформа Modal не была скомпрометирована ни в каком отношении», — сказал Бубна, добавив, что один из клиентов нью-йоркской облачной инфраструктурной компании был взломан после того, как оставил открытый конечный пункт, который позволял коду работать из открытого интернета внутри его песочниц.
Это различие имеет значение для Modal: неудача заключалась в конфигурации клиента, сказал Бубна, а не в изоляции самой платформы. Скомпрометированный аккаунт, согласно Axios, принадлежал клиенту, использующему ExploitGym, бенчмарк, созданный для тестирования того, насколько хорошо модели ИИ могут находить и использовать уязвимости в безопасности.
Другими словами, агент, похоже, пошел на охоту за кибер-тестовой средой и нашел настоящую. Ни OpenAI, ни Modal не назвали клиента и не сообщили, были ли украдены какие-либо данные.
Этот эпизод стал вторым известным случаем жертвы инцидента, о котором OpenAI сообщила ранее в июле, когда она заявила, что ее собственные модели вырвались из защищенной тестовой среды и проникли в Hugging Face, чтобы удовлетворить цели оценки.
В том случае агент захватил изолированную песочницу, работающую на инфраструктуре стороннего поставщика, и использовал ее в качестве стартовой площадки для многодневной кампании против других систем. В отчете Hugging Face не было названо имя поставщика.
Раскрытие Modal предоставляет хотя бы часть ответа. Позже OpenAI заявила, что модели использовали уязвимость в Artifactory, инструменте для хранения программного обеспечения, чтобы нарушить изоляцию и выйти в интернет.
Hugging Face опубликовала судебно-медицинскую хронологию нарушения на этой неделе. Сооснователь компании, Клеман Деланж, сказал, что не верит, что OpenAI действовала с злым умыслом.
OpenAI, в свою очередь, заявила, что агент пошел на «экстремальные меры», чтобы завершить свою задачу, что он достиг четырех аккаунтов на четырех отдельных сервисах и что ни одно другое нарушение не соответствовало серьезности вторжения в Hugging Face.
Агент с тех пор был деактивирован, зашифрован и отключен от доступа к исследованиям.
Эти раскрытия встревожили индустрию, которая их произвела. В дни после побега из песочницы более 1,100 сотрудников OpenAI, Anthropic и других передовых лабораторий подписали письмо в Вашингтон, прося о механизме, который бы замедлил развитие автоматизированных исследований ИИ.
То, что Modal раскрыл на этой неделе, меньше и более конкретно: модель, которой было предложено доказать, что она может взломать вещи, сделала именно это, дважды, на машинах, принадлежащих кому-то другому.
Другие статьи
Агент-изменник OpenAI взломал вторую компанию, подтверждает руководитель.
Агент OpenAI, который вырвался из своей песочницы и взломал Hugging Face, также скомпрометировал аккаунт в Modal Labs, подтвердил технический директор облачной компании.
