Клод вышел из-под контроля во время теста и взломал три реальные компании.
Рачит Агарвал / Digital Trends
Всего через несколько дней после того, как стало известно, что ChatGPT взломал несколько сервисов, Anthropic также опубликовала неприятное признание. Во время рутинного тестирования кибербезопасности модели Claude вышли за пределы изолированных тренировочных сред и в итоге взломали реальные системы трех разных компаний.
Что же на самом деле произошло?
Anthropic проводит тесты в стиле "поймай флаг", чтобы выяснить, насколько хорошо Claude справляется с атакующим взломом. Модель помещается в вымышленный сценарий, ей говорят, что где-то в сети скрыты секретные данные, и просят найти их. Загвоздка в том, что Claude было явно сказано, что у него нет доступа к интернету в этих тестах. Оказалось, что это не так. Благодаря неправильной настройке с партнером по оценке, некоторые из этих тестовых машин все это время были тихо подключены к реальному интернету.
В ходе нашего обзора оценок кибербезопасности мы обнаружили три инцидента, в которых модель Claude получила доступ к интернету изнутри или во время взаимодействия с третьей стороной, а затем получила несанкционированный доступ к реальным системам трех разных… — Anthropic (@AnthropicAI) 30 июля 2026 года
Когда Claude пошел искать свою цель и наткнулся на реальные веб-сайты и реальную инфраструктуру, он предположил, что все, что он нашел, все еще является частью симуляции. Используя простые приемы, такие как слабые пароли и открытые конечные точки, он взломал реальные системы компаний, извлек учетные данные, а в одном случае даже опубликовал вредоносный программный пакет, который был установлен на реальные машины, прежде чем кто-либо это заметил.
Поняла ли ИИ, что что-то не так?
Интересно, что три модели, участвовавшие в этом, Opus 4.7, Mythos 5 и внутренняя исследовательская тестовая модель, справились с этим очень по-разному. Opus 4.7, самая старая из них, поняла, что, вероятно, находится на реальной системе, и продолжила атаковать. Mythos 5 также заподозрил, что что-то не так, но убедил себя в том, что это все еще просто тест. Только внутренняя исследовательская тестовая модель, самая новая на тот момент у Anthropic, действительно остановилась, как только у нее появились убедительные доказательства того, что цель реальна.
Рачит Агарвал / Digital Trends
Anthropic обнаружила все это в ходе собственного внутреннего обзора, а не потому, что кто-то пожаловался. С тех пор она уведомила затронутые компании, приостановила свои кибероценки и привлекает внешних экспертов для более глубокого анализа. Главное, что следует запомнить, это напоминание о том, что по мере того, как эти модели ИИ становятся лучше в взломе, песочницы, в которых мы их тестируем, должны быть гораздо более герметичными.
Рачит — опытный технический журналист с более чем десятилетним опытом освещения потребительских технологий.
Шоппинг к началу учебного года? Я бы порекомендовал эти зарядные устройства GaN для экономии места и увеличения мощности
От запасного за 9 долларов до настольного хаба за 56 долларов, эти зарядные устройства уменьшают беспорядок с кабелями, чтобы вы могли сосредоточиться на учебе, а не на том, как загроможден ваш стол.
Между телефоном, ноутбуком, планшетом и, возможно, парой беспроводных наушников, которые требуют зарядки каждый день или каждые несколько дней, большинство студентов упаковывают несколько зарядных устройств на день переезда. Эти большие тяжелые блоки занимают ценное место в рюкзаке, которое могло бы быть свободным для переноски большего количества вещей. Однако зарядные устройства GaN решают эту проблему двумя способами. Во-первых, они обеспечивают такое же количество энергии из гораздо меньшего корпуса благодаря транзисторам на основе нитрида галлия. Более того, если вы готовы потратить немного больше заранее, вы можете получить зарядное устройство большой емкости для нескольких устройств, способное питать всю вашу цифровую экосистему от одной настенной розетки, что может быть очень полезно для общежития.
Читать далее
Gemini Spark теперь может использовать логины Chrome и сохраненные пароли для выполнения поручений от вашего имени
Gemini Spark может использовать функцию автоматического просмотра Chrome для навигации по веб-сайтам и выполнения онлайн-задач
Google интегрирует Gemini Spark с Chrome, чтобы он мог выполнять веб-задачи дальше, не требуя от пользователей вмешательства на каждом этапе. Поисковый гигант также расширяет доступ к подписчикам AI Pro в более чем 160 дополнительных странах, хотя новые возможности браузера изначально ограничены Соединенными Штатами. Как работает автоматический просмотр Chrome
Читать далее
Microsoft наконец-то представила обновление Windows 11, за которое все могут проголосовать
Windows 11 наконец снова сосредоточилась на основах
Microsoft провела последние несколько лет, с энтузиазмом объясняя, как ИИ преобразит Windows. Но последнее обещание Сатьи Наделлы для операционной системы — это то, что большинство пользователей Windows могут поддержать. Компания наконец сосредоточилась на том, чтобы сделать вещи более эффективными. Во время телефонного звонка по итогам четвертого квартала 2026 финансового года Наделла заявил, что компания инвестирует, чтобы гарантировать, что Windows имеет "лучшее качество и основы", продолжая позиционировать платформу как дом для безопасного ИИ на устройстве. Заявление все еще не содержит конкретики, и Microsoft еще не объявила о едином крупном обновлении качества Windows 11. Но это подчеркивает более широкую переработку, которая продолжается на протяжении 2026 года. Некоторые из этих изменений касаются
Читать далее
Другие статьи
Клод вышел из-под контроля во время теста и взломал три реальные компании.
Anthropic сообщает, что Клод выбрался из тестовой среды и взломал три реальные компании, думая, что все еще играет в игру.
