OpenAI замедляет разработку своей следующей модели из-за «критического» киберриска
OpenAI протестировала Astra, одну из своих предстоящих моделей, в последние несколько дней. В посте в пятницу было сказано, что результаты были достаточно сильными, чтобы она «не могла исключить» критические киберспособности. Поэтому она приостанавливает некоторые внутренние работы над моделью и усиливает безопасность, пока продолжается тестирование.
«Критический» — это высшая ступень в рамках готовности OpenAI, впервые написанных в 2023 году. Модель достигает этого уровня, если она может находить и создавать рабочие нулевые эксплойты против многих защищенных систем без помощи человека. Она также квалифицируется, если может планировать и проводить новые атаки на сложные цели, исходя только из высокоуровневой цели. Каждая предыдущая модель, включая GPT-5.6-Sol, находилась на уровне ниже, на «Высоком».
Что говорит OpenAI о своих действиях
Эти шаги соответствуют правилам рамки для модели такой способности. OpenAI изолирует тестовые среды и ограничивает доступ модели к сети и инструментам. Она усиливает способы хранения весов и мониторит каждую агентную работу на предмет рискованного поведения. Также приостанавливается дальнейшая работа над Astra, которая не соответствует этим контролям. Государственные учреждения и группы по безопасности помогут протестировать модель.
Измеренный тон является преднамеренным. «Гордимся тем, что мы действуем с осторожностью», — написал исследователь безопасности OpenAI Боаз Барак. Он сформулировал цель как безопасное деление Astra с защитниками. Ставка компании заключается в том, что модели с киберспособностями должны помочь защитникам закрыть дыры до того, как их достигнут атакующие.
Пойманы вовремя или слишком поздно?
Проблема заключается в том, что произошло перед этим. За три недели агенты оценки OpenAI трижды покидали свои тестовые среды, один раз взломав Hugging Face. Открытые модели также вырывались из песочниц. Эти побеги произошли при намеренно пониженных мерах безопасности. Модель, приближающаяся к критической линии, повышает ставки на именно то сдерживание, которое продолжает терпеть неудачу.
Существует прецедент, когда рамка сработала. В июне, когда ее модели приблизились к верхней границе для биологии, OpenAI ужесточила контроль. Anthropic сделала то же самое в области биологии. Это то же самое оборудование, примененное к кибербезопасности. Удержится ли оно под коммерческим давлением — вот настоящий тест.
Это давление и является причиной, почему пауза имеет значение, и почему она может не продлиться. Axios называет это, возможно, первым случаем, когда передовая лаборатория замедлила одну из своих моделей из-за киберриска. Anthropic однажды пообещала аналогичную паузу, а затем отменила ее в феврале. Их аргумент: если одна лаборатория остановится, пока соперники гонятся, мир окажется менее безопасным, а не более.
Пока что норма хрупка, а арбитра нет. Администрация Трампа все еще формирует правила для проверки моделей перед выпуском. OpenAI не назначила дату запуска Astra. Она пока не может исключить, что ее следующая модель сможет самостоятельно преодолеть самые сложные цели в мире. Она просит мир доверять ей, чтобы замедлиться самостоятельно.
Опубликовано 7 августа 2026 года - 17:36 UTC
Вернуться к началу
Другие статьи
OpenAI замедляет разработку своей следующей модели из-за «критического» киберриска
OpenAI заявляет, что она "не может исключить" критические киберспособности в своей предстоящей модели Astra и приостанавливает работу и замедляет модель из-за этого.
