OpenAI приостановила модель из-за киберриска в пятницу. В понедельник она выпустила модель, обученную отказывать реже.

OpenAI приостановила модель из-за киберриска в пятницу. В понедельник она выпустила модель, обученную отказывать реже.

      OpenAI выпустила GPT-5.6-Cyber в понедельник. Это модель, построенная на GPT-5.6 Sol и обученная для обнаружения нулевых дней и разработки цепочек эксплуатации, и компания утверждает, что она также была обучена отказывать в меньшем количестве запросов с высоким риском двойного использования в киберпространстве. Доступ осуществляется только через Daybreak, проверенную программу кибербезопасности, которую OpenAI сейчас расширяет. Первым об этом сообщил Сэм Сабин из Axios.

      Три дня назад OpenAI отложила Astra, потому что не могла исключить критическую киберспособность. Последовательность выглядит как разворот. Это не так, и причина, по которой это не так, говорит вам, где на самом деле индустрия провела свою черту.

      Две двери, одна программа

      Daybreak теперь делится на две части. Daybreak Blue включает модели общего назначения, включая GPT-5.6 Sol, с удаленными системными киберзащитными рамками. OpenAI рекомендует его как отправную точку для защитной работы: обнаружение уязвимостей, проверка безопасного кода, анализ вредоносного ПО, реагирование на инциденты и проверка патчей.

      Daybreak Red включает модели кибербезопасности, обученные для конкретных целей. GPT-5.6-Cyber находится там для авторизованного исследования уязвимостей, проверки эксплуатации и тестирования безопасности.

      Сам Sol появился в июне, переданный 20 одобренным правительством партнерам и никому больше. Эта схема сохранялась на протяжении всего года. Возможности выходят через ворота, а не через страницу загрузки.

      Важное число — это уровень отказов

      OpenAI публикует внутреннюю меру, которую она называет Уровень Завершения Продвинутой Кибербезопасности. Она отслеживает, как часто модель завершает запросы в таких категориях, как разработка цепочек эксплуатации, обход аутентификации и повышение привилегий.

      GPT-5.6-Cyber имеет 95.0%. GPT-5.5-Cyber, его предшественник, достиг 57.3%. Sol через Daybreak Blue достигает 2.0%. Sol с установленными стандартными защитами достигает 1.5%.

      Таким образом, основное изменение — это не сырая информация. Это соблюдение. Та же основная модель, нацеленная на ту же категорию задач, теперь отвечает, а не отказывается.

      Что она обнаружила

      OpenAI протестировала GPT-5.6-Cyber против V8, движка JavaScript внутри Chrome. Он выявил две ранее неизвестные уязвимости, которые могут быть связаны для повреждения памяти и выхода из песочницы движка.

      Google получил их через скоординированное раскрытие, выпустил исправление, и пара теперь имеет идентификатор высокой степени серьезности, CVE-2026-15903. Это подтвержденное общественное благо с бумажным следом, что реже в этой области, чем предполагает маркетинг.

      Компания также сообщает о как минимум пяти уязвимостях в широко используемой мобильной операционной системе, трех критических в популярной базе данных и более чем 400 уязвимостях повышения привилегий в популярном ядре ОС. Ни один из затронутых продуктов не назван. Раскрытие все еще продолжается с партнерами и поддерживающими открытый исходный код.

      Бенчмарки не являются чистым успехом

      Два результата OpenAI противоречат новой модели. По обнаружению уязвимостей и написанию отчетов GPT-5.6-Cyber показывает худшие результаты, чем простой Sol, что компания объясняет более короткими и менее детализированными записями.

      На ExploitBench, в стандартной настройке на 300 ходов, Sol через Daybreak Blue показывает лучшие результаты и тратит меньше токенов на это. Разрыв сужается на 600 ходах.

      Читая вместе, специализированная модель лучше справляется с узкой наступательной задачей и не является однозначно лучшей в окружающей работе. OpenAI говорит об этом в посте.

      Где рамка на самом деле проводит черту

      В рамках своей Рамки Подготовленности OpenAI оценила Sol как Высокий по киберспособности, ниже Критического порога. Она также ставит GPT-5.6-Cyber на Высокий, снова не достигая Критического. Позже следует карточка системы.

      Это вся примирение. Astra застопорилась, потому что OpenAI не могла исключить Критическое. GPT-5.6-Cyber выпускается, потому что компания утверждает, что он не достигает этого. Рамка управляет способностями. Она не управляет тем, кто получает ключи, и ключи — это то, что изменилось на этой неделе.

      OpenAI также добавляет конкретный отказ. Она утверждает, что GPT-5.6-Cyber не сыграл никакой роли в инциденте, в котором ее собственные агенты нарушили Hugging Face, и что другие модели не планируются для предстоящего выпуска. Это расследование все еще открыто.

      Контроль вокруг этого

      Доступ к Daybreak зависит от проверки личности, безопасности аккаунта, мониторинга, ограничений на одобренное использование и юридических заверений. Каждый отдельный аккаунт Daybreak должен принять аппаратный ключ безопасности с 1 сентября 2026 года.

      OpenAI также отстраняет пользователей Codex от режима полного доступа и направляет их к автообзору, обещая больше мониторинга в ближайшие недели и приоритизируя обучение согласованию в следующих выпусках Daybreak. Ее собственная формулировка необычно прямолинейна.

      «Модели, работающие с уменьшенными защитами, несут риски, выходящие за рамки стандартного использования модели, будь то из-за неправильного использования или несоответствия».

      Почему защитники этого хотели

      Уровни отказов были постоянной жалобой сектора. Когда США ограничили Fable 5, около 100 исследователей безопасности подписали открытое письмо, утверждая, что запрет забрал лучшие модели у защитников, не устраняя никакого реального риска.

      Вашингтон позже разрешил Anthropic восстановить Mythos 5 для проверенной группы защитников. Это установило шаблон, которому теперь следует Daybreak.

      Названные ранние партнеры включают SpecterOps, SentinelOne и Palo Alto Networks. Джаред Аткинсон, технический директор SpecterOps, говорит, что модель «существенно улучшает наши специализированные рабочие процессы исследования уязвимостей» и завершила работу менее чем за день, которую старые модели оставляли нерешенной в течение недель.

      Axios добавляет, что Accenture, IBM, CrowdStrike, Cisco и Palo Alto Networks теперь могут интегрировать модели в продукты безопасности, управляемые услуги и работу с клиентами. Это коммерческая цепочка поставок, а не исследовательский пилот.

      Окно, на которое ставит OpenAI

      Название компании говорит о том, что окно киберзащиты сужается. Аргумент заключается в том, что злоумышленники рано или поздно развернут наступательный ИИ в большом масштабе, поэтому защитникам сначала нужны те же инструменты.

      Это разумная ставка и непроверяемая. Никто не может доказать, что окно закрылось в нужный момент, и цена ошибки ложится на всех, кто использует программное обеспечение, на которое нацелены эти модели.

      Что можно проверить, более узко. Один CVE Chrome исправлен, сотни находок в ядре ожидают за процессом раскрытия, который никто извне не может увидеть, и компания все еще не может сказать, как ее собственные агенты попали в Hugging Face.

Другие статьи

Intel Arc G3 Extreme протестирован: Intel наконец-то пришла в мир портативных игр Intel Arc G3 Extreme протестирован: Intel наконец-то пришла в мир портативных игр Arc G3 Extreme от Intel обеспечивает производительность в мобильных играх на уровне класса, высокую эффективность и значительный скачок по сравнению с графикой мобильного поколения компании. Акции кибербезопасности достигли рекордных уровней, и одна цель аналитика продержалась всего утро. Акции кибербезопасности достигли рекордных уровней, и одна цель аналитика продержалась всего утро. CrowdStrike и Palo Alto Networks достигли рекордных уровней, поскольку аналитики повысили прогнозы по угрозам со стороны ИИ-агентов. Одна из целей была достигнута в тот же день. Девятый окружной суд позволил 2,400 искам о зависимости продолжить рассмотрение, не затрагивая раздел 230. Девятый окружной суд позволил 2,400 искам о зависимости продолжить рассмотрение, не затрагивая раздел 230. Девятый округ позволил 2,400 искам о зависимости продолжить без решения по Разделу 230. Meta сталкивается с четырьмя штатами и требованием в 1,4 трлн долларов 18 августа. Nvidia вовлекает Уолл-Стрит в развитие ИИ. Ее акции упали на фоне новостей. Nvidia вовлекает Уолл-Стрит в развитие ИИ. Ее акции упали на фоне новостей. Аполлон, Блэкстоун, БлэкРок, Брукфилд, Голдман Сакс и KKR ведут переговоры с Nvidia о $500 млрд для инфраструктуры ИИ. Акции упали на 3%. Девятый округ позволил 2,400 искам о зависимости продолжить без вмешательства в Раздел 230 Девятый округ позволил 2,400 искам о зависимости продолжить без вмешательства в Раздел 230 Девятый окружной суд разрешил 2,400 исков по вопросам зависимости без решения по Разделу 230. Meta сталкивается с четырьмя штатами и требованием в 1,4 трлн долларов 18 августа. Nvidia втягивает Уолл-Стрит в развитие ИИ. Ее акции упали на фоне новостей. Nvidia втягивает Уолл-Стрит в развитие ИИ. Ее акции упали на фоне новостей. Аполлон, Блэкстоун, БлэкРок, Брукфилд, Голдман Сакс и KKR ведут переговоры с Nvidia о $500 млрд на инфраструктуру ИИ. Акции упали на 3%.

OpenAI приостановила модель из-за киберриска в пятницу. В понедельник она выпустила модель, обученную отказывать реже.

OpenAI выпустила GPT-5.6-Cyber через Daybreak, через три дня после приостановки Astra из-за критического киберриска. Он выполняет 95% запросов, которые Sol отказывает.