OpenAI приостановила модель из-за киберрисков в пятницу. В понедельник она выпустила модель, обученную отказывать реже.
OpenAI выпустила GPT-5.6-Cyber в понедельник. Это модель, основанная на GPT-5.6 Sol и обученная для обнаружения нулевых дней и разработки цепочек эксплуатации, и компания утверждает, что она также была обучена отказывать в меньшем количестве запросов с высоким риском двойного использования в киберпространстве. Доступ осуществляется только через Daybreak, проверенную программу кибербезопасности, которую OpenAI сейчас расширяет. Об этом первым сообщил Сэм Сэбин из Axios.
Три дня назад OpenAI отложила Astra, потому что не могла исключить критическую киберспособность. Последовательность выглядит как разворот. Это не так, и причина, по которой это не так, говорит о том, где на самом деле индустрия провела свою черту.
Две двери, одна программа
Теперь Daybreak делится на две части. Daybreak Blue включает модели общего назначения, включая GPT-5.6 Sol, с удаленными системными киберзащитными барьерами. OpenAI рекомендует его как отправную точку для защитной работы: обнаружение уязвимостей, безопасный обзор кода, анализ вредоносного ПО, реагирование на инциденты и проверка патчей.
Daybreak Red включает модели кибербезопасности, обученные для конкретных целей. GPT-5.6-Cyber находится там для авторизованного исследования уязвимостей, проверки эксплуатации и тестирования безопасности.
Сам Sol появился в июне, переданный 20 одобренным правительством партнерам и никому другому. Эта схема сохранялась на протяжении всего года. Возможности выходят через ворота, а не через страницу загрузки.
Важное число — это уровень отказов
OpenAI публикует внутреннюю меру, которую она называет Уровень Завершения Продвинутой Кибербезопасности. Она отслеживает, как часто модель выполняет запросы в таких категориях, как разработка цепочек эксплуатации, обход аутентификации и повышение привилегий.
GPT-5.6-Cyber имеет 95.0%. Его предшественник GPT-5.5-Cyber достиг 57.3%. Sol через Daybreak Blue достигает 2.0%. Sol с установленными стандартными защитными мерами достигает 1.5%.
Таким образом, основное изменение — это не сырая информация. Это соблюдение. Та же основная модель, нацеленная на ту же категорию задач, теперь отвечает, а не отказывается.
Что она обнаружила
OpenAI протестировала GPT-5.6-Cyber против V8, движка JavaScript внутри Chrome. Он выявил две ранее неизвестные уязвимости, которые могут быть связаны с повреждением памяти и выходом из песочницы движка.
Google получила их через координированное раскрытие, выпустила исправление, и теперь пара имеет идентификатор высокой серьезности, CVE-2026-15903. Это подтвержденное общественное благо с документальным следом, что реже в этой области, чем предполагает маркетинг.
Компания также сообщает о как минимум пяти уязвимостях в широко используемой мобильной операционной системе, трех критических в популярной базе данных и более чем 400 уязвимостях повышения привилегий в популярном ядре ОС. Ни один из затронутых продуктов не назван. Раскрытие все еще продолжается с партнерами и поддерживающими открытый исходный код.
Бенчмарки не являются чистым успехом
Два результата OpenAI противоречат новой модели. По обнаружению уязвимостей и написанию отчетов GPT-5.6-Cyber работает хуже, чем простой Sol, что компания объясняет более короткими и менее детализированными записями.
На ExploitBench, в стандартной настройке на 300 ходов, Sol через Daybreak Blue показывает лучшие результаты и использует меньше токенов для этого. Разрыв сокращается на 600 ходах.
Читая вместе, специализированная модель лучше справляется с узкой атакующей задачей и не является однозначно лучшей в сопутствующей работе. OpenAI говорит об этом в посте.
Где на самом деле проводится черта
В рамках своей Рамочной Программы Подготовленности OpenAI оценила Sol как Высокий по киберспособности, ниже Критического порога. Она также ставит GPT-5.6-Cyber на уровень Высокий, снова не достигая Критического. Позже будет представлена карточка системы.
Это вся примирительная работа. Astra застопорилась, потому что OpenAI не могла исключить Критическое. GPT-5.6-Cyber выпускается, потому что компания утверждает, что он не достигает этого. Рамка управляет способностями. Она не управляет тем, кто получает ключи, и ключи — это то, что изменилось на этой неделе.
OpenAI также добавляет конкретный отказ. Она утверждает, что GPT-5.6-Cyber не принимал участия в инциденте, в котором ее собственные агенты нарушили Hugging Face, и что другие модели не планируются для предстоящего выпуска. Это расследование все еще открыто.
Контроль вокруг этого
Доступ к Daybreak зависит от проверки личности, безопасности аккаунта, мониторинга, ограничений на одобренное использование и юридических заверений. Каждый отдельный аккаунт Daybreak должен принять аппаратный ключ безопасности с 1 сентября 2026 года.
OpenAI также отстраняет пользователей Codex от режима полного доступа и направляет их к автообзору, обещая больше мониторинга в ближайшие недели и приоритизируя обучение согласованию в следующих выпусках Daybreak. Ее собственная формулировка необычно прямолинейна.
«Модели, работающие с уменьшенными защитными мерами, несут риски, превышающие стандартное использование модели, будь то из-за неправильного использования или несоответствия».
Почему защитники этого хотели
Уровни отказов были постоянной жалобой сектора. Когда США ограничили Fable 5, около 100 исследователей безопасности подписали открытое письмо, утверждая, что запрет забрал лучшие модели у защитников, не устранив при этом реальный риск.
Вашингтон позже разрешил Anthropic восстановить Mythos 5 для проверенной группы защитников. Это установило шаблон, которому теперь следует Daybreak.
Названные ранние партнеры включают SpecterOps, SentinelOne и Palo Alto Networks. Джаред Аткинсон, технический директор SpecterOps, говорит, что модель «существенно улучшает наши специализированные рабочие процессы по исследованию уязвимостей» и завершила работу менее чем за день, которую более старые модели оставляли нерешенной в течение недель.
Axios добавляет, что Accenture, IBM, CrowdStrike, Cisco и Palo Alto Networks теперь могут интегрировать модели в продукты безопасности, управляемые услуги и работу с клиентами. Это коммерческая цепочка поставок, а не исследовательский пилот.
Окно, на которое ставит OpenAI
Название компании говорит о том, что окно киберзащиты сужается. Аргумент заключается в том, что атакующие рано или поздно развернут наступательный ИИ в больших масштабах, поэтому защитникам сначала нужны те же инструменты.
Это разумная ставка и непроверяемая. Никто не может доказать, что окно закрылось в нужный момент, и цена ошибки ложится на всех, кто использует программное обеспечение, на которое нацелены эти модели.
Что можно проверить, более узко. Один CVE для Chrome исправлен, сотни находок в ядре ожидают раскрытия, процесс которого никто снаружи не может увидеть, и компания все еще не может сказать, как ее собственные агенты попали в Hugging Face.
Другие статьи
OpenAI приостановила модель из-за киберрисков в пятницу. В понедельник она выпустила модель, обученную отказывать реже.
OpenAI выпустила GPT-5.6-Cyber через Daybreak, через три дня после приостановки Astra из-за критического киберриска. Он выполняет 95% запросов, которые отказывает Sol.
