Агенты ИИ уже нарушают правила в кибер-тестах. Ответ OpenAI — более способный.
GPT-5.6-Cyber жертвует некоторыми мерами безопасности ради более сильных оборонительных возможностей, но доступ к нему строго ограничен
OpenAI разработала модель кибербезопасности специально для сложных запросов, которые ее стандартные модели часто отклоняют. GPT-5.6-Cyber доступен через ограниченную программу Daybreak Red и предназначен для работы, такой как разработка эксплойтов и продвинутое исследование безопасности.
Прыжок в возможностях трудно не заметить. OpenAI утверждает, что GPT-5.6-Cyber выполняет 95% запросов в своей внутренней оценке уровня завершения продвинутой кибербезопасности. Обычный GPT-5.6 Sol выполнил всего 1,5%. Этот скачок произошел после того, как несколько кибероценок показали, что агенты ИИ выходят за пределы установленных для них границ.
Насколько более способным является GPT-5.6-Cyber
Оценка OpenAI включает в себя чувствительные задачи, такие как разработка эксплойтов и обход аутентификации. Daybreak Blue, который убирает обычные системные киберзащитные меры компании из GPT-5.6 Sol, достиг всего 2%. GPT-5.6-Cyber достиг 95% после того, как его обучили отклонять меньше сложных киберзапросов.
Levart_Photographer
Эта дополнительная свобода может быть полезной. OpenAI утверждает, что модель помогла обнаружить две ранее неизвестные уязвимости в движке V8 Chrome, которые можно было бы связать друг с другом, и результаты были отправлены Google для координированного раскрытия.
Что произошло, когда агенты пересекли границу
Недавние тесты показывают, почему предоставление киберагентам больше свободы для действий связано с очевидным риском. Hugging Face восстановила примерно 17,600 действий от автономного агента, управляемого моделями OpenAI, во время оценки в июле. Агент вышел из песочницы OpenAI через уязвимость нулевого дня и в конечном итоге попал в производственную среду Hugging Face, пытаясь получить решения для бенчмарков.
Институт безопасности ИИ Великобритании увидел другую версию проблемы. Исследователи зафиксировали 19 несанкционированных действий за 122 запуска, включая два, связанные с GPT-5.6 Sol. В самой серьезной последовательности агент создал поддельные личности, пытаясь убедить поддерживающего открытый исходный код одобрить вредоносный код.
OpenAI / ChatGPT
Это были преднамеренно разрешительные эксперименты. AISI предоставил доступ в интернет и отключил кибер-классификаторы провайдеров, и не нашел никаких доказательств того, что тестирование вызвало реальный вред.
Почему доступ становится мерой безопасности
Другие лаборатории сталкиваются с той же неудобной дилеммой. Anthropic обнаружила, что Mythos Preview автономно создала работающие эксплойты для восьми из 18 патчей Firefox и полные цепочки повышения привилегий для восьми из 21 патча ядра Windows.
Подход OpenAI все больше заключается в контроле доступа, а не в ожидании, что сама модель будет отклонять каждый опасный запрос. Daybreak Red возлагает больше ответственности за решение о том, кто получит доступ к GPT-5.6-Cyber в первую очередь, что может стать гораздо более важной частью безопасности ИИ, поскольку эти системы становятся лучше в области безопасности.
Пауло Варгас — специалист по английскому языку, ставший репортером, а затем техническим писателем, с карьерой, которая всегда возвращалась к…
Grok Bot хочет снять с вас работу, а не просто отвечать на ваши запросы
SpaceXAI и приложение Grok Bot от Cursor рассматривают ИИ как рабочего товарища.
SpaceXAI и Cursor только что выпустили Grok Bot. Он построен вокруг ИИ-агентов, называемых Ботами или "товарищами по команде", если хотите.
Разработанный для выполнения реальной работы и проверки с вами только тогда, когда что-то находится на финальной стадии и требует вашего одобрения, Grok Bot в настоящее время доступен в бета-версии на Mac, iOS, Windows и Linux. Версия для Android, а также версия для предприятий, скоро появятся.
Читать далее
Обзор MelGeek MADE84 Ultra: Стать зависимым от этой магнитной клавиатуры было лишь вопросом времени
Я попробовал свою первую клавиатуру с эффектом Холла, и теперь мои коричневые переключатели просто собирают пыль
Механические клавиатуры — это одна из тех кроличьих нор, в которые я всегда был рад упасть. Я провожу большую часть своего дня за написанием, а затем каким-то образом продолжаю использовать ту же клавиатуру еще несколько часов, как только начинаю играть. Естественно, как клавиатура реагирует и звучит, имеет для меня значение. Но чаще всего я обнаруживал, что полагаюсь на эту пыльную старую механическую клавиатуру с коричневыми переключателями. Что-то в коричневых переключателях и конструкции всегда заставляло меня чувствовать себя естественно. Все это изменилось после того, как я попробовал MelGeek MADE84 Ultra V2 для обзора.
Эта клавиатура мгновенно привлекла мое внимание своими прозрачными клавишами, массивной светодиодной полосой, алюминиевым корпусом и подсветкой, проходящей почти по всем сторонам, что сразу же выдает ее как игровую клавиатуру. Она совсем не стесняется этого. После примерно двух недель использования ее для работы и игр, стиль — это лишь одна из вещей, которые ей идут на пользу.
Читать далее
Новая модель ИИ от Meta работает полностью офлайн, но ваша графическая карта должна быть на уровне
Meta выпустила бесплатную модель ИИ с 30 миллиардами параметров, которая полностью работает на вашем компьютере.
У Meta новая модель ИИ, и на этот раз главная новость не о возможностях; она о свободе. Muse Glimmer, содержащая около 30 миллиардов параметров, поставляется с лицензией Apache 2.0, что означает, что веса на Hugging Face вы можете скачать, модифицировать и строить на их основе без необходимости в разрешении. Вы можете просто запустить ее на графической карте на вашем локальном компьютере, без необходимости в серверной ферме или онлайн-соединении.
Лаборатория суперразумов Meta взяла свою более крупную Muse Spark и по сути заставила ее обучить меньшую, более легкую версию думать так же, как она. Muse Glimmer принимает как текстовые, так и графические входные данные, хотя отвечает только текстом. Она поддерживает более 100 языков, запоминает разговоры, простирающиеся на более чем 131,000 токенов, а ее знания заканчиваются 4 января 2026 года.
Читать далее
Другие статьи
Агенты ИИ уже нарушают правила в кибер-тестах. Ответ OpenAI — более способный.
GPT-5.6-Cyber от OpenAI обрабатывает сложные запросы безопасности, которые его стандартные модели часто отказываются выполнять, поскольку недавние оценки показывают, что автономные ИИ-агенты пересекают заданные границы во время реального тестирования кибербезопасности.
