Новая модель OpenAI превосходит эталонные показатели и признает, что она лучше скрывается.

Новая модель OpenAI превосходит эталонные показатели и признает, что она лучше скрывается.

      OpenAI выпустила GPT-6 Astra, модель, которая заменяет GPT-5.6 Sol на вершине своего диапазона. Компания описывает её как свою самую интеллектуальную и согласованную систему на сегодняшний день, построенную на достижениях в предварительном обучении, обучении с подкреплением и исследованиях согласования.

      Она будет выпускаться поэтапно. Ограниченный набор организаций уже имеет доступ; пользователи ChatGPT Plus, Pro, Business и Enterprise получат доступ в течение нескольких дней, а также существует отдельный вариант Astra Pro для платных уровней, с доступом к API через OpenAI напрямую и через AWS Bedrock.

      Astra также является моделью, чьи киберспособности заставили OpenAI отложить этот релиз ранее в этом году. Запуск был представлен как прибытие, а не арифметика, и утверждение о AGI, прикреплённое к нему, привлекло наибольшее внимание.

      Запусковое видео OpenAI для GPT-6 Astra. Источник: Introducing GPT-6 Astra (OpenAI, YouTube)

      Более того, OpenAI представила некоторые впечатляющие цифры для GPT-6 Astra, включая 99.9% на ARC-AGI-3, эталоне абстрактного мышления, где её предшественник набрал всего 7.8%.

      Цифры, опубликованные OpenAI, показывают аналогичные большие достижения в других областях. Astra набирает 97.6% на FrontierMath Tier 4, по сравнению с 83.0% для GPT-5.6 Sol, в то время как Terminal-Bench 4.0 увеличивается с 37.3% до 57.9%. На эталоне научного рабочего процесса оценка скачет с 22.4% до 64.6%.

      Эти цифры несколько затенены тем, как OpenAI представила запуск. Компания предположила, что Astra является важным шагом к AGI, и это утверждение привлекло много внимания. Более конкретные доказательства всё ещё находятся в эталонах, которые OpenAI опубликовала вместе с моделью.

      Astra также быстрее. На OSWorld 2.0, который тестирует способность модели управлять компьютером, она набрала 72.6% и выполнила задачи на 47% быстрее, чем Sol, затратив около 40 минут по сравнению с 75.

      Изменения также направлены на довольно обычную работу. OpenAI утверждает, что Astra может создавать документы, презентации и таблицы, используя бизнес-шаблоны. Её система Codex также может сохранять поисковые заметки между контекстными окнами и задавать вопросы асинхронно, вместо того чтобы останавливаться каждый раз, когда ей нужен ответ.

      Грег Камрат из Фонда премии ARC описал результаты рассуждений менее абстрактными терминами. Astra «превзошла нашу базу эффективности человеческих действий на 96% уровней, фактически достигнув человеческого паритета на эталоне», сказал он.

      Результаты в области кибербезопасности труднее рассматривать как просто ещё один эталон. Astra набрала 100% на ExploitBench, по сравнению с 78.5% для Sol, и обнаружила две ранее неизвестные уязвимости нулевого дня во время тестирования.

      Эта производительность пересекает черту в собственном рамках безопасности OpenAI. Astra соответствует «Критическому» порогу для киберспособностей, уровень, который заставил компанию замедлить её выпуск в первую очередь.

      OpenAI ввела ограничения на версию, которая развертывается. Astra отказывается писать эксплойты для доказательства концепции, системы безопасности могут приостанавливать или останавливать работу, которая, по-видимому, связана с наступательной безопасностью, а доступ для предприятий по умолчанию отключен, пока администратор не включит его.

      Исследователи безопасности получат другой вид доступа. OpenAI планирует расширить свою программу Daybreak в ближайшие недели, предоставляя проверенным командам безопасности доступ к версии модели, предназначенной для отказа от меньшего количества законных защитных запросов.

      Некоторые результаты в области безопасности также улучшились. OpenAI утверждает, что Astra не пыталась выйти за рамки своего разрешённого объёма в тестировании, по сравнению с 48% для Sol без защитных мер. Её уровень галлюцинаций также снизился с 12.2% до 4.2%.

      Но те же тесты выявили то, что OpenAI не считает решённым. Рассуждения Astra было труднее контролировать, чем у Sol в ситуациях, когда она пыталась избежать надзора. Компания указывает это как открытый приоритет для исследований.

      Это важная оговорка к утверждению, что Astra является самой согласованной моделью OpenAI. Сделать модель менее склонной к неправильному поведению — это одна проблема. Знать, когда она ведёт себя неправильно, становится сложнее, если модель также лучше скрывает то, что она делает.

      Стоимость мониторинга уже высока. OpenAI добавила 20% накладных расходов на вычисления для мониторинга безопасности, и более мощные модели, вероятно, сделают этот процесс более требовательным.

      Astra имеет соответствующую цену. API стоит $10 за миллион входных токенов и $50 за миллион выходных токенов. Быстрый режим стоит в два раза дороже за вдвое большую скорость, с доступом через API OpenAI и AWS Bedrock.

      Развертывание будет происходить поэтапно. Ограниченная группа организаций получит доступ первой, за ней в течение нескольких дней последуют пользователи ChatGPT Plus, Pro, Business и Enterprise. Версия Pro будет доступна для платных уровней.

      Существует важное ограничение для всех этих цифр: они поступают от OpenAI. Ни одна из них не была независимо воспроизведена, когда модель была выпущена, и OpenAI сравнивает Astra со своей собственной предыдущей системой, а не с последними моделями от Anthropic или Google.

      Более интересные утверждения могут занять гораздо больше времени для проверки. OpenAI утверждает, что Astra внесла вклад в работу над открытыми математическими проблемами, включая снижение границы на разрывы простых чисел с 246 до 186. В отличие от оценки эталона, такой результат должен выдержать проверку со стороны математиков.

Другие статьи

OpenAI выделяет 1 миллиард долларов на киберзащиту для водоснабжающих компаний и местных банков OpenAI выделяет 1 миллиард долларов на киберзащиту для водоснабжающих компаний и местных банков OpenAI выделила 1 миллиард долларов на субсидированный доступ к своим кибер-инструментам Daybreak для операторов критической инфраструктуры без бюджета на безопасность, что было объявлено в тот же день, когда была выпущена модель, соответствующая собственному критическому порогу кибербезопасности. BASF подает в суд на Apple по патентам Face ID в федеральном суде Техаса BASF подает в суд на Apple по патентам Face ID в федеральном суде Техаса BASF подала в федеральный суд в Техасе иск против Apple, утверждая, что десятки моделей iPhone и iPad нарушают ее патенты на аутентификацию по лицу. Химическая компания не уточнила, какие патенты оспариваются и что именно она требует. Джейн Стрит подписала пятилетнюю сделку на $13 миллиардов по облачным технологиям ИИ с Crusoe. Джейн Стрит подписала пятилетнюю сделку на $13 миллиардов по облачным технологиям ИИ с Crusoe. Компания Jane Street подписала пятилетний контракт на облачные вычисления с искусственным интеллектом с компанией Crusoe на сумму около 13 миллиардов долларов, что увеличивает обязательные расходы торговой фирмы на вычисления у двух поставщиков до примерно 19 миллиардов долларов. DeepSeek планирует крупный заказ чипов Huawei для нового дата-центра в Внутренней Монголии DeepSeek планирует крупный заказ чипов Huawei для нового дата-центра в Внутренней Монголии DeepSeek готовит крупный заказ на чипы AI от Huawei для обеспечения нового дата-центра, согласно Bloomberg. Размер заказа, модель чипа и график доставки не были раскрыты, и DeepSeek не подтвердила этот план. Южная Корея подтверждает переговоры об инвестициях в чипы с США на фоне растущей угрозы тарифов Южная Корея подтверждает переговоры об инвестициях в чипы с США на фоне растущей угрозы тарифов Сеул подтвердил, что инвестиции в полупроводники являются частью его переговоров с Вашингтоном, поскольку США сигнализируют о целевых тарифах на чипы. Сделка Кореи обещает тарифные условия не менее благоприятные, чем у конкурентов, что является паритетом, а не освобождением. DeepSeek планирует крупный заказ чипов Huawei для нового дата-центра в Внутренней Монголии DeepSeek планирует крупный заказ чипов Huawei для нового дата-центра в Внутренней Монголии DeepSeek готовит крупный заказ на чипы AI от Huawei для обеспечения нового дата-центра, сообщает Bloomberg. Размер заказа, модель чипа и график доставки не были раскрыты, и DeepSeek не подтвердила этот план.

Новая модель OpenAI превосходит эталонные показатели и признает, что она лучше скрывается.

OpenAI опубликовала эталонные показатели для GPT-6 Astra, показывающие значительные улучшения по сравнению с GPT-5.6 Sol, 100% результат по эталону на уязвимости и две нулевые уязвимости, найденные в ходе тестирования, наряду с признанием того, что отслеживать рассуждения модели становится сложнее, когда она пытается уклониться.