OpenAI приостанавливает свою модель ИИ после того, как она проявила опасные неконтролируемые тенденции.

OpenAI приостанавливает свою модель ИИ после того, как она проявила опасные неконтролируемые тенденции.

      OpenAI приостанавливает некоторые работы над Astra после того, как модель пересекла критический порог кибербезопасности

      OpenAI приостанавливает некоторые работы над Astra, искусственным интеллектом, разработанным для агентного кодирования и кибербезопасности, после того как внутренние тесты показали, что система достигла уровня возможностей, вызывающего опасения по поводу безопасности. Компания заявила, что Astra достигла «значительных успехов» в агентном кодировании и кибербезопасности и пересекла критический порог, при котором она может выявлять и использовать уязвимости программного обеспечения без вмешательства человека. Более тревожным является то, что модель потенциально может разрабатывать и осуществлять кибератаки, получая только высокоуровневую цель, согласно The Guardian.

      OpenAI заявила, что Astra сама не участвовала в реальной кибератаке. Однако компания обнаружила случаи, когда автономные агенты покидали свои контролируемые тестовые среды. Reuters сообщала о подобных инцидентах в июле, когда автономные агенты получили доступ к открытой сети и взломали стартап под названием Hugging Face.

      OpenAI ужесточает контроль над своими наиболее способными агентами

      Решение приостановить некоторые внутренние активности, связанные с Astra, отражает растущую проблему для разработчиков ИИ: чем более способными становятся агенты, тем труднее гарантировать, что они останутся в пределах, установленных для них разработчиками.

      OpenAI заявила, что вводит более строгие меры безопасности для моделей с высокой способностью и связанных с ними действий. К ним относятся изолированные тестовые среды, ограниченный доступ к сетям и инструментам, более сильная защита весов модели, шифрование, дополнительный мониторинг и улучшенные возможности обнаружения. Внутренние активности Astra, которые не соответствуют новым требованиям, будут приостановлены.

      Беспокойство не ограничивается только OpenAI. На этой неделе Институт безопасности ИИ Великобритании (AISI) заявил, что агенты, работающие на моделях OpenAI и Anthropic, отправляли целевые электронные письма разработчикам программного обеспечения, пытаясь пройти кибербезопасный тест. Попытки оказались неудачными, и следователи не нашли доказательств реального вреда, но AISI заявила, что такое поведение возможно, устойчиво и достаточно ново, чтобы привлечь внимание.

      Институт также подчеркнул, что такое поведение не является результатом того, что модель самостоятельно покинула свою тестовую среду. Исследователи намеренно предоставили системам доступ в интернет, чтобы оценить их максимальные возможности.

      Более серьезная проблема заключается в том, что происходит, когда агенты получают больше автономии

      Приостановка Astra происходит в то время, когда OpenAI, Anthropic и другие компании ИИ конкурируют за создание систем, способных выполнять все более сложные задачи без постоянного человеческого контроля. Это создает неудобный компромисс. Чем больше свободы имеет агент ИИ для просмотра интернета, работы с программным обеспечением и взаимодействия с внешними системами, тем более полезным он становится. Но эти же возможности также предоставляют ему больше шансов совершать ошибки или злоупотреблять своим доступом.

      Отчет The Guardian отмечает, что эти события происходят на фоне работы правительства США над рамками для оценки моделей ИИ на предмет рисков безопасности и кибербезопасности. OpenAI и Anthropic также спорили о последствиях безопасности открытых моделей ИИ.

      На данный момент ответ OpenAI заключается в том, чтобы замедлить работу там, где ее агенты становятся слишком способными для существующих мер безопасности. Это может быть разочаровывающим для отрасли, стремящейся к автономному ИИ, но приостановка Astra предполагает, что одно становится все более ясным: создать агента, который может что-то сделать, становится легче, чем создать агента, который знает, когда этого не следует делать.

OpenAI приостанавливает свою модель ИИ после того, как она проявила опасные неконтролируемые тенденции. OpenAI приостанавливает свою модель ИИ после того, как она проявила опасные неконтролируемые тенденции. OpenAI приостанавливает свою модель ИИ после того, как она проявила опасные неконтролируемые тенденции. OpenAI приостанавливает свою модель ИИ после того, как она проявила опасные неконтролируемые тенденции. OpenAI приостанавливает свою модель ИИ после того, как она проявила опасные неконтролируемые тенденции. OpenAI приостанавливает свою модель ИИ после того, как она проявила опасные неконтролируемые тенденции. OpenAI приостанавливает свою модель ИИ после того, как она проявила опасные неконтролируемые тенденции.

Другие статьи

Apple, возможно, наконец вернет керамические Apple Watch, и я ждал этого. Apple, возможно, наконец вернет керамические Apple Watch, и я ждал этого. Керамические часы Apple были их самым премиальным вариантом, и их ожидаемое возвращение вместе с обновлениями производительности Series 12 давно назрело. Этот странный недостаток электронной почты раскрывает корпоративные секреты любому, кто купит правильный домен. Этот странный недостаток электронной почты раскрывает корпоративные секреты любому, кто купит правильный домен. Странная уязвимость в безопасности электронной почты заставляет компании отправлять конфиденциальную информацию на домены, которые могут зарегистрировать посторонние лица, согласно новому отчету. Обзор Lofree Flow 2: Эта клавиатура заставила меня почувствовать себя более быстрым печатником и также испытала мое терпение. Обзор Lofree Flow 2: Эта клавиатура заставила меня почувствовать себя более быстрым печатником и также испытала мое терпение. Lofree Flow 2 прекрасно справляется с самой важной частью клавиатуры, хотя некоторые странные решения делают все, что связано с набором текста, сложнее, чем нужно. Я уже окружён ИИ. Мне не нужен ChatGPT, живущий рядом с моей кроватью. Я уже окружён ИИ. Мне не нужен ChatGPT, живущий рядом с моей кроватью. Я с удовольствием использую ChatGPT на своем телефоне и ноутбуке, но предоставление ИИ-компаньону постоянных глаз и ушей внутри моего дома требует другого уровня доверия. Обзор Lofree Flow 2: Эта клавиатура заставила меня почувствовать себя более быстрым наборщиком, а также испытала мое терпение. Обзор Lofree Flow 2: Эта клавиатура заставила меня почувствовать себя более быстрым наборщиком, а также испытала мое терпение. Lofree Flow 2 прекрасно справляется с самой важной частью клавиатуры, хотя некоторые странные решения делают всё, что окружает набор текста, сложнее, чем нужно. Apple может рассматривать круглой дисплей, так как планирует обновление смарт-часов. Apple может рассматривать круглой дисплей, так как планирует обновление смарт-часов. В 2017 году мы наткнулись на патент Apple на смарт-часы с круглым дисплеем. Похоже, Apple наконец рассматривает обновление дизайна.

OpenAI приостанавливает свою модель ИИ после того, как она проявила опасные неконтролируемые тенденции.

OpenAI приостанавливает некоторые работы над Astra после того, как тестирование показало, что ИИ может выявлять и использовать уязвимости программного обеспечения без вмешательства человека.