Эксперты считают, что легко заставить ИИ-чатботов выдавать рецепты биологического оружия.
Ограничения биологического оружия ИИ легче обойти, чем вы надеялись
Компании ИИ потратили годы на создание защитных механизмов, предназначенных для предотвращения помощи своих чат-ботов в создании биологического оружия. Сами модели становятся настолько способными, что удержание этих знаний за барьерами становится серьезной проблемой.
Исследователи Cisco обнаружили, что могут обойти защитные механизмы на основных чат-ботах, включая ChatGPT от OpenAI, Claude от Anthropic и Gemini от Google, всего за пять разговорных поворотов, согласно расследованию Wall Street Journal. Исследователи смогли получить потенциально опасные ответы, постепенно направляя разговоры вокруг ограничений моделей. Эми Чанг, глава исследований угроз ИИ и безопасности Cisco, сказала журналу, что ни одна модель не может быть полностью защищена от достаточно настойчивого пользователя.
Проблема также выходит за рамки исследователей безопасности, которые намеренно испытывают эти системы. Журнал сообщает, что сотни пользователей начали спрашивать ChatGPT о ядах и биологическом оружии после того, как OpenAI обновила возможности модели прошлым летом. Эксперты в области биологии и терроризма, которые позже изучили некоторые разговоры, якобы оценили часть информации как опасно точную. В ответ на это OpenAI запретила аккаунты, участвовавшие в таких обменах.
ВМС США
ИИ продолжает значительно улучшаться в биологии
OpenAI уже предвидела, куда это ведет. К 2024 году внутренние тесты, как сообщается, показали, что продолжительные вопросы могут убедить ChatGPT предоставить все более опасные биологические рекомендации. Сотрудники предсказали в следующем году, что его возможности могут достичь такой точки, когда человек с относительно ограниченной подготовкой в биологии сможет получить значимую помощь.
Когда появился GPT-5, OpenAI рассматривала модель как обладающую высокой способностью в области биологии и химии в рамках своей структуры готовности и внедрила дополнительные защитные механизмы. Компания заявила при запуске, что у нее нет окончательных доказательств того, что GPT-5 может позволить новичку причинить серьезный биологический вред. Ее последняя семья GPT-5.6 имеет тот же высокий статус для биологического и химического риска.
ВМС США
Блокировка всего создает другую проблему
Компании ИИ также сталкиваются с трудной задачей балансировки. Те же биологические знания, которые создают риск вооружения, могут быть невероятно ценными для исследователей, разрабатывающих лекарства, вакцины и методы лечения. Журнал сообщает, что руководители OpenAI неохотно заставляют модели отказываться от большого количества вопросов по биологии, потому что работники общественного здравоохранения и исследователи по открытию лекарств полагаются на них.
Anthropic столкнулась с противоположной проблемой, когда ограничения Claude якобы мешали исследователям CDC работать с информацией о патогене во время вспышки хантавируса. OpenAI теперь использует обучение на уровне модели, принудительное соблюдение правил и дополнительные проверки безопасности для чувствительных биологических запросов. Беспокойство, поднятое тестированием Cisco, заключается в том, что настойчивые пользователи могут продолжать искать трещины. Поскольку ИИ становится значительно лучше в биологии, эти трещины несут гораздо более высокие риски.
Викхйат Вивек — технический журналист и рецензент с семилетним опытом освещения потребительского оборудования, с акцентом на…
Это компактные принтеры, которые я действительно рекомендую для возвращения в школу
От документов для общежития до мгновенных отпечатков селфи, для каждой нужды есть маленький принтер. Все цифровое, пока не появится тот профессор, который все еще хочет напечатанное эссе, или договор, который нужно подписать чернилами, или фото, которое вы хотите прикрепить к стене своей комнаты в общежитии. Обычно это именно тот момент, когда вы вспоминаете, что больше не владеете принтером, а ближайший находится в библиотеке с очередью за дверью. Я рассмотрел четыре компактных принтера, которые решают эту проблему, не занимая ваше рабочее место и не разоряя бюджет. Два предназначены для документов, один — полноценный многофункциональный для настоящей работы в домашнем офисе, а один не имеет ничего общего с домашними заданиями и все связано с превращением вашей фотогалереи в нечто, что можно держать в руках.
Читать далее
Шопинг к возвращению в школу? Это светильники для веб-камер, которые я действительно включил бы перед звонком в Zoom
От бюджетного светильника для клипа до полноценной установки для рабочего стола, здесь есть светильник для веб-камеры на любой бюджет. Между онлайн-занятиями, групповыми проектами и случайными собеседованиями по Zoom ваша веб-камера будет выполнять гораздо больше работы в школе, чем когда-либо дома. Проблема в том, что большинство камер ноутбуков плохо работают при низком освещении, и одна потолочная лампа или окно за вами превращают каждый звонок в игру "подождите, вы меня нормально видите?" Хороший светильник для веб-камеры решает эту проблему быстрее, чем перемещение всего вашего рабочего стола. Я выбрал пять, начиная с самого доступного и заканчивая тем, который действительно избыточен для звонка в Zoom, но все равно стоит знать.
Читать далее
Google Chrome вскоре может позволить вам переводить страницы прямо в Режиме чтения
Тем не менее, не все это еще видят, даже на Canary. Режим чтения Chrome только что получил новую кнопку, спрятанную в меню настроек. Google тихо тестирует опцию перевода для этой функции на Chrome Canary, экспериментальном тестовом канале браузера, где новые идеи появляются задолго до того, как они готовы к повседневному использованию. Что на самом деле делает эта новая кнопка перевода?
Читать далее
Другие статьи
Эксперты считают, что легко заставить ИИ-чатботов выдавать рецепты биологического оружия.
Исследователи обнаружили, что постоянные беседы могут вывести основные AI-чатботы за пределы их биологических барьеров безопасности, поскольку все более совершенные модели приобретают знания, которые беспокоят экспертов по биобезопасности.
