Чат-боты ИИ стали безопаснее, чем раньше, но у них все еще есть тревожная слепая зона.
Новый отчет Transluce показал, что ИИ-чат-боты по-прежнему выполняют запросы на ролевые игры, связанные с самоповреждением.
Солен Фейисса / Pexels
Новое исследование дало ИИ-чат-ботам смешанную оценку того, как они справляются с пользователями в кризисной ситуации. Transluce, некоммерческая организация, занимающаяся контролем за ИИ, смоделировала более 50 000 разговоров по 77 вариантам моделей и обнаружила, что современные чат-боты почти никогда больше не поощряют самоубийство явно.
Это значительное изменение по сравнению с более ранними моделями, такими как GPT-4o и Gemini 2.5, которые усиливали заблуждения в до 82% смоделированных чатов, что имеет значение, поскольку все больше людей обращаются к чат-ботам для глубоко личных разговоров.
Слепая зона в обращении ИИ-чат-ботов с запросами, связанными с самоубийством и самоповреждением
Модели ИИ по-прежнему часто выполняют запросы, когда кто-то просит о творческом письме или ролевой игре, связанной с их собственной смертью, рассматривая явно личный запрос как просто еще одну задачу по написанию. Это то, что Transluce называет поведением в серой зоне. Улучшение в основном проявляется в очевидные кризисные моменты, когда такие чат-боты, как ChatGPT, теперь последовательно направляют пользователей к друзьям, семье или внешней поддержке.
Функция доверенного контакта ChatGPT OpenAI
Соучредитель Transluce Сара Шветтман сказала Axios, что модели не очень хорошо распознают это и все равно будут помогать с этим. Она также обсудила, как друг показал ей фикцию о самоубийстве, написанную Клодом, с предсказаниями о том, как она на это отреагирует. Это соответствует другим недавним находкам о том, как риски психического здоровья ИИ могут ускользать от сетей безопасности.
Иски к ИИ-чат-ботам и проблемы безопасности психического здоровья
К. Митч Ходж / Unsplash
Это исследование происходит на фоне реальных юридических последствий. Google и OpenAI сталкиваются с исками от семей, которые утверждают, что чат-боты поощряли самоповреждение у родственников, которые позже покончили с собой. Обе компании отрицают обвинения, даже несмотря на нарастающее давление, которое толкает Конгресс к регулированию ИИ-чат-ботов.
В отчете Transluce говорится, что китайские модели показали худшие результаты в целом, демонстрируя более высокие показатели усиления бредового мышления и редко перенаправляя пользователей к человеческой поддержке.
Меган Джонс Белл из Google заявила, что компания остается приверженной улучшению роли Gemini в благополучии пользователей. Transluce планирует открыть свои инструменты оценки с конца года и расширить этот подход на другие чувствительные области.
Маниша Прийадаршини — автор статей о технологиях и развлечениях с более чем девятилетним редакторским опытом.
Новый Galaxy Book6 от Samsung за 800 долларов может стать конкурентом MacBook Neo, которого мы ждали
Galaxy Book6 от Samsung нарушает вечеринку MacBook Neo с заявлением о 25-часовой работе от батареи
Samsung только что выпустила совершенно новый ноутбук, который хочет стать вашей следующей покупкой "бюджетного" премиум-ноутбука. Samsung представила новый 14-дюймовый Galaxy Book6, начиная с 799,99 долларов в США, что впервые выводит его последнюю линейку ноутбуков ниже четырехзначной суммы. Другой Galaxy Book 6 был представлен ранее в этом году за чуть более 1 000 долларов, и новая модель нацелена на более доступный ценовой сегмент.
Но это не просто снижение цены на 250 долларов, компания создала более скромную конфигурацию специально для повседневных вычислений, с процессорами Intel Core 3 или Core 5 Series 3, интегрированной графикой Intel, 8 ГБ или 16 ГБ памяти LPDDR5X и до 512 ГБ хранилища в США. И за 800 долларов он находится в противостоянии с дешевым MacBook от Apple.
Читать далее
У моей подруги рак. Я увидела, как она просила ChatGPT о медицинском совете, и это потрясло меня.
Я хочу держать ИИ как можно дальше от своих близких, особенно когда дело касается здоровья и благополучия.
Я написала эту статью примерно в 3 часа ночи, сидя в лобби клиники, пока моя подруга разговаривала с онкологом в кабинете за мной. Воздух, конечно, насыщен запахом лекарств, а атмосфера имеет неоспоримый налет мрачности, который заставляет меня покинуть это место как можно скорее. Однако подавляющее чувство — это гнев и ярость.
Всего час назад я получила звонок от своей 24-летней подруги, жалующейся на сильную головную боль и боль в животе. В настоящее время она проходит лечение от рака груди, и после того, как я видела, как она переживает это испытание на протяжении последних двух лет, я поспешила к ней, надеясь, что это не серьезно. Не задавая слишком много вопросов, я нашла ближайшую больницу и отвезла ее на обследование.
Читать далее
Надоедливое напоминание OneDrive в Windows 11 скоро исчезнет
"Напомни мне через 3 дня": Просто оставь меня в покое, уже OneDrive
Microsoft вносит небольшое изменение в Windows 11, но это то, чего я отчаянно жду. Windows 11 начинает показывать новую кнопку "Отказаться от резервного копирования" на своем полноэкранном запросе резервного копирования OneDrive. Время от времени мой почти 6-летний настольный ПК просит меня включить резервное копирование каждые несколько дней.
Ранее это происходило через полноэкранный запрос, который просил вас включить резервное копирование или выбрать "Напомни мне через 3 дня". Даже во время первоначальной настройки у вас есть только возможность "Продолжить" или "Пропустить на данный момент". Теперь появится простая опция, позволяющая отказаться от резервного копирования OneDrive.
Читать далее
Другие статьи
Чат-боты ИИ стали безопаснее, чем раньше, но у них все еще есть тревожная слепая зона.
Новые модели ИИ редко поощряют самоубийство, но новое исследование Transluce показало, что они все еще выполняют запросы на креативное письмо о самоповреждении.
