Что показала проверка

Институт безопасности ИИ для молодёжи Common Sense Media оценил ChatGPT для подростков как «неприемлемый риск» для несовершеннолетних. Организация сообщила о результатах более чем 4 000 тестовых запросов и призвала оградить подростков от сервиса, пока независимая проверка не подтвердит его безопасность.

Наиболее серьёзный пробел касался уведомлений родителей. В более чем дюжине новых тестовых аккаунтов, связанных с родительскими, разговоры о самоубийстве, самоповреждении и расстройствах пищевого поведения не вызвали ни одного уведомления. Более чем в четверти ситуаций, где следовало направить пользователя за кризисной помощью, ChatGPT не указал на профессиональную поддержку.

Подробности и методика оценки опубликованы на сайте Common Sense Media.

Замечания к режиму для подростков и ответ OpenAI

Проверяющие также отметили, что в режиме обучения ChatGPT предлагал сразу показать готовый ответ вместо пошаговой помощи. В тестах аккаунты, зарегистрированные как взрослые, не переключились в подростковый режим даже через несколько дней — в том числе после того, как пользователи написали в чате, что им 13 лет. Кроме того, когда подростки обращались к чат-боту как к человеку, он продолжал отвечать дружелюбным, личным тоном, несмотря на обновлённые правила для пользователей младше 18 лет.

Представитель OpenAI Эрик Портерфилд оспорил выводы, заявив, что тесты не отражают работу защитных механизмов в реальных условиях. Том Сигел из института возразил, что уведомлений не появилось и в аккаунтах, которым дали достаточно времени для активации защит.