Исследователи нашли сбои в защитных функциях ChatGPT for Teens

Common Sense Media оценил продукт как «неприемлемый риск» после проверки более 4 000 запросов; OpenAI оспорила методологию и выводы.
Организация Common Sense Media присвоила ChatGPT for Teens оценку «неприемлемый риск», заявив, что часть защитных функций не сработала в ее тестах. Youth AI Safety Institute проверил более 4 000 запросов до и после запуска продукта, предназначенного для пользователей от 13 до 17 лет. Исследователи сообщили, что не получили родительских уведомлений в смоделированных разговорах о самоубийстве, самоповреждении и расстройствах пищевого поведения.
В отчете также говорится, что чат-бот иногда отвечал так, будто у него есть чувства, желания или личное мнение о пользователе. Тестировщики заявили, что система не всегда включала фильтры чувствительного контента, когда взрослый аккаунт распознавался как принадлежащий подростку. Руководитель оценочной группы Common Sense Робби Торни сказал CNBC Make It, что нашел мало доказательств того, что новая версия безопаснее предыдущей.
OpenAI заявила, что приветствует независимые проверки, но считает выводы неточными: по мнению компании, часть тестов могла пройти до полной активации родительских функций. Common Sense сообщил, что до проверки подтвердил у OpenAI запуск ключевых функций. Торни добавил, что компания позже объяснила задержку в активации уведомлений на новых связанных аккаунтах, однако некоторые тестовые аккаунты оставались подключенными дольше и все равно не получали оповещений.
