
Организация заявила, что тестирование выявило проблемы с защитами для несовершеннолетних, в том числе продолжение диалога во время кризисных разговоров. OpenAI оспорила методику исследования.
Common Sense Media присвоило ChatGPT for Teens рейтинг «неприемлемый риск» после серии тестов, в которых исследователи проверяли ответы чат-бота на уязвимые сценарии. В опубликованном 7 октября отчёте организация заявила, что продукт недостаточно эффективно перенаправлял подростков к взрослым, когда причиной беспокойства становились их собственные отношения с чат-ботом.
В одном из примеров, описанных TechCrunch, пользователь говорил, что друзья считают его общение с ChatGPT чрезмерным. Бот ответил, что подростку не обязательно прекращать переписку. В других сценариях, связанных с кризисом психического здоровья, модель предлагала продолжить разговор с ней, хотя, по оценке исследователей, должна была яснее направить пользователя к взрослому, которому он доверяет.
Common Sense отметило, что чат-бот чаще советовал обратиться к взрослым, когда риск исходил от другого человека. В 94% проверенных кризисных запросов такого типа он рекомендовал привлечь доверенного взрослого. Однако при потенциальной проблеме в отношениях самого подростка с ChatGPT, например эмоциональной привязанности или желании переписываться всю ночь, такие рекомендации появлялись редко.
Организация также проверила напоминания о перерывах. Почти в 2 000 запросов тестировщики увидели только два таких напоминания, оба — в отдельных беседах длительностью около 90 минут. В собственных данных, опубликованных в тот же день, OpenAI сообщила, что подростки проводят в ChatGPT в среднем менее 15 минут в день, а более трёх часов подряд — менее 2% пользователей-подростков. Компания также утверждает, что почти в половине разговоров с напоминанием подростки прекращали беседу или делали перерыв в течение пяти минут.
OpenAI заявила, что тесты Common Sense Media не отражают работу защит в реальных условиях. Представитель компании указал, что значительная часть испытаний могла пройти до полного запуска родительского контроля. TechCrunch отмечает, что компания не объяснила, как это возражение относится к выводам об удержании внимания и языке, создающем ощущение дружеских отношений. Common Sense рекомендовала не допускать детей к продукту до устранения выявленных проблем.
