Anthropic введёт запрет на систематическое жестокое обращение с Claude

Anthropic включила в новую политику использования запрет на продолжительное и беспричинное жестокое обращение со своими моделями. Правила начнут действовать 12 ноября 2026 года.
Компания относит новый пункт к ограничениям на жестокое, агрессивное и психологически вредное поведение. Как сообщает Lenta.ru со ссылкой на The Verge, речь идёт о крайних случаях повторяющегося обращения без очевидной цели, а не об обычном недовольстве ответами Claude.
Критика работы чат-бота, споры с ним, обсуждение мрачных тем и исследования или тестирование модели не подпадают под этот запрет сами по себе. Anthropic связывает изменения в том числе с изучением возможного благополучия ИИ. Вопрос о сознании и моральном статусе современных моделей компания считает открытым.
Новая редакция также уточняет ограничения на дезинформацию, политические манипуляции, разработку оружия и слежку за людьми без согласия. Отдельные требования предусмотрены для сфер повышенного риска, включая медицину и финансы. Политика распространяется на приложения Anthropic, API и продукты, которые интегрируют её модели.
