OpenAI внедрит невидимую текстовую метку ChatGPT и Codex в ЕС

В ближайшие недели OpenAI начнет добавлять статистический водяной знак к подходящим текстам ChatGPT и Codex для пользователей в ЕС. Компания подчеркивает: метка помогает установить происхождение текста, но не доказывает авторство и может теряться при редактировании.

OpenAI объявила о поэтапном внедрении textGrain — невидимой статистической метки в тексты, созданные подходящими моделями ChatGPT и Codex для пользователей в Европейском союзе. Запуск ожидается в ближайшие недели и затронет все тарифные планы. Глобально включать эту функцию по умолчанию компания пока не планирует. Отдельно с 5 октября клиенты API по всему миру могут добровольно включить маркировку для некоторых моделей.

По описанию OpenAI, textGrain не добавляет скрытые символы или специальные токены. Во время генерации система слегка меняет статистику выбора слов, используя секретный ключ и предшествующий контекст. Специальный детектор затем анализирует текст и проверяет наличие сигнала.

В испытаниях OpenAI детектор обнаружил метку примерно в 80% фрагментов длиной 200 токенов и в 95% фрагментов на 400 токенов в материалах по психологии при целевом уровне ложных срабатываний 1%. На математических текстах показатель был существенно ниже: там меньше свободы выбора слов. Редактирование также ослабляло сигнал. В тесте 400-токенных фрагментов замена 10% слов синонимами снизила обнаружение примерно с 92% до 66%, а замена четверти слов — до 17%.

Поэтому на первом этапе доступ к детектору получат только одобренные исследователи и профильные организации. Он сообщит лишь, обнаружен ли водяной знак OpenAI; идентифицировать пользователя или раскрыть его запросы и переписку инструмент не будет.

Компания отдельно предупреждает о границах метода. Метка не показывает, сколько человеческой редакторской работы вложено в текст, не устанавливает право собственности или ответственность, не определяет автора и не подтверждает точность содержания. Отсутствие сигнала также не доказывает, что текст написал человек: детектор может не распознать короткий, измененный или переведенный текст, материал неподдерживаемой модели, созданный до внедрения маркировки, либо результат другой ИИ-системы.

Правила ЕС отдельно обязывают пользователей систем маркировать определенные тексты, созданные или измененные ИИ и опубликованные для информирования общественности по вопросам общественного интереса. OpenAI намерена открыть textGrain как программное обеспечение с открытым исходным кодом и рассматривает его как один элемент более широкой системы проверки происхождения. Для изображений и аудио компания уже использует, среди прочего, Content Credentials на основе C2PA и невидимые водяные знаки SynthID; сама OpenAI отмечает, что одного метода подтверждения происхождения недостаточно.