OpenAI включит водяные знаки textGrain в ChatGPT в ЕС

OpenAI планирует включить невидимую маркировку textGrain для пользователей ChatGPT и Codex в ЕС, а для API оставить её добровольной по всему миру. В тестах обнаружение зависело от длины и темы: редактирование текста заметно снижало точность детектора.

Маркировка внедряется в распределение слов

OpenAI представила textGrain — технологию невидимого статистического сигнала, встроенного в выбор слов моделью. Компания планирует включить её для пользователей ChatGPT и Codex в ЕС в ближайшие недели. Для API маркировка останется добровольной по всему миру; функция также должна появиться у облачных партнёров, включая Microsoft Azure.

THE DECODER связывает европейский запуск с требованиями Закона ЕС об ИИ маркировать сгенерированный текст в машиночитаемом виде, отмечая, что такое толкование приводится как сообщение, а не подробное юридическое заключение. OpenAI также заявляет, что планирует открыть технологию, чтобы другие могли её использовать.

Детектор зависит от темы и длины текста

При целевом уровне ложных срабатываний 1% OpenAI обнаружила водяной знак примерно в 95% отрывков на 400 токенов по психологии и примерно в 80% отрывков на 200 токенов. Для математических текстов показатель был ниже: при 400 токенах около 60%. Это результаты внутренних испытаний компании.

Редактирование заметно ослабляет сигнал. По данным OpenAI, замена 10% слов синонимами снижала обнаружение в 400-токенных отрывках примерно с 92% до 66%; замена четверти слов — до 17%. Следовательно, отсутствие обнаруженного водяного знака не подтверждает, что текст написан человеком.

Маркировка не устанавливает авторство и точность

OpenAI утверждает, что включение textGrain не ухудшило результаты её модели на восьми бенчмарках, включая GPQA Diamond, BrowseComp и DeepSWE. Компания отмечает, что тесты не доказывают отсутствие влияния на качество письма.

Сам водяной знак, согласно OpenAI, не показывает, сколько человеческого творчества или редактирования вложено в текст, не устанавливает владельца или конкретного пользователя и не подтверждает достоверность содержания. Детектор лишь оценивает наличие статистического сигнала при определённых условиях.

OpenAI will watermark ChatGPT text in the EU but makes it optional for API users worldwide