OpenAI начнет помечать тексты ChatGPT и код Codex невидимыми водяными знаками
Компания утверждает, что отметки никак не повлияют на качество контента.
OpenAI начнет добавлять невидимые водяные знаки в тексты ChatGPT и Codex для пользователей из Евросоюза. Новая технология должна помочь выполнять требования европейского законодательства, обязывающего разработчиков генеративных ИИ-систем обеспечивать распознавание созданного моделями текста.
Технология textGrain добавляет в выбор слов для формирования ответа статистическую сигнатуру, которую можно распознать. Компания утверждает, что в собственных тестах технология показала результаты не хуже других изученных методов, включая SynthID, разработанный Google.
При этом надежность textGrain сильно зависит от длины и типа материала. При целевой доле ложно-положительных результатов в 1% детектор находил водяной знак примерно в 80% текстов длиной 200 токенов по темам вроде психологии. Для фрагментов на 400 токенов показатель достигал примерно 95%.
Редактирование также быстро ослабляет статистический сигнал textGrain. В тестах с текстами длиной 400 токенов исходную маркировку удавалось обнаружить примерно в 92% случаев. После замены 10% слов синонимами показатель снижался до 66%, а после замены 25% — до 17%.
С 5 октября добавление водяных знаков можно будет включить через API OpenAI; по умолчанию эта функция пока останется отключенной. Для ChatGPT и Codex в Евросоюзе маркировку начнут внедрять в течение ближайших недель, причем она появится на всех тарифных планах.


