OpenAI начнёт помечать водяными знаками текст ChatGPT и Codex — пока только в ЕС

В ЕС водяные знаки появятся у пользователей всех тарифов. Для клиентов по API по всему миру они будут опциональны.

OpenAI начнёт помечать водяными знаками текст ChatGPT и Codex — пока только в ЕС

OpenAI объявила, что в ближайшие недели добавит в текст ChatGPT и Codex водяные знаки для пользователей из стран Европейского союза. Этого требует закон ЕС об искусственном интеллекте — работа ИИ должна быть распознаваемой.

«Мы не делаем текстовые водяные знаки глобальными настройками по умолчанию на момент запуска. Такой региональный подход позволяет нам учиться на реальном опыте использования и учитывать отзывы»
— OpenAI

Компания будет использовать фирменный метод textGrain: на этапе подбора слов в тексте ИИ-модель будет внедрять статистический паттерн, который могут распознать алгоритмы. По внутренним тестам OpenAI, наличие паттерна почти не влияет на качество и точность генерации.

Хотя в OpenAI говорят, что textGrain «соответствует или превосходит» другие подходы вроде SynthID от Google, такой метод хуже работает с короткими фрагментами текста и с математикой и другими точными дисциплинами, где выбор формулировок ограничен.

Однако в компании отмечают, что textGrain «не гарантирует надёжного обнаружения»: если вручную заменить 10% слов синонимами в тексте из 400 токенов, точность распознавания снизится с 92% до 66%. Кроме того, водяные знаки не подтверждают точность, не определяют владельца текста, не измеряют вклад человека и не доказывают авторство человека.

Для клиентов через API по всему миру водяные знаки будут доступны по желанию.

«Начиная с сегодняшнего дня, клиенты API по всему миру смогут добавлять текстовые выходные данные с водяными знаками для отдельных моделей. Это позволит клиентам самим решать, насколько наличие водяных знаков соответствует их обязательствам по обеспечению прозрачности и качеству предоставляемых пользователям данных»
— OpenAI