OpenAI объявила, что в ближайшие недели добавит в текст ChatGPT и Codex водяные знаки для пользователей из стран Европейского союза. Этого требует закон ЕС об искусственном интеллекте — работа ИИ должна быть распознаваемой.
«Мы не делаем текстовые водяные знаки глобальными настройками по умолчанию на момент запуска. Такой региональный подход позволяет нам учиться на реальном опыте использования и учитывать отзывы»— OpenAI
Компания будет использовать фирменный метод textGrain: на этапе подбора слов в тексте ИИ-модель будет внедрять статистический паттерн, который могут распознать алгоритмы. По внутренним тестам OpenAI, наличие паттерна почти не влияет на качество и точность генерации.
Хотя в OpenAI говорят, что textGrain «соответствует или превосходит» другие подходы вроде SynthID от Google, такой метод хуже работает с короткими фрагментами текста и с математикой и другими точными дисциплинами, где выбор формулировок ограничен.
Однако в компании отмечают, что textGrain «не гарантирует надёжного обнаружения»: если вручную заменить 10% слов синонимами в тексте из 400 токенов, точность распознавания снизится с 92% до 66%. Кроме того, водяные знаки не подтверждают точность, не определяют владельца текста, не измеряют вклад человека и не доказывают авторство человека.
Для клиентов через API по всему миру водяные знаки будут доступны по желанию.
«Начиная с сегодняшнего дня, клиенты API по всему миру смогут добавлять текстовые выходные данные с водяными знаками для отдельных моделей. Это позволит клиентам самим решать, насколько наличие водяных знаков соответствует их обязательствам по обеспечению прозрачности и качеству предоставляемых пользователям данных»— OpenAI