OpenAI начнёт ставить вотермарки на тексты ChatGPT — но не у всех пользователей
Компания начнет добавлять невидимые цифровые водяные знаки к тексту, который ChatGPT и Codex генерируют для пользователей в Евросоюзе. Компания внедрит технологию в ближайшие недели, чтобы выполнить требования закона ЕС об искусственном интеллекте.
Компания начнет добавлять невидимые цифровые водяные знаки к тексту, который ChatGPT и Codex генерируют для пользователей в Евросоюзе. Компания внедрит технологию в ближайшие недели, чтобы выполнить требования закона ЕС об искусственном интеллекте.
Для маркировки OpenAI разработала систему textGrain. Она незаметно меняет выбор слов моделью, создавая статистический сигнал, который можно обнаружить специальным детектором. При копировании текста такой сигнал сохраняется.
«Водяной знак не измеряет вклад человека», — сообщает OpenAI. Он может показать, что система компании сгенерировала или обработала часть текста, но не позволяет определить, сколько в нем человеческого редактирования или творчества. Маркер также не раскрывает пользователя, его промпты или переписку.
При этом технология работает не всегда. В тестах на текстах длиной 400 токенов замена 10% слов синонимами снижала обнаружение водяного знака примерно с 92% до 66%, а замена четверти слов — до 17%. Короткие тексты, математические ответы и переводы также распознаются хуже.
Для пользователей ChatGPT и Codex в ЕС маркировка будет включена автоматически на всех тарифах для поддерживаемых текстовых ответов. Клиенты API по всему миру уже могут включать ее для отдельных моделей добровольно, однако по умолчанию она отключена.
Сам детектор OpenAI пока не станет делать общедоступным: на первом этапе доступ получат только одобренные исследователи и профильные организации. Компания объясняет это риском ложных срабатываний и пропущенных водяных знаков.
Релоцировались? Теперь вы можете комментировать без верификации аккаунта.