OpenAI планирует поставить водяные знаки на текстовом выводе ChatGPT и Кодекса в ЕС на фоне повышения прозрачности ИИ

Стоит прочитать: «Недостаточно осторожен»: бывший сотрудник OpenAI увольняется из-за опасений по поводу безопасности ИИ

Как работает текстовый водяной знак OpenAI?

Согласно отдельному техническому отчету, OpenAI сообщила, что использует метод создания водяных знаков под названием textGrain, который использует секретный ключ для тонкого влияния на то, какие слова ChatGPT выбирает при генерации текста. Таким образом, детектору ИИ потребуется только текст и секретный ключ для проверки водяного знака.

Но есть ли способ удалить текстовый водяной знак? В OpenAI заявили, что редактирование текста может затруднить обнаружение водяного знака. Например, замена всего 10% слов на синонимы снизила точность обнаружения примерно с 92% до 66%. Компания также сообщила, что система водяных знаков плохо работает с очень короткими фрагментами текста, математическими ответами и переведенным текстом.

«Эти ограничения способствуют нашему решению предоставить первоначальный доступ к детектору только утвержденным исследователям и экспертным организациям, которые могут помочь нам оценить надежность и ответственное использование», — заявили в компании. Однако система водяных знаков не влияет на производительность модели ИИ.

Обязательно прочтите: OpenAI грозит иск из-за инцидента со взломом системы Hugging Face: что вам нужно знать

Далее компания добавила: «(Водяные знаки) могут указывать на то, что система OpenAI сгенерировала или обработала часть отрывка, но не на то, сколько человеческого суждения, редактирования или творчества было вложено в него».

Что говорит Закон ЕС об искусственном интеллекте о текстовых водяных знаках?

Закон ЕС об искусственном интеллекте требует от компаний, занимающихся искусственным интеллектом, сделать контент, созданный искусственным интеллектом, идентифицируемым таким образом, чтобы машины могли его читать и обнаруживать. Чтобы соответствовать требованиям, OpenAI в ближайшие недели начнет внедрять свою систему водяных знаков textGrain для пользователей ChatGPT в ЕС. В августе Anthropic также выпустила систему водяных знаков для текстов Клода после вступления в силу Закона об искусственном интеллекте 2 августа 2026 года.

Первоначально текстовый водяной знак будет доступен в ЕС, но OpenAI также делает эту технологию доступной по всему миру для клиентов API в качестве дополнительной функции, начиная с сегодняшнего дня, но только на определенных моделях.