OpenAI внедрит водяные знаки в тексты ChatGPT в ЕС
Компания OpenAI объявила, что начнет добавлять невидимый водяной знак к текстам, генерируемым моделями ChatGPT и Codex на территории Европейского союза. Это решение направлено на соблюдение требований европейского закона об искусственном интеллекте. Соответствующее сообщение было опубликовано в блоге компании в понедельник.
Правила прозрачности, предусмотренные европейским законом об искусственном интеллекте и вступившие в силу 2 августа, обязывают разработчиков искусственного интеллекта помечать сгенерированный контент таким образом, чтобы другие системы могли его идентифицировать.
OpenAI сообщила, что внедрение водяного знака для соответствующих пользователей ChatGPT и Codex на всех тарифных планах будет происходить в течение ближайших недель, но исключительно в Европе. Разработчики, использующие API OpenAI в любой точке мира, могут активировать эту функцию для отдельных моделей уже сегодня; по умолчанию она отключена. Компания подчеркнула, что не делает водяные знаки для текста глобальным стандартом на этапе запуска.
Водяной знак не представляет собой графического символа. Он работает за счет незначительного изменения выбора слов моделью, формируя паттерн, который невидим для читателей, но фиксируется детекторами. Поскольку эта информация закодирована в самих словах, она сохраняется при копировании и вставке текста. OpenAI заявила, что водяной знак не позволяет идентифицировать конкретного пользователя и что производительность моделей не претерпела значимых изменений при его включении.
Вместе с анонсом компания опубликовала технический отчет о методе, названном textGrain. Документ написан совместно с исследователями из Пенсильванского и Йельского университетов. В нем на примере использования секретного ключа для сортировки предсказаний следующего слова описывается процесс завершения предложения. Совокупность таких незначительных корректировок позволяет детектору определять контент, созданный искусственным интеллектом, на основе только текста и ключа.
OpenAI признает, что редактирование может удалить водяной знак. В одном из тестов замена 10% слов на синонимы снизила точность обнаружения с примерно 92% до 66%. Компания также отметила, что короткие фрагменты, ответы на математические задачи и переведенный текст сложнее поддаются детекции.
Ограничения метода привели к решению предоставлять первоначальный доступ к детектору только утверждённым исследователям и экспертным организациям, которые помогут оценить надежность инструмента и ответственные способы его применения, заявила компания.
OpenAI предупредила, что отсутствие водяного знака не доказывает человеческое авторство. Текст может быть слишком коротким, сильно отредактированным или сгенерированным искусственным интеллектом другой компании.
«Водяные знаки могут указывать на то, что часть фрагмента была сгенерирована или обработана системой OpenAI, но не отражают степень участия человека в принятии решений, редактировании или творческом процессе», — уточнила компания.
Это объявление последовало через два месяца после того, как Anthropic заявила о внедрении водяных знаков в тексты, генерируемые моделью Claude, применяя этот подход по всему миру. Это решение вызвало критику со стороны некоторых пользователей Claude, которые утверждали, что именно они предоставляют «инструкции, контекст и принимают решения», а Claude служит лишь «инструментом».
Ранее OpenAI разработала водяной знак для текста, но отложила его выпуск, частично из-за опасений, что пользователи перейдут к конкурентам, не использующим такую маркировку, как сообщала The Wall Street Journal в 2024 году.
Anthropic, Google, Microsoft и OpenAI входят в число компаний, обязавшихся соблюдать европейский кодекс практики в отношении контента, созданного с помощью искусственного интеллекта.


