OpenAI начнет добавлять невидимые водяные знаки к текстам, созданным ChatGPT и Codex в Европейском союзе. Технология получила название textGrain и предназначена для того, чтобы специальные инструменты могли определить, что текст был сгенерирован или обработан моделью OpenAI.
Компания связывает нововведение с требованиями европейского законодательства о прозрачности контента, созданного искусственным интеллектом. В ближайшие недели маркировка будет автоматически включаться для подходящих текстовых ответов ChatGPT и Codex в ЕС. При этом OpenAI не планирует делать textGrain глобальным стандартом на первом этапе.

Как работает водяной знак textGrain
textGrain не добавляет в текст специальных символов, скрытых пробелов или необычной пунктуации. Вместо этого система немного изменяет статистический принцип выбора слов и их частей во время генерации.
При достаточно большом объеме текста такие изменения формируют определенный паттерн. Специальный детектор, обладающий необходимыми параметрами, может проверить текст и определить, соответствует ли его структура установленному водяному знаку.
Для обычного читателя текст при этом не отличается от стандартного ответа ChatGPT. При копировании и вставке в другой документ скрытая метка также не исчезает, поскольку она заложена непосредственно в выборе слов.
API-пользователи смогут включать маркировку самостоятельно
В отличие от ChatGPT и Codex в ЕС, где textGrain будет включаться автоматически, пользователи API по всему миру смогут самостоятельно активировать водяные знаки для поддерживаемых моделей. Функция останется отключенной по умолчанию.
OpenAI также пока не делает детектор доступным для всех желающих. Компания принимает заявки от исследовательских организаций и экспертов, которые смогут использовать инструмент для оценки надежности технологии и ее дальнейшего совершенствования.
Похожий подход ранее представила Anthropic. Компания также объявила о внедрении водяных знаков для текстов, создаваемых ее моделями, в рамках выполнения требований европейских правил о прозрачности ИИ-контента.
Чем длиннее текст, тем надежнее обнаружение
OpenAI подчеркивает, что textGrain пока нельзя считать безошибочным способом определения происхождения текста. Эффективность системы сильно зависит от объема материала и характера самого текста.
В тестах при целевом уровне ложных срабатываний в 1% детектор распознавал водяной знак примерно в 80% текстов объемом 200 токенов и примерно в 95% текстов объемом 400 токенов. При этом для математических текстов результаты были заметно хуже, поскольку в них значительно меньше свободы выбора формулировок.
Редактирование также способно существенно ослабить метку. В одном из экспериментов замена 10% слов синонимами снизила показатель обнаружения примерно с 92% до 66%. При замене 25% слов он упал до 17%.
Поэтому наличие водяного знака нельзя трактовать как доказательство того, что человек целиком скопировал текст из ChatGPT. По данным OpenAI, метка может свидетельствовать лишь о том, что система компании, вероятно, участвовала в создании или обработке некоторой части материала. Она не показывает объем участия человека, не устанавливает автора текста и не позволяет определить конкретного пользователя или его учетную запись.
OpenAI признает ограничения технологии
Компания отдельно отмечает, что отсутствие обнаруженного водяного знака также не доказывает человеческое авторство. Метка может не определиться из-за слишком короткого текста, существенного редактирования, перевода или особенностей самого материала. Кроме того, текст мог быть создан другой ИИ-системой.
OpenAI также заявляет, что внедрение textGrain не привело к заметному снижению качества работы моделей в проведенных тестах. Компания намерена постепенно расширять применение технологии и одновременно оценивать ее надежность в реальных условиях.
Таким образом, textGrain становится еще одним способом определения происхождения ИИ-контента, но пока не универсальным доказательством его авторства. Сам OpenAI подчеркивает, что результаты обнаружения следует рассматривать как сигнал о возможном участии модели, а не как окончательное заключение о том, кто написал текст и какую часть работы выполнил искусственный интеллект.
OpenAI начнет маркировать тексты ChatGPT и Codex водяными знаками в ЕС
Apple готовит две волны презентаций новых устройств в октябре
Новый роутер: что проверить в настройках после установки
Илон Маск переименует подразделение SpaceXAI в SpaceXSI
Qualcomm предоставит Huawei лицензию на патенты для технологии LogicFolding
Артефакты видеокарты - что делать, как исправить?
Синий экран смерти коды ошибок Bsod
Как удалить вирус explorer exe - решение проблемы, скачать explorer.exe
Как удалить вирус с компьютера с помощью утилиты AVZ
Температура процессора - способы уменьшения и какой должна быть температура компьютера