В отличие от традиционных метаданных, которые легко удаляются при копировании файла, текстовый водяной знак непосредственно встраивается в содержание. Один из простейших вариантов использует невидимые символы Unicode, например символы нулевой ширины. Разным символам можно сопоставить значения 0 и 1, сформировав скрытую последовательность, содержащую идентификатор документа или получателя.
Более устойчивый подход заключается в использовании заранее определённых вариантов слов или знаков препинания. Например, система может выбирать между близкими по смыслу словами или различными вариантами апострофов в соответствии с секретным ключом. Такой водяной знак способен пережить некоторые изменения текста, хотя полноценное перефразирование может уничтожить встроенный сигнал.
Третий класс методов формируется непосредственно на этапе генерации текста языковой моделью. В этом случае алгоритм управляет вероятностями выбора следующих токенов таким образом, чтобы сформировать статистически обнаружимый паттерн. Чем больше независимых решений совпадает с заданным ключом, тем ниже вероятность случайного совпадения. Именно этот принцип лежит в основе современных систем маркировки текста, включая технологии, исследуемые для контента, создаваемого ИИ.
Идея скрытой маркировки текста появилась задолго до генеративного ИИ. Издатели карт и справочников использовали вымышленные географические объекты, имена и другие преднамеренные ошибки, чтобы выявлять случаи копирования. Современные цифровые методы превращают тот же принцип в формализованный статистический механизм.
При этом наличие водяного знака само по себе не подтверждает право собственности на текст. Он может служить свидетельством того, что конкретная версия материала была скопирована, но вопрос авторства и прав на контент требует дополнительных доказательств.
Практические эксперименты показывают, что универсального текстового водяного знака не существует. Невидимые символы проще всего внедрять, но их уничтожают многие системы очистки текста. Маркировка на уровне выбора слов устойчивее к незначительному редактированию, однако плохо переносит глубокое переписывание. Водяные знаки, встроенные непосредственно в процесс генерации языковой модели, потенциально лучше сохраняются при преобразованиях, но требуют более сложных алгоритмов и специализированного детектора.
Таким образом, текстовый водяной знак постепенно превращается из экспериментального приёма в инструмент контроля происхождения цифрового контента. Его возможности особенно актуальны по мере роста объёма материалов, создаваемых генеративными моделями, и распространения автоматизированного копирования и переработки текстов.
Источник: https://towardsdatascience.com/text-watermarking-in-python-catch-whoever-copies-your-writing/Если вам понравился материал, кликните значок — вы поможете нам узнать, каким статьям и новостям следует отдавать предпочтение. Если вы хотите обсудить материал —не стесняйтесь оставлять свои комментарии : возможно, они будут полезны другим нашим читателям!

