В отличие от традиционных ИИ-детекторов, анализирующих уже готовый текст и пытающихся определить характерные для машинного письма признаки, водяной знак создается непосредственно в момент генерации. Читатель его не видит, а сам текст не должен заметно изменяться с точки зрения смысла или качества.
По данным Anthropic, маркировка реализуется на уровне модели Claude и распространяется на пользователей по всему миру.
Как работает водяной знак
При генерации ответа Claude немного изменяет вероятности выбора отдельных слов. Эти изменения формируют статистический паттерн, который впоследствии может быть распознан специальным инструментом.
Такой подход позволяет искать не косвенные признаки машинного текста, а заранее созданный сигнал его происхождения.
Технология может оказаться полезной для издателей, образовательных учреждений и онлайн-платформ, которым необходимо определять участие ИИ в создании контента. При этом наличие или отсутствие водяного знака не должно рассматриваться как абсолютное доказательство авторства.
Anthropic отмечает, что масштабное редактирование, перевод или смешивание текста Claude с другими материалами способны ослабить или полностью уничтожить маркировку. Кроме того, отсутствие водяного знака не означает, что текст обязательно написан человеком: он мог быть создан другой ИИ-системой или существенно переработан после генерации.
На фоне новых требований ЕС
Появление технологии происходит на фоне вступления в силу требований о прозрачности, предусмотренных Законом ЕС об искусственном интеллекте. Статья 50 предусматривает, что определенный контент, созданный или измененный с помощью ИИ, должен быть обнаруживаемым в машиночитаемом формате, когда это технически возможно.
Для изображений и других типов цифрового контента Anthropic использует стандарт C2PA, предназначенный для фиксации происхождения и истории создания файлов. Однако метаданные C2PA также могут теряться при редактировании, конвертации или загрузке файлов на сторонние платформы.
Anthropic не является первой компанией, которая пытается решить проблему идентификации ИИ-контента. Google развивает систему SynthID, предназначенную для маркировки созданных ИИ изображений, аудио, видео и текста. OpenAI и Meta также исследуют технологии водяных знаков и другие методы определения участия ИИ в создании цифрового контента.
Водяной знак не решает проблему авторства
Распространение скрытой маркировки может сделать происхождение сгенерированного текста более прозрачным, однако не устраняет более сложный вопрос об авторстве.
Пользователь может применять ИИ для создания текста целиком, а может использовать его только для перевода, редактирования, сокращения или поиска идей. В таких случаях бинарный вопрос «написал ли это ИИ?» становится все менее содержательным.
Поэтому водяные знаки, вероятно, станут прежде всего инструментом отслеживания происхождения контента, а не универсальным детектором «машинного авторства». В перспективе важнее может оказаться не сам факт использования ИИ, а то, каким образом он применялся при создании материала и кто несет ответственность за его конечное содержание.
Источник: https://news.cgtn.com/news/2026-08-17/Invisible-watermarks-could-make-AI-writing-easier-to-trace-1PG...Если вам понравился материал, кликните значок — вы поможете нам узнать, каким статьям и новостям следует отдавать предпочтение. Если вы хотите обсудить материал —не стесняйтесь оставлять свои комментарии : возможно, они будут полезны другим нашим читателям!