Компания Anthropic раскрыла технические подробности маркировки материалов, созданных нейросетью Claude. Новые модели будут добавлять в текст незаметный для человека водяной знак, который поможет определить возможное участие искусственного интеллекта. Решение связано с требованиями закона ЕС об ИИ, обязывающими разработчиков внедрять машиночитаемую маркировку.
Как работает водяной знак Claude в тексте?
Claude составляет ответ последовательно, выбирая каждое следующее слово из нескольких подходящих вариантов. Если два слова одинаково точны по смыслу, система использует специальный ключ и предыдущую часть фразы, чтобы сделать выбор. Такие решения постепенно образуют статистическую последовательность, которую способен распознать проверочный инструмент.
В тексте не появляются скрытые символы, дополнительные пробелы или видимые пометки. Копирование и вставка также не уничтожают сигнал. Anthropic применяет способ SynthID-Text, разработанный Google DeepMind и описанный в научной работе 2024 года. Компания утверждает, что технология не ухудшает смысл, творческую выразительность и читаемость ответов.
Невидимый водяной знак Claude и качество ответов нейросети
Маркировка не требует дополнительных элементов текста, поэтому не должна увеличивать стоимость или заметно снижать скорость работы Claude. Алгоритм выбирает только среди уместных слов и не заставляет модель использовать редкие либо неточные выражения.

Водяной знак Claude не содержит сведений о пользователе, компании или отдельном разговоре. По нему нельзя восстановить личность автора запроса. Метка показывает лишь вероятность того, что Claude участвовал в создании или существенной переработке материала. Она не подтверждает авторство и не меняет права на результат.
Проверка текста на ИИ и ограничения водяного знака Claude
Точность проверки зависит от объема материала. В длинной статье модель принимает много языковых решений, поэтому статистический сигнал становится заметнее. В коротком ответе данных для уверенного заключения может оказаться недостаточно.
Слабее маркировка проявляется и в строго фактических фрагментах, где существует единственный правильный ответ. Легкая правка человеком, вероятно, сохранит часть сигнала, а полное переписывание текста способно его удалить. Anthropic готовит отдельное средство проверки водяных знаков, однако дата его запуска пока не названа.
Водяной знак Claude в коде, переводах и отредактированном тексте
В программном коде метка будет слабее, поскольку синтаксис часто не оставляет свободы выбора. Она может появляться в комментариях или названиях, но не должна влиять на работоспособность программы.
При простой проверке орфографии большая часть исходных слов остается авторской, поэтому участие Claude может не определиться. В переводе ситуация иная: модель заново выбирает почти каждое слово, а значит, сигнал будет выражен сильнее. Изображения и поддерживаемые файлы получат не текстовый водяной знак, а подписанные сведения о происхождении по стандарту C2PA.
Экспертный вывод
Новый подход полезен для издательств, учебных заведений и компаний, которым важно понимать происхождение материалов. Однако результат проверки нельзя использовать как безусловное доказательство нарушения: технология оценивает вероятность участия Claude, а не устанавливает автора.
Рекомендация: открыто указывать существенную помощь ИИ, сохранять исходные версии документов и проверять факты вручную. Водяной знак стоит воспринимать как дополнительный сигнал прозрачности, а не как окончательный приговор тексту или его создателю.
