К содержанию
Выпуск №77 · 24 августа 2026 / Новости

Водяной знак Claude годится для внутреннего сигнала, но не для доказательства авторства

Anthropic собирается встраивать невидимый сигнал на этапе генерации текста, однако расшифровать его сможет только сама компания. Для бизнеса это повод добавить отдельную проверку в текстовые контуры, но не основание автоматически блокировать документы, наказывать пользователей или устанавливать происхождение текста.

Редакция 24 августа 2026 г., 08:20 MSK

В Telegram

Anthropic объявила о водяных знаках в текстах Claude, а Себастьян Рашка разобрал принцип их работы в своем блоге. Главный вывод для бизнеса прозаичнее слова «watermarking»: это потенциально полезный технический сигнал, но не универсальный детектор AI-текста и тем более не доказательство того, кто написал документ.

Если компания проверяет пользовательский контент, договоры, учебные работы или ответы модели перед публикацией, сигнал Claude стоит учитывать. Но ставить его в центр compliance-процесса рано: по разбору Рашки, водяной знак может не сработать или быть удален, а проверить его независимо от Anthropic нельзя.

Что именно встраивает Claude

Рашка пишет, что Anthropic объявила о watermarking текстовых ответов Claude за несколько дней до его публикации. Мотивация компании, по его пересказу, состоит в том, чтобы распознавать текст, сгенерированный конкретной моделью Claude, например Claude Opus 4.8.

Сигнал невидим пользователю и появляется внутри процесса генерации. Ключевая точка вмешательства находится на этапе сэмплирования, когда модель выбирает продолжение текста. Иными словами, речь не о метке, которую дописывают в готовый файл, а о характеристике самого выхода модели.

Но слово «водяной знак» здесь звучит надежнее, чем описанный механизм. В изображении метка ассоциируется с чем-то устойчивым, что можно найти в копии. В тексте любая правка меняет последовательность, на которой держится сигнал. Сам Рашка отдельно обещает разобрать, как watermarking может дать сбой или быть удален. Значит, даже в исходной постановке это не неуничтожимая подпись.

Есть и вторая граница. По словам Рашки, водяной знак сможет декодировать только Anthropic. Для внешней команды результат проверки поэтому будет утверждением владельца системы, а не независимо воспроизводимым измерением. В опубликованном разборе нет собственного открытого теста, по которому оператор мог бы взять текст, повторить процедуру и получить тот же вывод без участия Anthropic.

Происхождение модели не равно авторству документа

Даже положительное срабатывание отвечает на более узкий вопрос: обнаружила ли Anthropic свой сигнал в этом фрагменте. Оно само по себе не устанавливает, кто сформулировал идею, составил запрос, отредактировал результат и утвердил финальную версию.

Отрицательное срабатывание тоже нельзя автоматически читать как «Claude здесь не было». Рашка прямо указывает, что watermarking способен не сработать или быть удален. Поэтому бинарная политика вида «метка есть, значит нарушение; метки нет, значит текст человеческий» превращает вероятностный технический признак в административную печать. Удобно для регламента, плохо для точности.

Для российских команд практический сценарий другой. Если ответы Claude проходят в production, сохраняйте исходный ответ модели отдельно от отредактированной версии и фиксируйте преобразования внутри контура. Если вы модерируете чужие тексты, используйте будущую проверку Anthropic как один из сигналов наряду с историей документа и данными собственного процесса. Единственным основанием для санкции, атрибуции или compliance-решения она быть не должна.

Что проверить до внедрения

Нужен тест на собственных данных, а не вера в название технологии. Возьмите исходные ответы Claude, затем прогоните их через обычную редактуру: сокращение, перестановку абзацев, изменение формулировок и сборку текста из нескольких фрагментов. После этого сравните результаты проверки для оригиналов и производных версий, если Anthropic даст доступ к декодированию.

Главный маркер зрелости технологии будет конкретным: появится ли у внешних операторов способ получать воспроизводимый результат и увидим ли мы измерения устойчивости сигнала после редактуры. Пока этого нет, водяной знак Claude разумно считать служебным индикатором происхождения ответа модели. Доказательством авторства он от этого не становится.

Как процитировать

«Водяной знак Claude годится для внутреннего сигнала, но не для доказательства авторства». hegai.media, 24 августа 2026 г.. https://hegai.media/novosti/vodyanoy-znak-claude-goditsya-dlya-vnutrennego-signala-no-ne-dlya-doka--90a5f8cb-338b-4fc8-9abd-5f37fa1716a0

так материал выглядит в мессенджере