
Как работает водяной знак
Водяной знак Claude — это не видимая надпись, не скрытые символы и не метаданные документа. Он создаётся за счёт выбора слов. Когда модели подходят несколько вариантов продолжения, специальный алгоритм влияет на выбор одного из них. В длинном тексте так появляется статистический рисунок, который можно обнаружить с помощью секретного ключа Anthropic.
Маркировка есть только в ответах поддерживаемых моделей Claude. В коротких и насыщенных фактами фрагментах сигнал слабее: у модели меньше слов, между которыми она может выбирать. Водяной знак не содержит сведений о пользователе, организации или конкретном диалоге.
Можно ли его удалить
Удаление невидимых Unicode-символов, замена тире, пробелов или кавычек не помогают: водяной знак находится в последовательности выбранных слов, а не в оформлении текста.
По объяснению Anthropic, небольшая редактура может ослабить сигнал, но не обязательно удалит его. Глубокое переписывание меняет последовательность слов и может устранить исходную маркировку. При этом нужно заново проверить факты, термины и смысл: вместе с формулировками они тоже могут измениться.
Гарантированно подтвердить удаление сейчас нельзя. Для проверки нужен официальный детектор Anthropic, а доступ к нему ограничен. Обычные детекторы ИИ используют другие методы и не могут надёжно показать наличие или отсутствие водяного знака Claude.