Anthropic объяснила, как устроен невидимый водяной знак в текстах Claude

Anthropic опубликовала подробный разбор того, как будет работать водяной знак в текстах Claude, рассказали в блоге компании.
Языковые модели генерируют текст по одному слову за раз, выбирая из списка кандидатов. Во фразе «погода сегодня была холодной и…» продолжение «пасмурной» или «серой» равнозначны для читателя — и выбор между ними решается случайным числом.
Водяной знак использует именно такие незначительные развилки. Он не подсказывает модели новых слов, а меняет источник случайности: вместо обычного генератора случайных чисел выбор определяют секретный ключ и несколько предыдущих слов. Обладатель ключа затем может проверить, соответствует ли последовательность слов тому, что выбрал бы Claude.
Разница между текстом с водяным знаком и без него для читателей неразличима.
В компании подчёркивают, что в текст ничего не дописывается, скрытых символов нет, а дополнительные токены не расходуются — значит, генерация не станет медленнее или дороже. Идентифицирующей информации знак не несёт: привязать его к конкретному человеку, компании или переписке нельзя.
Метод — версия подхода SynthID-Text, опубликованного Google DeepMind в 2024 году. Google проверяла влияние на качество, раздав модель с водяным знаком части трафика Gemini: статистически значимой разницы в оценках пользователей не нашлось.
У технологии есть ограничения, которые Anthropic перечисляет сама. Ключ отвечает только на вопрос, какова вероятность, что текст частично написан Claude, — но не доказывает авторство человека и не распознаёт другие нейросети. На коротких фрагментах детекция работает плохо, а на фактических данных знаку почти не за что зацепиться.
По той же причине в коде маркировки заметно меньше, чем в обычном тексте, — там чаще требуется единственно верный вариант. Знак может попасть разве что в комментарии.
Полностью снять маркировку помогает только переписывание, где заменено каждое слово. Лёгкая правка её, скорее всего, не убирает, а вот переводы Claude помечаются полностью — там все слова выбирает модель.
Причина нововведения — регламент Евросоюза под названием AI Act. В июле 2026 года Anthropic вместе с другими разработчиками вошла в число примерно 190 подписантов европейского кодекса о прозрачности ИИ-контента. Маркировку включают по всему миру, потому что надёжного способа ограничить её одним регионом у компании пока нет. Детекцию обещают открыть через отдельный API.
Ранее Код.ру писал, что Google добавила в Gemini настройку для отключения видимого водяного знака — при этом невидимая метка SynthID и метаданные C2PA в файлах остаются.