Кодик кратко объясняет суть статьи
Anthropic представила технологию водяного знака для текстов, генерируемых моделью Claude, основанную на управлении выбором между семантически эквивалентными вариантами слов с помощью секретного ключа. Метод не изменяет качество, скорость или стоимость генерации, не добавляет скрытых символов и не содержит идентифицирующей информации. Технология аналогична подходу SynthID-Text от Google DeepMind, тесты которой не выявили влияния на пользовательские оценки. Водяной знак позволяет определить вероятность участия Claude в создании текста, но не доказывает авторство и слабо работает на коротких или фактически точных фрагментах и в коде. Полное удаление метки возможно только при полном переписывании текста, тогда как переводы остаются помеченными. Внедрение вызвано требованиями ЕС AI Act: Anthropic и другие компании подписали кодекс прозрачности ИИ, и маркировка применяется глобально из-за отсутствия региональных ограничений. Детекция будет доступна через отдельный API. Ранее Google в Gemini отключила видимый знак, оставив скрытую метку и метаданные.
Читайте в Telegram
|
Anthropic опубликовала подробный разбор того, как будет работать водяной знак в текстах Claude, рассказали в блоге компании.
Языковые модели генерируют текст по одному слову за раз, выбирая из списка кандидатов. Во фразе «погода сегодня была холодной и…» продолжение «пасмурной» или «серой» равнозначны для читателя — и выбор между ними решается случайным числом.
Водяной знак использует именно такие незначительные развилки. Он не подсказывает модели новых слов, а меняет источник случайности: вместо обычного генератора случайных чисел выбор определяют секретный ключ и несколько предыдущих слов. Обладатель ключа затем может проверить, соответствует ли последовательность слов тому, что выбрал бы Claude.
Разница между текстом с водяным знаком и без него для читателей неразличима.
В компании подчёркивают, что в текст ничего не дописывается, скрытых символов нет, а дополнительные токены не расходуются — значит, генерация не станет медленнее или дороже. Идентифицирующей информации знак не несёт: привязать его к конкретному человеку, компании или переписке нельзя.
Метод — версия подхода SynthID-Text, опубликованного Google DeepMind в 2024 году. Google проверяла влияние на качество, раздав модель с водяным знаком части трафика Gemini: статистически значимой разницы в оценках пользователей не нашлось.
У технологии есть ограничения, которые Anthropic перечисляет сама. Ключ отвечает только на вопрос, какова вероятность, что текст частично написан Claude, — но не доказывает авторство человека и не распознаёт другие нейросети. На коротких фрагментах детекция работает плохо, а на фактических данных знаку почти не за что зацепиться.
По той же причине в коде маркировки заметно меньше, чем в обычном тексте, — там чаще требуется единственно верный вариант. Знак может попасть разве что в комментарии.
Полностью снять маркировку помогает только переписывание, где заменено каждое слово. Лёгкая правка её, скорее всего, не убирает, а вот переводы Claude помечаются полностью — там все слова выбирает модель.
Причина нововведения — регламент Евросоюза под названием AI Act. В июле 2026 года Anthropic вместе с другими разработчиками вошла в число примерно 190 подписантов европейского кодекса о прозрачности ИИ-контента. Маркировку включают по всему миру, потому что надёжного способа ограничить её одним регионом у компании пока нет. Детекцию обещают открыть через отдельный API.
Ранее Код.ру писал, что Google добавила в Gemini настройку для отключения видимого водяного знака — при этом невидимая метка SynthID и метаданные C2PA в файлах остаются.







