14 августа 2026 года Anthropic объяснила, как устроен водяной знак в текстах Claude. Будущие модели будут помечать сгенерированный текст так, чтобы по нему можно было оценить вероятность участия Claude в написании. Это выполнение EU AI Act, и то же самое делают другие крупные разработчики моделей. Разбор с ответами на вопросы лежит в блоге Anthropic, 1 сентября его обновили данными о детекторе.
Как это работает
В текст ничего не дописывают и скрытых символов не вставляют. Модель пишет по слову за раз и на каждом шаге выбирает из нескольких одинаково уместных вариантов: в фразе «погода сегодня была холодная и...» дальше одинаково подходят «пасмурная» и «серая». Обычно такой выбор решает случайное число.
Водяной знак меняет только источник случайности. Вместо произвольного генератора берётся ключ и несколько предыдущих слов. Слова остаются случайными, но потом последовательность можно сверить с ключом и назвать вероятность, что писал именно Claude. Метод это версия SynthID-Text, опубликованного Google DeepMind в Nature в 2024 году.
Что Anthropic обещает по последствиям:
- Читатель не отличит помеченный ответ от непомеченного.
- Лишних токенов не появляется, скорость и цена не меняются.
- В знаке нет данных ни о человеке, ни о компании, ни о конкретном чате.
- Во внутренних тестах разницы в качестве текста не увидели.
Чего знак не умеет
Ключ отвечает ровно на один вопрос: насколько вероятно, что это частично писал Claude. Он не доказывает, что текст написал человек, и не опознаёт чужую нейросеть: у другой модели свой ключ, а то и другой метод разметки. На коротких фрагментах проверка работает плохо, потому что выборов слишком мало.
В фактических пассажах знака меньше. После «главный труд Исаака Ньютона назывался Principia» правильный вариант ровно один, и цепляться знаку не за что. То же с вычиткой: попросили поправить только запятые, и метка живёт в горстке исправлений. Переводы, наоборот, помечаются полностью: там каждое слово выбирает Claude.
Код, файлы и старые модели
Код помечается заметно слабее обычного текста. Там, где вариант обязан быть точным, иначе программа сломается, никакого подталкивания не происходит. Знак может жить в комментариях, но на сам код влияние ничтожное.
С файлами схема другая. Когда Claude отдаёт .png, .jpg или .svg, в метаданные кладётся подписанная пометка по открытому стандарту C2PA: файл сделан или обработан с участием Claude. Само изображение не меняется.
Модели, вышедшие до 2 августа 2026 года, попали под переходный период закона, но знак планируют добавить и им в ближайшие месяцы. Проверить текст самостоятельно пока нельзя: детектор работает в закрытом превью для регуляторов, СМИ, фактчекеров, исследователей и образовательных организаций. Доступ обещают со временем расширять.
Что это значит для нас
В работе Claude из России не меняется ничего. Знак включают глобально, потому что надёжного способа ограничить его одним ЕС у Anthropic пока нет, но ни скорости, ни цены запросов, ни настроек API это не касается.
Практический вывод один: происхождение текста от Claude теперь в принципе проверяемо тем, у кого есть ключ. Личность, компанию и переписку из знака не восстановить, а разработчиков он почти не касается: в коде помечать нечего. Заметнее всего это для тех, кто сдаёт готовые тексты туда, где к нейросетям относятся строго.
Оплатить подписку российской картой на сайте Anthropic не выйдет, платёж отклоняет сама площадка. Подписка Claude Pro и Max есть в нашем каталоге Claude, оплата картой РФ или СБП.
Коротко
- Anthropic объяснила водяной знак в текстах Claude 14 августа 2026 года.
- Меняется только источник случайности при выборе слов: скрытых символов и лишних токенов нет, цена и скорость те же.
- Знак не привязан к пользователю, организации или чату.
- Короткие тексты и код помечаются слабо, переводы полностью.
- Причина это EU AI Act и кодекс о прозрачности ИИ-контента, подписанный в июле 2026 года.
Обсуждение
0 комментариев