Зачем это нужно
Anthropic представила техническое описание технологии водяных знаков для своих будущих моделей Claude. Основная причина изменений — соблюдение требований EU AI Act. Согласно закону, поставщики ИИ, работающие на европейском рынке, обязаны маркировать контент, созданный искусственным интеллектом. В июле 2026 года Anthropic подписала кодекс прозрачности ЕС вместе с другими крупными компаниями.
Вместо того чтобы ограничивать использование технологии только Европой, Anthropic внедряет водяные знаки глобально. На данный момент у компании нет возможности точно разделить пользователей по регионам, поэтому европейские стандарты стали общим техническим ограничением для всех пользователей Claude.
Как работает технология
Механизм водяного знака основан на методе SynthID-Text, разработанном Google DeepMind. Он не добавляет в текст скрытые символы, невидимые знаки Unicode или лишние токены. Вместо этого технология использует сам процесс генерации слов.
Когда языковая модель выбирает следующее слово, у нее часто есть несколько подходящих вариантов. В обычном режиме выбор между ними происходит случайным образом. В случае с водяным знаком случайность заменяется на последовательность, основанную на секретном ключе и предыдущих словах. Для обычного читателя текст выглядит абсолютно естественно, но человек, владеющий ключом, может статистически определить, был ли текст создан моделью Claude.
Влияние на качество и стоимость
Anthropic утверждает, что внедрение водяных знаков никак не влияет на качество, креативность или читаемость текстов. Внутренние тесты компании подтвердили, что пользователи не заметят разницы в ответах модели.
Технология также не увеличивает стоимость использования или скорость генерации. Поскольку водяной знак не требует дополнительных токенов, нагрузка на систему остается прежней. Это отличает метод Anthropic от программ для обнаружения ИИ, которые пытаются угадать авторство по стилистическим привычкам, не имея доступа к ключам разработчика.
Ограничения и ошибки
Технология не является идеальной и имеет свои пределы. Вероятность обнаружения снижается на коротких текстах, где у модели мало вариантов для выбора слов. Также сложность возникает при работе с фактологическими текстами, где правильный ответ может быть только один, и при написании программного кода, где важна точность.
Важно понимать, что водяной знак не дает полной уверенности. Он лишь отвечает на вопрос: «Какова вероятность, что этот текст был частично написан Claude?». Он не может доказать, что текст написал человек, не может идентифицировать работу другой нейросети и не может отличить полный текст от текста, который Claude лишь сильно отредактировал.
Что это значит
Anthropic переходит на стандарты прозрачности, принятые в ЕС, внедряя водяные знаки во все свои модели. Это решение не меняет права собственности на контент и не содержит личных данных пользователя, но позволяет статистически подтверждать участие ИИ в создании текста.
