Новые правила прозрачности
С 2 августа 2026 года компания Anthropic начала внедрять невидимые водяные знаки во все тексты, которые генерируют модели Claude. Это решение было принято в рамках соблюдения статьи 50 закона ЕС об ИИ (AI Act). Компания подписала Кодекс практики по прозрачности ИИ-контента, который признан Еврокомиссией как адекватный способ контроля за создаваемым контентом.
Маркировка распространяется на все ключевые продукты: Claude Platform (API), приложения Claude, Claude Code, Claude Cowork и Claude Tag. Примечательно, что Anthropic решила внедрять эту систему не только для европейских пользователей, но и по всему миру, чтобы не поддерживать две разные версии одной и той же модели.
Как работает невидимая метка
В отличие от изображений, где метку можно спрятать в изменении яркости пикселей, в тексте нет визуальных элементов. Технология работает на уровне вероятностей. Когда нейросеть выбирает следующее слово, она анализирует список подходящих вариантов. С помощью секретного ключа модель слегка смещает вероятность выбора в пользу определенных слов, разделяя кандидатов на условные группы.
Один такой выбор незаметен, но на дистанции в тысячу слов накапливается статистическое смещение. Человек не увидит разницы, но специальный алгоритм сможет обнаружить закономерность, которую невозможно случайно повторить. Это напоминает игру в кости: если на кубике слишком часто выпадает одно и то же число, становится ясно, что он подкручен.
Борьба с маркировкой
Сразу после анонса сообщество разработчиков на GitHub начало создавать инструменты для удаления этих меток. Появились проекты, обещающие «чистый» текст, а также коммерческие сервисы, специализирующиеся на обходе детекторов. Однако на данный момент большинство таких инструментов умеют удалять только метаданные или технический мусор в кодировке Unicode.
Полноценный «магический ластик» пока не создан. Чтобы стереть статистическую метку, текст необходимо полностью перефразировать с помощью другой модели. Но это создает проблему: качество итогового текста будет ограничено возможностями более слабой модели, которую используют для «очистки».
Проблема проверки и авторства
На текущий момент доказать эффективность любого сервиса по удалению меток невозможно. Это связано с тем, что Anthropic не опубликовала публичный детектор, по которому можно было бы измерить успех «чистильщиков». Без эталона от разработчика невозможно понять, была ли удалена статистическая метка или нет.
Внедрение таких меток также поднимает этические вопросы. Если пользователь использует Claude как инструмент для глубокой переработки своего текста, становится неясно, на что именно претендует метка — на работу ИИ или на творческий вклад человека.
Что это значит
Технология невидимой маркировки текста — это способ подтвердить происхождение контента, не меняя его визуально. Однако из-за того, что метка завязана на контексте и последовательности слов, любая серьезная переработка текста полностью разрушает этот статистический след.
