Водяные знаки в текстах Claude: сигнал, а не доказательство
Anthropic подписала европейский кодекс прозрачности ИИ-контента и описала, как будет его выполнять: модели Claude, выпущенные после 2 августа, будут помечать сгенерированный текст с первого дня. Знак невидимый, вплетён в сам текст, переживает копирование и часть правок. Применяется на уровне модели — он будет в тексте независимо от того, каким продуктом или облаком вы пользуетесь: приложение, API, AWS, Google Cloud. И не только в Европе — везде, где работает Claude.
Причина — европейский закон об ИИ: со 2 августа действует статья о прозрачности, кодекс подписали около 190 компаний, включая OpenAI и Google. Картинки и файлы у Claude получают подписанные метаданные о происхождении. Старые модели «в работе» — закон даёт переходный период, своих дат Anthropic не называет.
Как именно устроен знак, Anthropic не раскрывает. Зато честно пишет, что он доказывает — и что нет.
Знак говорит одно: текст, вероятно, проходил через Claude — и не более. «ИИ написал всё» и «ИИ вычитал мой абзац» помечаются одинаково, и даже сам знак Anthropic называет сигналом, а не доказательством. И наоборот: отсутствие знака не означает, что текст написан человеком, — об этом Anthropic пишет сама. Детектор, кстати, ещё не выпущен.
Для тех, кто работает с тайной — банк, юридическая фирма, госструктура — вопрос не в знаке. Каждый запрос к облачной модели — это ваш документ, который обрабатывается на чужом сервере, по чужим правилам. Водяной знак лишь сделал это видимым.
Ответ здесь архитектурный. Модель, которая живёт в вашем контуре: документы не покидают периметр, журналы доступа ваши, и проверяется это аудитом инфраструктуры, а не верой в детектор. Мы так и разворачиваем ассистентов: открытая модель на железе клиента, поверх — поиск по вашему корпусу, ссылка на пункт, честный отказ. И паспорт качества, который можно перепроверить.
Вопрос «куда уходит документ» существовал и до водяных знаков. Знаки просто сделали его видимым.