Перейти к содержанию

Как работает водяной знак ИИ

Обновлено September 1, 2026 · впервые опубликовано September 1, 2026

Краткий ответ: В тексте, созданном поддерживаемыми моделями Claude, есть невидимый сигнал. Вы его не видите, и ваши пользователи тоже. Он не меняет смысл, качество или восприятие текста и не появляется в счёте. Тем...

В тексте, созданном поддерживаемыми моделями Claude, есть невидимый сигнал. Вы его не видите, и ваши пользователи тоже. Он не меняет смысл, качество или восприятие текста и не появляется в счёте. Тем не менее он там есть, и стоит потратить десять минут, чтобы его понять: то, что его ломает, ваш собственный конвейер делает каждый день.

Как работает текстовый водяной знак

Языковая модель не выбирает самый вероятный следующий токен. Она выбирает токен из распределения вероятностей, и в этом выборе есть случайность. Техника водяного знака — по подходу SynthID-Text от Google DeepMind — смещает эту случайность. Определённые токены становятся чуть более вероятными, чем были бы иначе, по закономерности, которую знает только детектор.

Выбор одного слова ничем не примечателен: всегда была правдоподобная альтернатива, и модель выбрала одну из них. Но на протяжении нескольких сотен токенов закономерность складывается в статистический сигнал, который детектор может измерить, а читатель нет. В этом весь трюк: водяной знак прячется в решении, которое модель и так принимала случайно.

Из этого сразу следуют два следствия, и оба важнее самого механизма. Во-первых, это статистика, а не печать: нет поля, которое можно прочитать, есть только уровень уверенности, который надо вычислить. Во-вторых, нужна длина. Вывод размером с твит несёт гораздо меньше сигнала, чем целая страница.

Как устроена проверка происхождения изображений и почему она другая

С файлами и изображениями подход противоположный. Сгенерированные файлы .svg, .png и .jpg несут метаданные C2PA: криптографически подписанный манифест, в котором записано, что создало файл. Это не статистика и не скрыто: это дискретный блок данных, прикреплённый к файлу, который проверяется точно, а не вероятностно.

Компромисс именно такой, какого и стоило ожидать. Подписанные метаданные дают определённость, и их можно удалить одной командой. Статистический текстовый водяной знак нельзя чисто удалить, но он деградирует при редактировании, перефразировании и переводе. Ни то ни другое не является замком; оба являются доказательствами.

Кто может проверять

Детекция ограничена. 1 сентября 2026 года API открылся для подходящих организаций: регуляторов, правоохранительных органов, СМИ, фактчекеров, независимых исследователей, образовательных учреждений, групп гражданского общества ЕС и предприятий со своими обязательствами по проверке. Доступ со временем расширяется. Если вы не подходите под критерии, вы не сможете проверить свой собственный вывод через API, и доказательства придётся брать из собственных логов.

Зачем это нужно

Статья 50 Закона ЕС об ИИ вступила в силу 2 августа 2026 года; она требует машиночитаемой маркировки контента, созданного ИИ. Маркировка применяется по всему миру, а не только в ЕС. Это более простое инженерное решение, и означает оно, что маркировка уже есть в выводе, который вы выпустили несколько месяцев назад.

Что это значит для ваших систем

Три практических факта. Короткие выводы несут слабый сигнал, поэтому классификатор или сервис извлечения, возвращающий отдельные слова, фактически не помечен. Тяжёлая постобработка — перефразирование, суммаризация, перевод или прогон текста через вторую модель — размывает сигнал, так что цепочка моделей в лучшем случае приписывает происхождение последней из них. А ваш конвейер изображений может случайно уничтожить метаданные C2PA, и это самый распространённый способ потерять происхождение в продакшене.

Ни один из этих фактов не требует менять то, что вы строите. Это повод знать, какие ваши выводы всё ещё несут происхождение, а какие нет, прежде чем кто-то попросит это доказать.

Связанное

По теме


Хотите применить это к своему стеку? Принесите счета провайдеров, логи шлюза и ключевые рабочие процессы — мы определим драйверы затрат и пути экономии. Заказать бесплатный аудит →

Вернуться на finopsllm.com