Регулирование искусственного интеллекта официально перешло от необязательных добровольных обещаний к жестким законодательным требованиям. Согласно Закону ЕС об ИИ (EU AI Act), вступившему в силу для участников рынка 2 августа, ведущие разработчики, обслуживающие европейских пользователей, обязаны маркировать сгенерированный их системами синтетический текст. Чтобы соответствовать этим нормам и общеотраслевому Кодексу добросовестных практик, Anthropic подтвердила, что будущие модели Claude будут создавать текст со встроенными математическими водяными знаками.
Механика сэмплирования при маркировке токенов
Большие языковые модели работают путем пошагового прогнозирования и генерации текста токен за токеном, последовательно выбирая их из распределения вероятных вариантов на основе предыдущего контекста. Когда несколько вариантов имеют одинаковый смысловой вес — например, выбор между словами пасмурно или серо после фразы «Погода сегодня была холодной и...» — стандартное сэмплирование делает выбор с помощью обычного генератора псевдослучайных чисел. Реализация от Anthropic заменяет базовую энтропию детерминированным ключом, который обуславливает выбор токена непосредственно на основе предшествующей последовательности.
«Вместо использования случайного генератора для выбора следующего слова водяной знак задействует ключ и несколько предыдущих слов, определяя, какой вариант должна выбрать модель».
Поскольку замена происходит исключительно среди кандидатов с высокой вероятностью, система никогда не выбирает противоестественные аномалии или малопонятные редкие синонимы. Возникающее в результате статистическое смещение остается абсолютно незаметным для читателя, однако позволяет любому обладателю ключа проверки математически доказать авторство Claude.
Сохранение качества и нулевые накладные расходы
Для корпоративных архитектур и интеграций в продукты такая маркировка не создает дополнительных вычислительных затрат, не влияет на расход токенов и не меняет стоимость API. Поскольку технология полностью опирается на псевдослучайное распределение токенов, а не на скрытые символы Юникода или внедренные метаданные, сгенерированный текст не содержит пользовательских идентификаторов, связывающих результат с конкретной учетной записью, организацией или сессией чата.
Массовое внедрение маркировки на уровне токенов формирует единый стандарт соблюдения регуляторных норм для всех поставщиков базовых моделей без снижения интеллектуальных возможностей систем и раздувания бюджетов на вычисления. По мере того как передовые разработчики объединяются вокруг общего Кодекса практик, обнаружение синтетического текста будет все больше полагаться на строгую статистическую верификацию вместо инвазивных и легко обходимых фильтров постобработки.