Anthropic представила схему маркировки текстов, созданных Claude, чтобы выполнить требования EU AI Act. Как сообщает The Register, в основе подхода лежит метод из работы Google DeepMind о SynthID-Text. Модель меняет выбор слов, не затрагивая общий смысл фразы. В результате формируется статистическая сигнатура, которую можно обнаружить с помощью цифрового ключа.
По утверждению Anthropic, внутренние испытания показали, что маркировка не влияет на содержание, креативность и читаемость текстов Claude. Участники контролируемого исследования тоже не заметили разницы в качестве между ответами с меткой и без нее. В фактологических фрагментах маркировка встречается реже, поскольку там сложнее менять слова без риска для точности. В программном коде есть другое ограничение: алгоритм не может произвольно заменять названия методов.
Схема не использует персональные данные. Она лишь указывает на вероятность того, что Claude участвовал в создании текста на каком-то этапе. При этом Anthropic признает, что устойчивость метода ограничена. Легкое редактирование, скорее всего, не удалит метку полностью, однако полная переработка с заменой каждого слова устранит ее.
Ключевые факты
Во внутренних испытаниях Anthropic маркировка не повлияла на содержание, креативность и читаемость текстов Claude.
В контролируемом исследовании участники не увидели разницы в качестве между ответами с маркировкой и без нее.
В фактологических фрагментах маркировка используется реже, а в программном коде алгоритм не может произвольно заменять названия методов.
Легкое редактирование, вероятно, не удалит метку полностью, но полная замена всех слов устранит ее.