Anthropic рассказала, как будет работать маркировка сгенерированного через Claude текста — «водяной знак» будет незаметен для читателя и не повлияет на качество ответов
Компания использует технологию SynthID‑Text, разработанную Google DeepMind.
- Метод позволяет создавать в ответах «определённый шаблон», невидимый для читателя, но распознаваемый тем, у кого есть ключ для расшифровки, объясняет Anthropic.
- При генерации текста модель каждый раз выбирает следующее слово из набора вероятных вариантов. В некоторых местах значение фразы не меняется от того, какое слово использовать — например «пасмурно» или «серо». Обычно в таких случаях выбор определяется случайно. Но для маркировки нейросеть будет использовать «специальный ключ» и несколько предыдущих фраз, чтобы выбрать нужное слово.
- Anthropic отмечает, что модель не будет добавлять в текст скрытые символы или другие элементы. Маркировка также не повлияет на качество ответов и скорость работы Claude.
- У метода SynthID‑Text есть и ограничения. Маркировка «проявится» только там, где у модели есть свобода выбора между сопоставимыми вариантами. В строго фактических формулировках, где есть единственно корректный выбор, механизм работать не будет.
- При генерации коротких ответов, надёжность «водяного знака» будет ниже. Если ИИ используют для исправления орфографии в человеческом тексте, то водяной знак также «не проявится». Но чем большую долю текста переписывает модель, тем отчётливей будет маркировка.
- В августе 2026 года Anthropic объявила, что начнёт маркировать тексты и графику, сгенерированные или отредактированные через Claude. Маркировку ввели из‑за требований ЕС, но она будет работать по всему миру.