
Критики: водяной знак Claude меняет качество на комплаенс
Через неделю после того как Anthropic начала встраивать невидимые водяные знаки в текстовые ответы Claude, критики ставят под вопрос, стоят ли издержки этой техники того, что она реально даёт, сообщил The Decoder 17 августа.
Сам водяной знак, который Anthropic начала внедрять ранее в этом месяце, работает через изменение случайности, которую Claude использует при выборе между примерно равнозначными вариантами слов, — на основе SynthID-Text, техники, которую Google DeepMind опубликовала в Nature в 2024 году. Система использует секретный ключ и предшествующие слова, чтобы определить, какой синоним будет выбран, встраивая статистически обнаруживаемый паттерн без каких-либо видимых меток или скрытых символов в тексте.
Главная претензия, наиболее чётко сформулированная блогером Джоном Грубером, состоит в том, что синонимы на самом деле не взаимозаменяемы: выбор между «пасмурно» и «серо» на основе скрытого ключа водяного знака, а не смысловой точности, пусть немного, но меняет то, что сообщает предложение. Грубер утверждает, что заявление Anthropic о незаметности техники для читателя не выдерживает критики. Отдельно указывается, что инструменты вроде Declaude уже способны снимать водяной знак через перефразирование, а значит техника даёт слабую защиту против тех, кто целенаправленно пытается её обойти. Критики также отмечают более тонкую юридическую проблему: водяной знак сохраняется, когда текст, созданный Claude, переиспользуется в последующих документах, а вывод нескольких размеченных водяными знаками ИИ-систем может накладываться друг на друга в пределах одного текста.
“Заявление Anthropic о том, что различия незаметны, просто неверно.”
— Джон Грубер, блогер, Daring Fireball
- Водяной знак Claude, основанный на SynthID-Text от Google DeepMind, смещает выбор слов среди почти равнозначных синонимов
- Применяется ко всем моделям Claude, выпущенным с 2 августа 2026 года; более старые модели получат его в ближайшие месяцы
- Критики говорят, что смещение выбора синонимов ради скрытого сигнала незаметно меняет смысл — вопреки формулировке Anthropic о «незаметности»
- Инструменты перефразирования вроде Declaude уже способны снимать водяной знак
- Сохранение и наложение водяных знаков в переиспользуемом или мультимодельном тексте поднимают отдельные юридические вопросы и вопросы происхождения контента
Сама Anthropic не утверждает, что водяной знак непробиваем: компания признала, что не может отличить текст, который Claude написал, от текста, который Claude лишь слегка отредактировала, что сигнал становится разреженным в коротких фрагментах или фактологических текстах с малым выбором слов, и что тщательная переписка способна полностью его убрать. Это более узкое заявление, чем «обнаруживает ИИ-контент», и разрыв между этими двумя формулировками — как раз то место, куда попадает критика этой недели. Водяной знак создавался для соответствия требованию прозрачности из статьи 50 EU AI Act, а не для победы в гонке вооружений против тех, кто целенаправленно пытается скрыть ИИ-сгенерированный текст, и компромисс, который описывают критики, — это цена выбора регуляторного соответствия в качестве цели разработки вместо этого.
Ничего из вышеперечисленного не стоит воспринимать как персональную инвестиционную рекомендацию.

Комментарии (0)
Пока нет комментариев — будь первым!
Похожие материалы
ПопулярноеТоп 7
Крипторынок теряет 4-5% за день: что говорят объёмы и трейдеры
71Рынок





