18.08.2026
Новые модели Claude будут помечать текст статистическим паттерном в выборе слов, а Anthropic готовит API для его обнаружения. Компания заявляет, что механизм не ухудшает ответы, однако критики сомневаются в полной нейтральности такого вмешательства в генерацию.
Компания Anthropic описала механизм водяных знаков для текстов, создаваемых Claude. Он основан на разработанном Google DeepMind методе SynthID-Text: при выборе между несколькими подходящими продолжениями модель использует секретный ключ и предыдущие слова, формируя статистически обнаружимый паттерн.
В текст не добавляются видимые отметки или скрытые символы, а водяной знак не содержит сведений о пользователе, организации или конкретном диалоге. Проверка сможет лишь оценить вероятность участия Claude в создании или существенном редактировании текста. На коротких и фактологических фрагментах, а также в программном коде обнаружение работает хуже; лёгкая правка может сохранить паттерн, а полная перефразировка способна его удалить.
Anthropic утверждает, что водяной знак не влияет на содержание, читаемость и творческие качества ответов. Соавтор языка разметки Markdown Джон Грубер оспорил этот вывод: по его мнению, синонимы не полностью равнозначны, поэтому выбор слова с учётом секретного ключа иногда может приводить к менее точной формулировке.
Маркировка вводится для выполнения требований европейского Акта об искусственном интеллекте и будет применяться глобально. Новые модели Claude получат её по умолчанию, а модели, выпущенные до 2 августа 2026 года, Anthropic планирует обновить в ближайшие месяцы. Компания также готовит API, который позволит сторонним сервисам проверять тексты.
Для юридических и корпоративных документов это создаёт дополнительные вопросы прозрачности. Как отмечает Artificial Lawyer, после появления средств проверки участие ИИ можно будет обнаружить даже в отдельных фрагментах документа, хотя сам водяной знак не устанавливает авторство, объём работы модели или юридическую ответственность.
Источник: anthropic.com