Anthropic открыла API для проверки водяных знаков в текстах Claude

Anthropic запустила закрытое тестирование API, определяющего вероятность участия Claude в создании текста. Доступ могут запросить регуляторы, СМИ, фактчекеры, исследователи, образовательные организации и компании, которым проверка нужна для соблюдения требований ЕС.

Anthropic открыла в режиме private preview API для обнаружения цифровых водяных знаков в текстах, созданных или существенно отредактированных моделями Claude. На первом этапе инструмент доступен одобренным организациям, включая регуляторов, правоохранительные органы, СМИ, фактчекеров, независимых исследователей и образовательные учреждения. Компания намерена постепенно расширять доступ.

Водяной знак основан на методе SynthID-Text от Google DeepMind. Он формирует статистически распознаваемый рисунок при выборе моделью слов, не добавляя в текст скрытых символов или сведений о пользователе, организации и переписке.

API оценивает только вероятность участия Claude и не способен подтвердить человеческое авторство или определить использование другой нейросети. Точность ниже на коротких фрагментах, фактологических текстах и программном коде; полное переписывание текста может удалить распознаваемый рисунок.

Anthropic внедряет маркировку в рамках выполнения требований Акта ЕС об искусственном интеллекте и Кодекса практики по прозрачности контента, созданного ИИ. Водяные знаки применяются к текстовым результатам новых моделей Claude, выпущенных после 2 августа 2026 года.

Источник: anthropic.com

Связь с редакцией