Главная / Аналитика / Инструменты
Инструменты

Anthropic раскрыла принцип работы водяных знаков в Claude

Компания объяснила, как будет маркировать тексты, созданные ИИ.

Артём Соколов2 минсегодня
Anthropic раскрыла принцип работы водяных знаков в Claude

Anthropic подробно рассказала о системе водяных знаков, которые внедряет в тексты, сгенерированные Claude. Технология позволит отмечать контент, созданный ИИ, даже после редактирования.

Водяные знаки работают на уровне структуры текста. Модель встраивает незаметные для человека паттерны — например, в распределение слов или знаков препинания. Эти маркеры сохраняются при незначительных правках: исправлении опечаток, перефразировании или изменении порядка предложений.

Система не идеальна. Если полностью переписать текст вручную, водяные знаки могут исчезнуть. Однако для их удаления потребуется серьезная переработка, а не просто косметические изменения.

Для кода водяные знаки встраивают в комментарии и структуру так, чтобы это не влияло на выполнение программы. Даже если удалить часть комментариев, маркеры останутся в других элементах.

Anthropic тестирует технологию в экспериментальном режиме. Компания признает, что водяные знаки — не панацея, но они усложнят массовое распространение текстов Claude под видом человеческих.

Пока система обнаруживает только свои водяные знаки, но в будущем возможно создание универсального инструмента для проверки.