Anthropic добавит водяные знаки к тексту своих ИИ-моделей
Компания внедрит технологию для маркировки контента, созданного как новыми, так и старыми версиями ИИ.
Anthropic расширит поддержку водяных знаков для текста, который генерируют её ИИ-модели. Технологию внедрят не только в новые, но и в старые версии систем. Это позволит отмечать машинный контент даже в ранних генерациях.
Водяные знаки — скрытые метки в тексте, помогающие отличить написанное ИИ от человеческого. Они работают на уровне токенов, не влияя на читаемость. Компания уже тестирует метод в Claude 3, а теперь готовит обновления для предыдущих моделей.
Решение связано с ростом проблем из-за неразмеченного ИИ-контента. Поддельные новости, спам и плагиат сложно выявлять без специальных маркеров. Anthropic стремится сделать генерации прозрачными, чтобы платформы и пользователи могли фильтровать информацию.
Технология пока не идеальна. Водяные знаки можно удалить переписыванием текста, а ложные срабатывания случаются. Но это первый шаг к стандартизации маркировки. Компания работает над улучшением точности и защитой от взлома.
Другие разработчики ИИ, включая OpenAI и Google, тоже экспериментируют с подобными методами. Пока нет единого подхода — каждая компания использует свои алгоритмы. Эксперты предлагают создать общий стандарт, чтобы системы могли распознавать любой ИИ-контент.