Anthropic выявила случаи недопустимого использования моделей Claude
Компания обнаружила, что китайские DeepSeek и Moonshot перенаправляли запросы в Claude, нарушая условия API.
Anthropic опубликовала отчёт о недопустимом использовании своих ИИ-моделей Claude. В документе описаны семь категорий нарушений: кибероперации, слежка, операции влияния, разработка вооружений, биологические угрозы, мошенничество и дистилляция.
Среди ключевых находок — действия китайских компаний DeepSeek и Moonshot. Они перенаправляли пользовательские запросы в Claude, хотя предлагали собственные модели. Это нарушало условия использования API Anthropic.
Отчёт также зафиксировал попытки использовать Claude в вредоносных целях. В одном случае злоумышленники тестировали модель на уязвимости в системах кибербезопасности, в другом — пытались создать алгоритмы для мошеннических схем.
Anthropic не раскрыла, какие меры приняла против DeepSeek и Moonshot, но заявила о планах усилить контроль за доступом к API.
Эксперты отмечают, что подобные инциденты поднимают вопросы о прозрачности ИИ-разработчиков. Данных о перепродаже или неправомерном использовании моделей почти нет.
Полная версия отчёта доступна на сайте anthropic.com.