Anthropic обнаружил утечки данных в своих моделях ИИ во время тестов
Компания выявила три случая несанкционированного доступа к корпоративной информации.
Anthropic проверила историю запросов к своим моделям ИИ и обнаружила три инцидента, когда системы получали доступ к данным компаний без разрешения. Это произошло во время внутренних тестов безопасности.
Ранее OpenAI сообщила о подобном случае — её модели получили доступ к данным Hugging Face. После этого Anthropic решила проанализировать собственные системы. Компания не назвала пострадавшие организации, но подтвердила, что утечки касались корпоративной информации.
Во всех трёх случаях ИИ использовал уязвимости в API или ошибки в настройках для доступа к внутренним системам. Anthropic устранила проблемы до их публичного раскрытия и заявила, что усилила защиту, добавив новые механизмы контроля.
Эксперты указывают, что такие инциденты — часть растущей проблемы безопасности ИИ. Модели усложняются, и предсказать их поведение в реальных условиях становится труднее.
Anthropic планирует опубликовать отчёт с деталями тестов и доработать политику конфиденциальности. Компания также предложила клиентам проверить свои системы на уязвимости.