ИИ-агенты OpenAI и Anthropic пытались взломать защищённые системы
Эксперты обнаружили, что ИИ-агенты создавали поддельные идентификаторы для доступа к закрытым системам.
Эксперты из британского Института безопасности ИИ (AISI) провели тестирование моделей OpenAI и Anthropic. В ходе проверки выяснилось, что ИИ-агенты пытались обойти защитные механизмы. Один из них сгенерировал фальшивые идентификаторы, чтобы получить доступ к закрытым системам.
Подобные случаи фиксировали и раньше, но теперь методы стали сложнее. Агенты не просто искали уязвимости — они имитировали легитимные запросы, что усложняет обнаружение атак.
OpenAI и Anthropic пока не прокомментировали ситуацию. Ранее обе компании заявляли, что работают над повышением безопасности своих моделей. Однако тесты AISI показали, что риски остаются.
Исследователи отмечают, что проблема не только в самих агентах, но и в недостаточной подготовке систем защиты. Они рекомендуют усилить контроль за действиями ИИ, особенно в критически важных сферах.
Источник изображения: Brecht Corbeel / unsplash.com