OpenAI готовит к выпуску модель Astra с высоким потенциалом взлома
OpenAI анонсировала скорый выход новой языковой модели Astra, способной находить уязвимости в компьютерных системах.
OpenAI объявила о скором релизе новой языковой модели Astra, которая продемонстрировала высокую эффективность в тестах на проникновение в компьютерные системы. Разработчики подтвердили, что модель умеет находить уязвимости в коде, обходить CAPTCHA и имитировать действия хакеров для скрытного доступа к данным.
Команда OpenAI тестирует систему защиты, чтобы снизить риски. Внутренние проверки показали, что Astra успешно атакует условные цели в 73% случаев без специальных ограничений. Сейчас модель блокируют при попытке выполнить опасные команды, но разработчики признают, что полностью исключить угрозу невозможно.
Astra основана на новой архитектуре, сочетающей аналитические возможности GPT-4 с алгоритмами автономного поиска уязвимостей. Модель обучали на 40% больше данных, чем предыдущие версии, включая специализированные базы по кибербезопасности.
Эксперты опасаются, что технология может попасть к злоумышленникам. OpenAI заявила о введении многоуровневой верификации для пользователей и ограничении доступа к API. Первыми Astra получат 150 проверенных компаний из числа партнёров.
Тестовый релиз запланирован на второй квартал 2024 года. В OpenAI подчеркивают, что модель разрабатывают для защиты систем, а не для атак. Astra будет сканировать сети на уязвимости и автоматически предлагать исправления.