OpenAI усиливает защиту моделей после инцидента с Hugging Face
Компания ужесточила контроль за разработкой и посттренингом ИИ-моделей после уязвимостей на платформе Hugging Face.
OpenAI усилил мониторинг моделей на всех этапах разработки и посттренинга. Изменения включают детальный контроль поведения моделей и проверку их соответствия целям безопасности.
Поводом стали недавние уязвимости на платформе Hugging Face, через которые злоумышленники получили доступ к ряду моделей. OpenAI не пострадал напрямую, но инцидент заставил компанию пересмотреть подходы к защите.
Теперь OpenAI уделяет больше внимания согласованности (alignment) — проверке, что модель работает в рамках заданных параметров. На этапе посттренинга введены дополнительные проверки, включая стресс-тесты и анализ угроз.
Эксперты отмечают, что инцидент с Hugging Face показал риски для открытых ИИ-платформ. Даже модели с ограниченным доступом могут стать мишенью при наличии уязвимостей в инфраструктуре.
OpenAI не раскрывает технические детали новых мер, но часть изменений касается инструментов внутреннего аудита. Компания также расширила команду, отвечающую за безопасность моделей.
Инцидент не привёл к утечке данных пользователей, но временно замедлил работу некоторых сервисов Hugging Face. Платформа устранила уязвимости и добавила новые уровни защиты. Ужесточение стандартов безопасности становится отраслевой нормой.