Глава Anthropic предложил план контроля за развитием ИИ
Компания Anthropic представила поэтапный подход к разработке ИИ для снижения рисков.
Anthropic разработала систему безопасного развития передовых ИИ-моделей. Компания предлагает постепенный выход технологий вместо резкого скачка, чтобы общество успевало адаптироваться и минимизировать риски.
План включает три элемента: прозрачное тестирование моделей перед выпуском, постепенное увеличение возможностей систем и независимый аудит на каждом этапе.
Компания уже применяет этот подход к своей модели Claude. Вместо единовременного выпуска максимально мощной версии Anthropic последовательно развертывает улучшенные итерации. Между обновлениями проходит 2–4 месяца — время для анализа воздействия.
Эксперты считают, что метод контролируемого темпа может стать отраслевым стандартом. OpenAI и Google DeepMind изучают похожие стратегии.
Критики опасаются замедления прогресса, но в Anthropic уверены, что выгоды от ответственного внедрения перевешивают временные задержки. Компания призывает регуляторов поддержать инициативу.
Параллельно Anthropic разрабатывает инструменты для оценки безопасности ИИ. В проекте участвуют 50 исследователей, а бюджет на 2024 год превышает $100 млн.