Стоимость развёртывания крупных языковых моделей в России резко выросла
Анализ MWS Cloud показал, что за год затраты на запуск больших языковых моделей в России увеличились в 2,8 раза.
MWS Cloud, подразделение «МТС Web Services», изучила требования к вычислительным ресурсам для работы больших языковых моделей. Результаты показали, что за последний год стоимость их развёртывания в России выросла в 2,8 раза.
Основной причиной роста цен стал дефицит GPU. Спрос на видеокарты и тензорные процессоры резко увеличился из-за бума генеративного ИИ. Крупные игроки, такие как OpenAI и Google, активно скупают оборудование, что усугубляет дефицит.
Для запуска модели уровня GPT-4 теперь требуется минимум 16 серверов с 8 GPU каждый. Год назад аналогичный результат достигался на 6 машинах. Затраты на электроэнергию выросли на 40% из-за повышения тарифов и увеличения сложности вычислений.
Российские компании чаще выбирают локальные аналоги зарубежных моделей, но их адаптация тоже дорожает. Например, развёртывание RuGPT-3 теперь обходится в 1,5 раза дороже, чем в 2023 году. Аналитики связывают это с санкциями и логистическими проблемами.
MWS Cloud прогнозирует дальнейший рост цен на 20-30% в течение следующего года. Альтернативой могут стать облачные решения, но их доля пока не превышает 15% рынка ИИ-инфраструктуры в России.