Стоимость развёртывания ведущих ИИ-моделей в России выросла в 2,8 раза
Компания MWS Cloud выяснила, что затраты на оборудование для запуска языковых моделей за год увеличились почти втрое.
Компания MWS Cloud проанализировала требования к вычислительным ресурсам для запуска мировых и российских языковых моделей. В исследовании участвовали популярные открытые модели, выпущенные весной и летом 2025 года.
Для 2025 года эксперты оценили Kimi K2, gpt-oss-120b, Gemma 3 27B, GLM-4.5V, Qwen3 235B и российскую Cotype Pro 2. В 2026 году в список вошли Kimi K3, Qwen3.5 397B, DeepSeek-V4-Pro, DeepSeek-V4-Flash, GLM-5.2, Gemma 4 и Cotype Pro 3.
Средняя стоимость минимального набора ускорителей NVIDIA для развёртывания этих моделей за год выросла в 2,8 раза. Точные цифры не указаны, но тенденция показывает, что развитие ИИ требует всё больше ресурсов.
Рост затрат связан с увеличением сложности моделей и их параметров. Например, Qwen3.5 397B почти вдвое крупнее Qwen3 235B. Российская Cotype Pro тоже демонстрирует прогресс — третья версия ожидается мощнее предыдущей.
MWS Cloud входит в МТС Web Services и специализируется на облачных решениях. Исследование подтверждает, что даже открытые модели требуют значительных вложений в оборудование. Это может повлиять на доступность ИИ-технологий для небольших компаний и стартапов.