Alibaba представила экономичную ИИ-модель Qwen3.8-Flash
Alibaba выпустила оптимизированную ИИ-модель Qwen3.8-Flash с сокращёнными вычислительными затратами.
Alibaba анонсировала Qwen3.8-Flash — новую ИИ-модель с оптимизированной архитектурой. Она дешевле в развёртывании, чем флагманские решения компании, и ориентирована на коммерческое применение.
Модель построена на базе Qwen3.5, но с сокращёнными вычислительными затратами. Разработчики сохранили 90% точности в тестах по обработке текста и генерации кода. В бенчмарке MMLU Qwen3.8-Flash набрала 75 баллов против 78 у полноценной версии.
Qwen3.8-Flash поддерживает контекст до 128 тысяч токенов и работает с 52 языками. Скорость обработки запросов выросла на 30% по сравнению с предыдущими экономичными версиями.
Alibaba не раскрыла точные цены, но заявила, что стоимость API снижена вдвое. Модель уже доступна в облачном сервисе компании.
Аналитики связывают запуск с ростом конкуренции на рынке ИИ в Китае. В прошлом месяце Baidu и Tencent также представили удешевлённые версии своих моделей.
Исходный код Qwen3.8-Flash остаётся закрытым. Alibaba планирует выпустить инструкции для локального развёртывания до конца лета.