РекламаРекламаРеклама
ИИ

Компания Alibaba выпустила ИИ-модель Qwen3.8-Flash с 125 миллиардами параметров

26.08.2026, 20:43 • Евгения Слив

(обновлено: 26.08.2026)

Компания Alibaba выпустила ИИ-модель Qwen3.8-Flash с 125 миллиардами параметров

Корпорация Alibaba Group Holding Ltd. выпустила Qwen3.8-Flash – модель искусственного интеллекта по сниженной цене, призванную стимулировать глобальное распространение ИИ-платформы Qwen. Компания открыла модель для скачивания и опубликовала ее веса – параметры, которые помогают ИИ-системам принимать решения. По заявлению Alibaba, Qwen3.8-Flash содержит 125 миллиардов параметров и по производительности сопоставима с последними разработками конкурентов, в том числе Opus 4.6 от Anthropic и V4-Flash от DeepSeek.

Производственная версия модели доступна через API QwenCloud по цене 0,16 доллара за миллион входных токенов и 0,47 доллара за миллион выходных токенов. Архитектура Qwen3.8-Flash использует 125 миллиардов параметров плюс 51 миллиард N-gram эмбеддингов, при этом на каждый токен активируется лишь 6 миллиардов из них, что обеспечивает высокую энергоэффективность при обработке запросов.

Модель продемонстрировала следующие результаты на отраслевых бенчмарках: 58,7 балла на DeepSWE 1.1, 62,5 – на SWE-bench Pro, 73,9 – на CoWorkBench, 84,5 – на AndroidWorld и 95,7 – на MathVision с учетом доверительных интервалов. По данным компании, Qwen3.8-Flash была обучена за одну девятую стоимости предыдущей модели Qwen3.7-Plus, при этом превзойдя ее в задачах программирования и работы с офисными приложениями.

Alibaba также опубликовала веса модели Qwen3.8-Flash-Next – раннего превью архитектуры, запланированной для следующего поколения Qwen4. Данная модель нативно поддерживает контекст в 262 144 токена и расширяема до 1 миллиона токенов с помощью технологии YaRN. Веса обеих моделей доступны на платформах Hugging Face и ModelScope для исследований и коммерческого использования.

Выпуск оптимизированной модели с открытыми весами отражает стратегию Alibaba по democratization доступа к передовым ИИ-технологиям и укреплению позиций платформы Qwen на глобальном рынке. Снижение стоимости инференса при сохранении конкурентной производительности позволяет разработчикам интегрировать возможности генеративного ИИ в свои продукты с меньшими затратами на инфраструктуру.

Популярные статьи