Кибер-Миша
Релиз26 авг 2026· 🇨🇳 Alibaba (Qwen)

Qwen3.8-Flash-Next вышла с открытыми весами на Hugging Face

2026-08-26 Alibaba Qwen опубликовала открытые веса Qwen3.8-Flash-Next. Карточка на Hugging Face указывает объём 180B параметров и размер файлов около 360 GB. Модель принимает текст и изображения, подходит для работы с кодом и позиционируется как экспериментальная проверка архитектуры будущей линейки Qwen4. Независимых замеров качества и скорости пока нет.

Веса распространяются по Qwen Community License 1.0; доступны исходная версия и отдельная сборка FP8. Для развёртывания у себя заявлена поддержка Transformers, vLLM и SGLang. Архитектура сочетает Gated DeltaNet и Qwen Sparse Attention, чтобы снизить затраты при обработке длинного контекста. Точные параметры контекстного окна, число активных параметров и цена официального API для этой версии в доступных материалах не указаны.

Для бизнеса релиз интересен командам, которым нужны мультимодальная модель и контроль над размещением данных. Однако полный комплект весов около 360 GB требует серверного оборудования и затрат на настройку; достоверную стоимость эксплуатации в рублях без конфигурации, тарифа на электроэнергию и профиля нагрузки рассчитать нельзя. Риск — экспериментальный статус архитектуры и отсутствие независимых замеров; перед внедрением стоит проверить качество, скорость и стабильность на собственных документах и рабочих сценариях.

Дальше важно отслеживать результаты независимых испытаний, поддержку оптимизированных форматов и появление производственной версии Qwen3.8-Flash в официальных сервисах. Отдельного сравнения Qwen3.8-Flash-Next с Qwen3.8 27B на одинаковом оборудовании первоисточник пока не предоставил.

Первоисточник ↗

Что за модель: Qwen3.8-Flash-Next

Alibaba Qwen выпустила Qwen3.8-Flash-Next 2026-08-24 как экспериментальную открытую модель с поддержкой текста, программного кода, изображений и видео. Модель содержит 125 млрд параметров и задействует 6 млрд при обработке запроса; отдельно заявлены 51 млрд параметров n-gram embeddings и 4 млрд параметров MTP. Базовый контекст составляет 262 144 токена, с возможностью расширения до 1 млн токенов. Архитектура объединяет Gated DeltaNet, Qwen Sparse Attention и 512 экспертов, из которых на каждом шаге работают 10 маршрутизируемых и один общий. Все опубликованные результаты тестов предоставлены вендором, независимых замеров пока нет.

РазработчикAlibaba (Qwen)
Дата выхода24 августа 2026
Контекст262K
ДоступОткрытые веса
ЛицензияQwen Community License 1.0
Цена входа$0.16 · ≈ 14 ₽
Цена вывода$0.47 · ≈ 42 ₽
Полная карточка Qwen3.8-Flash-Next: цена, характеристики, история версий

Что это значит для бизнеса

Модель подходит компаниям, которым нужны обработка документов, программного кода и визуальных материалов с возможностью развернуть систему у себя. Основное преимущество — только 6 млрд активных параметров при общей емкости 125 млрд, что потенциально снижает вычислительные расходы по сравнению с полностью активными моделями сопоставимого размера. Риск — экспериментальный статус архитектуры и отсутствие независимых измерений скорости, качества и требований к оборудованию; перед внедрением следует провести проверку на собственных данных и рассчитать стоимость инфраструктуры. Цена официального API в USD за 1M токенов для этой версии не опубликована.

Хроника Qwen3.8-Flash-Next

27 авг 2026Апдейт

Qwen3.8-Flash-Next вышла с открытыми весами

Qwen опубликовала веса Qwen3.8-Flash-Next на Hugging Face и ModelScope 2026-08-27. Это экспериментальная мультимодальная MoE-модель на 125 млрд параметров, из которых при работе задействуются 6 млрд; собственный контекст составляет 262 144 токена с заявленной возможностью расширения до 1 млн. По данным Qwen, модель набрала 62,5 на SWE-bench Pro и 58,7 на DeepSWE 1.1, однако независимых замеров пока нет. Веса распространяются по Qwen Community License 1.0.

26 авг 2026Апдейт

Qwen3.8-Flash-Next вышла с открытыми весами и архитектурой Qwen4

Alibaba Qwen выпустила открытые веса Qwen3.8-Flash-Next 2026-08-26. Модель сочетает основную часть на 125B параметров и N-gram embeddings на 51B, при работе активируются 6B параметров на токен. Нативный контекст составляет 262 144 токена, расширение до 1M доступно через YaRN. Все показатели производительности опубликованы вендором, независимых замеров пока нет.

26 авг 2026Апдейт

Qwen3.8-Flash-Next стала доступна с открытыми весами

Alibaba Qwen опубликовала веса Qwen3.8-Flash-Next на Hugging Face 2026-08-26. Репозиторий содержит модель объёмом 180B параметров и лицензию Qwen Community License 1.0. Модель работает с текстом, кодом и изображениями; заявлена поддержка Transformers, vLLM и SGLang. Это экспериментальная версия архитектуры, которую Qwen связывает с будущей линейкой Qwen4; независимых замеров скорости и качества пока нет.

24 авг 2026Релиз

Alibaba Qwen выпустила открытую модель Qwen3.8-Flash-Next

Alibaba Qwen опубликовала веса Qwen3.8-Flash-Next — экспериментальной модели с 125 млрд параметров, из которых 6 млрд задействуются при обработке запроса. Модель работает с текстом, программным кодом, изображениями и видео, а базовый контекст составляет 262 144 токена. По данным вендора, архитектура станет основой будущего семейства Qwen4; независимых замеров производительности пока нет.