Кибер-Миша

Qwen3.8-Flash-Next

ДоступнаФронтир
🇨🇳 Alibaba (Qwen)·КитайОткрытые веса
Alibaba Qwen выпустила Qwen3.8-Flash-Next 2026-08-24 как экспериментальную открытую модель с поддержкой текста, программного кода, изображений и видео. Модель содержит 125 млрд параметров и задействует 6 млрд при обработке запроса; отдельно заявлены 51 млрд параметров n-gram embeddings и 4 млрд параметров MTP. Базовый контекст составляет 262 144 токена, с возможностью расширения до 1 млн токенов. Архитектура объединяет Gated DeltaNet, Qwen Sparse Attention и 512 экспертов, из которых на каждом шаге работают 10 маршрутизируемых и один общий. Все опубликованные результаты тестов предоставлены вендором, независимых замеров пока нет.

Для бизнеса: стоит ли брать Qwen3.8-Flash-Next

Модель подходит компаниям, которым нужны обработка документов, программного кода и визуальных материалов с возможностью развернуть систему у себя. Основное преимущество — только 6 млрд активных параметров при общей емкости 125 млрд, что потенциально снижает вычислительные расходы по сравнению с полностью активными моделями сопоставимого размера. Риск — экспериментальный статус архитектуры и отсутствие независимых измерений скорости, качества и требований к оборудованию; перед внедрением следует провести проверку на собственных данных и рассчитать стоимость инфраструктуры. Цена официального API в USD за 1M токенов для этой версии не опубликована.

Бенчмарки Qwen3.8-Flash-Next

SWE-bench Pro62.5данные вендора
SWE-bench Multilingual81данные вендора
GPQA Diamond91.7данные вендора
LiveCodeBench v691.9данные вендора
AndroidWorld84.5данные вендора
RealWorldQA88.5данные вендора

История версий и событий Qwen3.8-Flash-Next

27 авг 2026Апдейт

Qwen3.8-Flash-Next вышла с открытыми весами

Qwen опубликовала веса Qwen3.8-Flash-Next на Hugging Face и ModelScope 2026-08-27. Это экспериментальная мультимодальная MoE-модель на 125 млрд параметров, из которых при работе задействуются 6 млрд; собственный контекст составляет 262 144 токена с заявленной возможностью расширения до 1 млн. По данным Qwen, модель набрала 62,5 на SWE-bench Pro и 58,7 на DeepSWE 1.1, однако независимых замеров пока нет. Веса распространяются по Qwen Community License 1.0.

Первоисточник ↗
26 авг 2026Апдейт

Qwen3.8-Flash-Next вышла с открытыми весами и архитектурой Qwen4

Alibaba Qwen выпустила открытые веса Qwen3.8-Flash-Next 2026-08-26. Модель сочетает основную часть на 125B параметров и N-gram embeddings на 51B, при работе активируются 6B параметров на токен. Нативный контекст составляет 262 144 токена, расширение до 1M доступно через YaRN. Все показатели производительности опубликованы вендором, независимых замеров пока нет.

Первоисточник ↗
26 авг 2026Апдейт

Qwen3.8-Flash-Next стала доступна с открытыми весами

Alibaba Qwen опубликовала веса Qwen3.8-Flash-Next на Hugging Face 2026-08-26. Репозиторий содержит модель объёмом 180B параметров и лицензию Qwen Community License 1.0. Модель работает с текстом, кодом и изображениями; заявлена поддержка Transformers, vLLM и SGLang. Это экспериментальная версия архитектуры, которую Qwen связывает с будущей линейкой Qwen4; независимых замеров скорости и качества пока нет.

Первоисточник ↗
24 авг 2026Релиз

Alibaba Qwen выпустила открытую модель Qwen3.8-Flash-Next

Alibaba Qwen опубликовала веса Qwen3.8-Flash-Next — экспериментальной модели с 125 млрд параметров, из которых 6 млрд задействуются при обработке запроса. Модель работает с текстом, программным кодом, изображениями и видео, а базовый контекст составляет 262 144 токена. По данным вендора, архитектура станет основой будущего семейства Qwen4; независимых замеров производительности пока нет.

Первоисточник ↗

Частые вопросы про Qwen3.8-Flash-Next

Сколько стоит Qwen3.8-Flash-Next?

Через API — $0.16 за миллион входящих токенов и $0.47 за миллион исходящих, то есть ≈ 14 ₽ и ≈ 42 ₽ по курсу 90 ₽/$. Это списочная цена вендора: посредники и агрегаторы добавляют свою наценку. Веса Qwen3.8-Flash-Next открыты, поэтому платить за API необязательно — модель можно развернуть на своём железе и платить только за него.

Когда вышла Qwen3.8-Flash-Next?

Qwen3.8-Flash-Next вышла 24 августа 2026, разработчик — Alibaba (Qwen). Все последующие обновления модели мы фиксируем в истории событий на этой странице.

Какой контекст у Qwen3.8-Flash-Next?

Контекстное окно — 262K токенов, максимальный ответ — до 66K токенов. На практике это означает, что за один запрос модель удерживает примерно 187 страниц текста.

Сколько параметров у Qwen3.8-Flash-Next?

180000000000 параметров, из них активных при генерации — 6000000000 (архитектура Mixture-of-Experts: работает не вся модель сразу, поэтому запрос считается быстрее и дешевле).

Можно ли развернуть Qwen3.8-Flash-Next у себя?

Да. Веса Qwen3.8-Flash-Next выложены публично под лицензией Qwen Community License 1.0, их можно скачать и запустить на своём сервере — данные не уходят наружу. Это главный аргумент для компаний, которым нельзя отдавать документы во внешний сервис.

Доступна ли Qwen3.8-Flash-Next в России?

Да. Китайские провайдеры не ограничивают доступ по региону, а открытые веса Qwen3.8-Flash-Next вдобавок можно развернуть на своём сервере. Сложность остаётся только с оплатой — российские карты напрямую обычно не проходят.

Цена Qwen3.8-Flash-Next: доллары и рубли за 1M токенов

Ввод$0.16≈ 14 ₽
Вывод$0.47≈ 42 ₽

Рубли — по курсу 90 ₽/$ на 15 августа 2026. Списочные цены вендора; у агрегаторов для РФ будет наценка.

Характеристики Qwen3.8-Flash-Next

ЛицензияQwen Community License 1.0
ДоступОткрытые веса
АрхитектураMoE
Параметры180000000000
Активные параметры6000000000
Контекст262K токенов
Макс. вывод66K токенов
Знания до—
МодальностиТекст, Код, Зрение, Видео
Релиз24 авг 2026