Кибер-Миша

Qwen3.8-Flash-Next

ДоступнаФронтир
🇨🇳 Alibaba (Qwen)·КитайОткрытые веса
Alibaba Qwen выпустила Qwen3.8-Flash-Next 2026-08-24 как экспериментальную открытую модель с поддержкой текста, программного кода, изображений и видео. Модель содержит 125 млрд параметров и задействует 6 млрд при обработке запроса; отдельно заявлены 51 млрд параметров n-gram embeddings и 4 млрд параметров MTP. Базовый контекст составляет 262 144 токена, с возможностью расширения до 1 млн токенов. Архитектура объединяет Gated DeltaNet, Qwen Sparse Attention и 512 экспертов, из которых на каждом шаге работают 10 маршрутизируемых и один общий. Все опубликованные результаты тестов предоставлены вендором, независимых замеров пока нет.

Для бизнеса: стоит ли брать Qwen3.8-Flash-Next

Модель подходит компаниям, которым нужны обработка документов, программного кода и визуальных материалов с возможностью развернуть систему у себя. Основное преимущество — только 6 млрд активных параметров при общей емкости 125 млрд, что потенциально снижает вычислительные расходы по сравнению с полностью активными моделями сопоставимого размера. Риск — экспериментальный статус архитектуры и отсутствие независимых измерений скорости, качества и требований к оборудованию; перед внедрением следует провести проверку на собственных данных и рассчитать стоимость инфраструктуры. Цена официального API в USD за 1M токенов для этой версии не опубликована.

Бенчмарки Qwen3.8-Flash-Next

SWE-bench Pro62.5данные вендора
SWE-bench Multilingual81данные вендора
GPQA Diamond91.7данные вендора
LiveCodeBench v691.9данные вендора
AndroidWorld84.5данные вендора
RealWorldQA88.5данные вендора

История версий и событий Qwen3.8-Flash-Next

24 авг 2026Релиз

Alibaba Qwen выпустила открытую модель Qwen3.8-Flash-Next

Alibaba Qwen опубликовала веса Qwen3.8-Flash-Next — экспериментальной модели с 125 млрд параметров, из которых 6 млрд задействуются при обработке запроса. Модель работает с текстом, программным кодом, изображениями и видео, а базовый контекст составляет 262 144 токена. По данным вендора, архитектура станет основой будущего семейства Qwen4; независимых замеров производительности пока нет.

Первоисточник ↗

Частые вопросы про Qwen3.8-Flash-Next

Сколько стоит Qwen3.8-Flash-Next?

Сама модель бесплатна: веса опубликованы под лицензией qwen-community-1.0, платить нужно только за железо, на котором вы её запускаете, либо за API того провайдера, через которого подключаетесь.

Когда вышла Qwen3.8-Flash-Next?

Qwen3.8-Flash-Next вышла 24 августа 2026, разработчик — Alibaba (Qwen). Все последующие обновления модели мы фиксируем в истории событий на этой странице.

Какой контекст у Qwen3.8-Flash-Next?

Контекстное окно — 262K токенов. На практике это означает, что за один запрос модель удерживает примерно 187 страниц текста.

Сколько параметров у Qwen3.8-Flash-Next?

125B параметров, из них активных при генерации — 6B (архитектура Mixture-of-Experts: работает не вся модель сразу, поэтому запрос считается быстрее и дешевле).

Можно ли развернуть Qwen3.8-Flash-Next у себя?

Да. Веса Qwen3.8-Flash-Next выложены публично под лицензией qwen-community-1.0, их можно скачать и запустить на своём сервере — данные не уходят наружу. Это главный аргумент для компаний, которым нельзя отдавать документы во внешний сервис.

Доступна ли Qwen3.8-Flash-Next в России?

Да. Китайские провайдеры не ограничивают доступ по региону, а открытые веса Qwen3.8-Flash-Next вдобавок можно развернуть на своём сервере. Сложность остаётся только с оплатой — российские карты напрямую обычно не проходят.

Цена Qwen3.8-Flash-Next: доллары и рубли за 1M токенов

Публичной цены API нет.

Характеристики Qwen3.8-Flash-Next

Лицензияqwen-community-1.0
ДоступОткрытые веса
АрхитектураMoE
Параметры125B
Активные параметры6B
Контекст262K токенов
Макс. вывод
Знания до
МодальностиТекст, Код, Зрение, Видео
Релиз24 авг 2026