Кибер-Миша
Релиз18 авг 2026

DFlash 2 выпущен для Qwen3.8-27B и Muse Glimmer 30B

Inco AI опубликовала DFlash 2 и вспомогательные модели для ускорения работы Qwen3.8-27B и Muse Glimmer 30B. По данным разработчиков, DFlash 2 повышает скорость формирования ответа за счёт параллельной подготовки и проверки нескольких вариантов продолжения; независимых замеров пока нет. Поддержка llama.cpp предложена отдельным изменением и на дату выпуска ещё не включена в основную версию, поэтому перед внедрением следует проверить совместимость и расход памяти на целевой инфраструктуре.

Первоисточник ↗

Что за модель: Qwen3.8 27B

Компактная модель новой линейки Qwen3.8 и преемница Qwen3.6-27B: 27B параметров, контекст 256K токенов. Веса опубликованы на Hugging Face под свободной лицензией Apache-2.0 (есть и сжатая FP8-версия), в хостинговых каталогах модель появилась 14 августа 2026 по цене $0.45/$3.20 за миллион токенов. Официального техотчёта и таблицы замеров на момент выхода нет — независимые проверки только начинаются. Судя по загрузкам на Hugging Face (100K+ за первые дни), сообщество приняло релиз активно.

Разработчикalibaba-qwen
Дата выхода14 августа 2026
Контекст262K
ДоступOpen source
ЛицензияApache-2.0
Цена входа$0.45 · ≈ 41 ₽
Цена вывода$3.2 · ≈ 288 ₽
Полная карточка Qwen3.8 27B: цена, характеристики, история версий

Что это значит для бизнеса

Главный кандидат для компаний, которые хотят развернуть модель у себя и не зависеть от чужих серверов: свободная лицензия Apache-2.0 разрешает любое коммерческое использование без юридических рисков, а размер позволяет работать на одной серверной видеокарте. Подойдёт для внутренних ботов, обработки документов и типовых задач, где данные нельзя отдавать наружу. Если развёртывание у себя не принципиально — через API DeepSeek V4-Flash даёт больше возможностей дешевле ($0.14/$0.28 против $0.45/$3.20). Замеров качества пока нет, поэтому перед боевым запуском прогоните на своих задачах. Для старта на собственном железе сейчас это самый безопасный выбор в базе.

Хроника Qwen3.8 27B

14 авг 2026Релиз

Вышла Qwen3.8 27B — компактная открытая модель линейки 3.8

Веса под Apache-2.0 на Hugging Face, в API-каталогах — $0.45/$3.20 за миллион токенов, контекст 256K.