DFlash 2 выпущен для Qwen3.8-27B и Muse Glimmer 30B
Inco AI опубликовала DFlash 2 и вспомогательные модели для ускорения работы Qwen3.8-27B и Muse Glimmer 30B. По данным разработчиков, DFlash 2 повышает скорость формирования ответа за счёт параллельной подготовки и проверки нескольких вариантов продолжения; независимых замеров пока нет. Поддержка llama.cpp предложена отдельным изменением и на дату выпуска ещё не включена в основную версию, поэтому перед внедрением следует проверить совместимость и расход памяти на целевой инфраструктуре.
Что за модель: Qwen3.8 27B
Компактная модель новой линейки Qwen3.8 и преемница Qwen3.6-27B: 27B параметров, контекст 256K токенов. Веса опубликованы на Hugging Face под свободной лицензией Apache-2.0 (есть и сжатая FP8-версия), в хостинговых каталогах модель появилась 14 августа 2026 по цене $0.45/$3.20 за миллион токенов. Официального техотчёта и таблицы замеров на момент выхода нет — независимые проверки только начинаются. Судя по загрузкам на Hugging Face (100K+ за первые дни), сообщество приняло релиз активно.
Что это значит для бизнеса
Главный кандидат для компаний, которые хотят развернуть модель у себя и не зависеть от чужих серверов: свободная лицензия Apache-2.0 разрешает любое коммерческое использование без юридических рисков, а размер позволяет работать на одной серверной видеокарте. Подойдёт для внутренних ботов, обработки документов и типовых задач, где данные нельзя отдавать наружу. Если развёртывание у себя не принципиально — через API DeepSeek V4-Flash даёт больше возможностей дешевле ($0.14/$0.28 против $0.45/$3.20). Замеров качества пока нет, поэтому перед боевым запуском прогоните на своих задачах. Для старта на собственном железе сейчас это самый безопасный выбор в базе.
Хроника Qwen3.8 27B
Вышла Qwen3.8 27B — компактная открытая модель линейки 3.8
Веса под Apache-2.0 на Hugging Face, в API-каталогах — $0.45/$3.20 за миллион токенов, контекст 256K.