Qwen3.8-27B получил полностью 4-битную версию QUASAR NVFP4
2026-08-26 команда QUASAR-QAT опубликовала Qwen3.8-27B-QUASAR-NVFP4 — 4-битную версию существующей Qwen3.8-27B для NVIDIA Blackwell. Во всех 496 линейных слоях используется формат NVFP4 W4A4, включая блоки внимания и Gated DeltaNet, которые обычно сохраняют в более высокой точности. Размер контрольной точки составляет 19,7 ГБ против 55,6 ГБ у исходной версии BF16.
Модель доступна для скачивания на Hugging Face и запуска через vLLM 0.27 или новее без дополнительного преобразования. Требуется NVIDIA GPU с поддержкой FP4 и вычислительной совместимостью 10.0 или выше; публичного облачного API и цены в USD за 1M токенов нет. По данным авторов, результат на GPQA-Diamond составляет 0,9091 против 0,9141 у исходной модели, а на AIME26 обе версии получили 1,0000. Это замеры авторов на ограниченных выборках и нескольких повторах, независимых замеров пока нет.
Для бизнеса выпуск может снизить требования к памяти при развертывании Qwen3.8-27B у себя и упростить запуск на одном современном ускорителе. Денежную экономию в рублях пока нельзя оценить: авторы не указали стоимость оборудования, энергопотребление или производительность под рабочей нагрузкой. Основной риск — привязка к NVIDIA Blackwell и отсутствие независимой проверки качества; перед внедрением стоит провести испытания на собственных документах, коде и длинных диалогах.
Мы будем отслеживать появление независимых сравнений скорости, потребления памяти и качества, а также поддержку других поколений GPU. Лицензия отдельной версии на странице релиза явно не указана, поэтому условия коммерческого использования следует проверить по файлам модели и лицензии исходной Qwen3.8-27B.
Что за модель: Qwen3.8 27B
Компактная модель новой линейки Qwen3.8 и преемница Qwen3.6-27B: 27B параметров, контекст 256K токенов. Веса опубликованы на Hugging Face под свободной лицензией Apache-2.0 (есть и сжатая FP8-версия), в хостинговых каталогах модель появилась 14 августа 2026 по цене $0.45/$3.20 за миллион токенов. Официального техотчёта и таблицы замеров на момент выхода нет — независимые проверки только начинаются. Судя по загрузкам на Hugging Face (100K+ за первые дни), сообщество приняло релиз активно.
Что это значит для бизнеса
Главный кандидат для компаний, которые хотят развернуть модель у себя и не зависеть от чужих серверов: свободная лицензия Apache-2.0 разрешает любое коммерческое использование без юридических рисков, а размер позволяет работать на одной серверной видеокарте. Подойдёт для внутренних ботов, обработки документов и типовых задач, где данные нельзя отдавать наружу. Если развёртывание у себя не принципиально — через API DeepSeek V4-Flash даёт больше возможностей дешевле ($0.14/$0.28 против $0.45/$3.20). Замеров качества пока нет, поэтому перед боевым запуском прогоните на своих задачах. Для старта на собственном железе сейчас это самый безопасный выбор в базе.
Хроника Qwen3.8 27B
Вышла Qwen3.8 27B — компактная открытая модель линейки 3.8
Веса под Apache-2.0 на Hugging Face, в API-каталогах — $0.45/$3.20 за миллион токенов, контекст 256K.