Qwen3.8 27B получила поддержку AMD NPU через FastFlowLM
На 2026-10-01 Qwen3.8 27B появилась в официальном каталоге FastFlowLM — среды для локальной работы моделей на NPU в процессорах AMD Ryzen AI. Каталог указывает поддержку версии 27B и ускоренного формирования ответа MTP. Это не новая модель: карточка Qwen3.8 27B уже есть в базе, а событие расширяет варианты ее развертывания.
FastFlowLM позволяет запускать модели локально через командную строку или совместимый с OpenAI API сервер. Проект входит в организацию AMD ROCm; управляющий код распространяется по лицензии MIT, а готовые NPU-модули разрешены для коммерческого использования. Плата за 1M токенов отсутствует, поскольку обработка выполняется на оборудовании компании. Официальный каталог пока не раскрывает объем памяти, точную конфигурацию устройства и скорость Qwen3.8 27B; заявленные сообществом около 1 токена в секунду первоисточником не подтверждены, независимых замеров пока нет.
Поддержка полезна компаниям, которым требуется обработка документов или внутренней переписки без передачи данных облачному поставщику. Денежная стоимость работы зависит от уже приобретенного компьютера и энергопотребления; надежно пересчитать ее в рубли по опубликованным данным нельзя. Основной риск — низкая скорость большой модели на мобильном NPU: перед внедрением следует проверить время ответа, потребление памяти и устойчивость на целевом устройстве. Для интерактивных сервисов стоит заранее сравнить Qwen3.8 27B с меньшими моделями и работой на GPU.
Что за модель: Qwen3.8 27B
Компактная модель новой линейки Qwen3.8 и преемница Qwen3.6-27B: 27B параметров, контекст 256K токенов. Веса опубликованы на Hugging Face под свободной лицензией Apache-2.0 (есть и сжатая FP8-версия), в хостинговых каталогах модель появилась 14 августа 2026 по цене $0.45/$3.20 за миллион токенов. Официального техотчёта и таблицы замеров на момент выхода нет — независимые проверки только начинаются. Судя по загрузкам на Hugging Face (100K+ за первые дни), сообщество приняло релиз активно.
Что это значит для бизнеса
Главный кандидат для компаний, которые хотят развернуть модель у себя и не зависеть от чужих серверов: свободная лицензия Apache-2.0 разрешает любое коммерческое использование без юридических рисков, а размер позволяет работать на одной серверной видеокарте. Подойдёт для внутренних ботов, обработки документов и типовых задач, где данные нельзя отдавать наружу. Если развёртывание у себя не принципиально — через API DeepSeek V4-Flash даёт больше возможностей дешевле ($0.14/$0.28 против $0.45/$3.20). Замеров качества пока нет, поэтому перед боевым запуском прогоните на своих задачах. Для старта на собственном железе сейчас это самый безопасный выбор в базе.
Хроника Qwen3.8 27B
Цена API изменилась: $0.02/4.4 → $0.02/4.35 за 1M токенов
Изменение зафиксировано по каталогу агрегатора OpenRouter.
Цена API изменилась: $0.02/4.35 → $0.02/2.99 за 1M токенов
Изменение зафиксировано по каталогу агрегатора OpenRouter.
Цена API изменилась: $0.42/3.0 → $0.06/4.4 за 1M токенов
Изменение зафиксировано по каталогу агрегатора OpenRouter.
Цена API изменилась: $0.06/4.4 → $0.05/4.4 за 1M токенов
Изменение зафиксировано по каталогу агрегатора OpenRouter.
Цена API изменилась: $0.05/4.4 → $0.05/4.4 за 1M токенов
Изменение зафиксировано по каталогу агрегатора OpenRouter.
Цена API изменилась: $0.21/2.55 → $0.05/4.4 за 1M токенов
Изменение зафиксировано по каталогу агрегатора OpenRouter.