PrismML выпустила Ternary Bonsai 2 27B на базе Qwen3.8 27B
2026-09-17 компания PrismML выпустила Ternary Bonsai 2 27B — сжатую версию Qwen3.8 27B для локальной работы. Модель содержит 27,36 млрд параметров, поддерживает текст, изображения и контекст до 262 тыс. токенов. Языковая часть занимает 5,95 ГБ в формате PTQ1_0 или 7,21 ГБ в формате PQ2_0; модуль обработки изображений размером 0,63 ГБ подключается отдельно.
Весовые коэффициенты представлены значениями −1, 0 и +1 с групповым масштабированием FP16. Модель опубликована под лицензией Apache 2.0 и доступна в GGUF для CUDA, Metal и CPU, а также в отдельной сборке MLX для Apple Silicon. Для запуска требуются специализированные низкоразрядные компоненты PrismML; стандартные программные сборки могут не поддержать файлы без доработок.
Релиз рассчитан на компании, которым нужно обрабатывать документы, изображения или программный код внутри собственного контура и не передавать данные облачному поставщику. Плата за загрузку и лицензию составляет 0 USD, то есть примерно 0 рублей; итоговые расходы определяются оборудованием, электроэнергией и сопровождением. PrismML заявляет сохранение 98,2% совокупного результата исходной модели и скорость до 143 токенов в секунду на NVIDIA GeForce RTX 5090, но независимых замеров пока нет: перед внедрением стоит проверить качество и скорость на собственных задачах.
Далее важно отслеживать поддержку форматов PTQ1_0 и PQ2_0 в распространённых средствах запуска, а также независимые сравнения с обычными версиями Qwen3.8 27B. Отдельной цены API и подтверждённых данных о работе на типовом корпоративном оборудовании пока нет.
Что за модель: Qwen3.8 27B
Компактная модель новой линейки Qwen3.8 и преемница Qwen3.6-27B: 27B параметров, контекст 256K токенов. Веса опубликованы на Hugging Face под свободной лицензией Apache-2.0 (есть и сжатая FP8-версия), в хостинговых каталогах модель появилась 14 августа 2026 по цене $0.45/$3.20 за миллион токенов. Официального техотчёта и таблицы замеров на момент выхода нет — независимые проверки только начинаются. Судя по загрузкам на Hugging Face (100K+ за первые дни), сообщество приняло релиз активно.
Что это значит для бизнеса
Главный кандидат для компаний, которые хотят развернуть модель у себя и не зависеть от чужих серверов: свободная лицензия Apache-2.0 разрешает любое коммерческое использование без юридических рисков, а размер позволяет работать на одной серверной видеокарте. Подойдёт для внутренних ботов, обработки документов и типовых задач, где данные нельзя отдавать наружу. Если развёртывание у себя не принципиально — через API DeepSeek V4-Flash даёт больше возможностей дешевле ($0.14/$0.28 против $0.45/$3.20). Замеров качества пока нет, поэтому перед боевым запуском прогоните на своих задачах. Для старта на собственном железе сейчас это самый безопасный выбор в базе.
Хроника Qwen3.8 27B
Цена API изменилась: $0.02/4.4 → $0.02/4.35 за 1M токенов
Изменение зафиксировано по каталогу агрегатора OpenRouter.
Цена API изменилась: $0.02/4.35 → $0.02/2.99 за 1M токенов
Изменение зафиксировано по каталогу агрегатора OpenRouter.
Цена API изменилась: $0.42/3.0 → $0.06/4.4 за 1M токенов
Изменение зафиксировано по каталогу агрегатора OpenRouter.
Цена API изменилась: $0.06/4.4 → $0.05/4.4 за 1M токенов
Изменение зафиксировано по каталогу агрегатора OpenRouter.
Цена API изменилась: $0.05/4.4 → $0.05/4.4 за 1M токенов
Изменение зафиксировано по каталогу агрегатора OpenRouter.
Цена API изменилась: $0.21/2.55 → $0.05/4.4 за 1M токенов
Изменение зафиксировано по каталогу агрегатора OpenRouter.