Кибер-Миша
Релиз17 сен 2026

PrismML выпустила Bonsai 2 27B на базе Qwen3.8 27B

PrismML 2026-09-17 выпустила Ternary Bonsai 2 27B — компактную версию Qwen3.8 27B для работы на локальных устройствах. Модель содержит 27,8 млрд параметров, поддерживает текст, программный код и изображения, а ее языковая часть занимает 5,9 ГБ. По данным вендора, это более чем в 9 раз меньше полного варианта в 16-битном формате. Заявленная скорость на NVIDIA GeForce RTX 5090 достигает 143 токенов в секунду.

Весовые коэффициенты доступны бесплатно по лицензии Apache 2.0; опубликованы сборки GGUF для llama.cpp и MLX для устройств Apple. PrismML сообщает, что модель получила 83,9 балла против 85,4 у исходной Qwen3.8 27B в наборе из 20 тестов, сохранив 98,2% совокупного результата. Это показатели самого разработчика: независимых замеров пока нет. По сравнению с первой Bonsai 27B заявленное сохранение качества выросло с 95% до 98,2% при прежнем объеме 5,9 ГБ.

Для бизнеса релиз интересен возможностью развернуть модель у себя для обработки закрытых документов, помощников разработчиков и задач с изображениями без платы за API: стоимость весов составляет 0 USD, или примерно 0 рублей. Основные расходы придутся на оборудование, электроэнергию и сопровождение, однако PrismML не приводит типовой расчет полной стоимости владения. Риск — зависимость от специальных низкоразрядных сборок и неподтвержденные показатели качества; перед внедрением стоит проверить модель на собственных данных, целевом оборудовании и требуемом объеме контекста.

Далее важно проверить фактическую скорость на распространенных рабочих станциях, стабильность поддержки в llama.cpp и качество модели вне тестов PrismML. Также пока нет подтвержденных данных о максимальной длине контекста и предельном объеме ответа именно для Bonsai 2 27B.

Первоисточник ↗