Кибер-Миша
Релиз15 сен 2026

ByteShape выпустила компактные ShapeLearn-сборки Qwen3.8-27B

2026-09-15 ByteShape опубликовала пять сжатых сборок Qwen3.8-27B в формате GGUF, подготовленных методом ShapeLearn. Они занимают от 8,84 до 13,1 ГБ и используют от 2,56 до 3,84 бита на параметр. Релиз заменяет прежние сборки ShapeLearn-Lite в том же официальном каталоге ByteShape на Hugging Face.

Файлы доступны для скачивания по лицензии Apache-2.0 и рассчитаны прежде всего на работу через llama.cpp на собственном оборудовании. Сборка 3,84 бита, по данным ByteShape, сохраняет 99,63% совокупного результата исходной BF16-версии по восьми тестам, а вариант 3,23 бита — 98,72%. Проверка охватывает математику, программирование, общие знания, следование инструкциям и работу с инструментами; независимых замеров пока нет.

Релиз полезен компаниям, которым нужно развернуть Qwen3.8-27B внутри своей инфраструктуры и сократить требования к видеопамяти без перехода на меньшую модель. Сами файлы предоставляются бесплатно, поэтому цена лицензии составляет 0 USD, однако стоимость оборудования и эксплуатации ByteShape не раскрывает — достоверно пересчитать проект в рубли пока нельзя. Основной риск состоит в том, что показатели качества получены разработчиком метода сжатия; перед внедрением стоит проверить сборку на собственных документах, коде и типовых запросах.

Далее важно сопоставить результаты ByteShape с независимыми тестами на распространённых видеокартах и оценить качество при длинном контексте. Также следует отслеживать совместимость новых файлов с рабочими версиями llama.cpp и возможные исправления сборок.

Первоисточник ↗

Что за модель: Qwen3.8 27B

Компактная модель новой линейки Qwen3.8 и преемница Qwen3.6-27B: 27B параметров, контекст 256K токенов. Веса опубликованы на Hugging Face под свободной лицензией Apache-2.0 (есть и сжатая FP8-версия), в хостинговых каталогах модель появилась 14 августа 2026 по цене $0.45/$3.20 за миллион токенов. Официального техотчёта и таблицы замеров на момент выхода нет — независимые проверки только начинаются. Судя по загрузкам на Hugging Face (100K+ за первые дни), сообщество приняло релиз активно.

Разработчикalibaba-qwen
Дата выхода14 августа 2026
Контекст262K
ДоступOpen source
ЛицензияApache-2.0
Цена входа$0.21 · ≈ 19 ₽
Цена вывода$2.55 · ≈ 229 ₽
Полная карточка Qwen3.8 27B: цена, характеристики, история версий

Что это значит для бизнеса

Главный кандидат для компаний, которые хотят развернуть модель у себя и не зависеть от чужих серверов: свободная лицензия Apache-2.0 разрешает любое коммерческое использование без юридических рисков, а размер позволяет работать на одной серверной видеокарте. Подойдёт для внутренних ботов, обработки документов и типовых задач, где данные нельзя отдавать наружу. Если развёртывание у себя не принципиально — через API DeepSeek V4-Flash даёт больше возможностей дешевле ($0.14/$0.28 против $0.45/$3.20). Замеров качества пока нет, поэтому перед боевым запуском прогоните на своих задачах. Для старта на собственном железе сейчас это самый безопасный выбор в базе.

Хроника Qwen3.8 27B

12 сен 2026Апдейт

Цена API изменилась: $0.42/3.0 → $0.21/2.55 за 1M токенов

Изменение зафиксировано по каталогу агрегатора OpenRouter.

12 сен 2026Апдейт

Цена API изменилась: $0.42/3.0 → $0.21/2.55 за 1M токенов

Изменение зафиксировано по каталогу агрегатора OpenRouter.

4 сен 2026Апдейт

Цена API изменилась: $0.42/2.55 → $0.42/3.0 за 1M токенов

Изменение зафиксировано по каталогу агрегатора OpenRouter.

3 сен 2026Апдейт

Цена API изменилась: $0.42/2.55 → $0.42/3.0 за 1M токенов

Изменение зафиксировано по каталогу агрегатора OpenRouter.

26 авг 2026Апдейт

Цена API изменилась: $0.45/3.2 → $0.42/2.55 за 1M токенов

Изменение зафиксировано по каталогу агрегатора OpenRouter.

14 авг 2026Релиз

Вышла Qwen3.8 27B — компактная открытая модель линейки 3.8

Веса под Apache-2.0 на Hugging Face, в API-каталогах — $0.45/$3.20 за миллион токенов, контекст 256K.