Кибер-Миша
Релиз22 сен 2026

BottleCap AI выпустила ThinkingCap-Qwen3.8-27B с сокращённым расходом токенов

BottleCap AI 2026-09-22 выпустила ThinkingCap-Qwen3.8-27B — доработанную версию Qwen3.8-27B для задач с пошаговым анализом. По данным вендора, модель расходует в среднем на 37,2% меньше токенов внутреннего анализа, а средняя точность по 12 тестам снижается с 86,6% до 85,8%. На LiveCodeBench v6 результат составил 91,21% против 91,14% у базовой модели. Независимых замеров пока нет.

Модель доступна на Hugging Face в исходном формате BF16 объёмом около 56 GB, а также в сборках FP8, GGUF и NVFP4 размером от 16 до 31 GB. Она принимает текст и изображения, поддерживает вызов инструментов и может быть развёрнута у себя через vLLM, SGLang, llama.cpp, Ollama или LM Studio. Лицензия PolyForm Small Business 1.0.0 разрешает ограниченное коммерческое использование; крупным компаниям потребуется отдельное соглашение с BottleCap AI. Публичного API и цены за 1M токенов нет.

Релиз ориентирован на компании, которые уже используют Qwen3.8-27B и хотят сократить задержку и вычислительные расходы без перехода на другую модель. Скачивание весов стоит $0, то есть примерно 0 рублей, но серверы и сопровождение оплачиваются отдельно; подтверждённых расчётов полной стоимости пока нет. Основной риск — заявленная экономия проверена самим разработчиком, поэтому перед внедрением нужно сравнить качество и расход токенов на собственных документах, коде и рабочих сценариях.

Первоисточник ↗

Что за модель: Qwen3.8 27B

Компактная модель новой линейки Qwen3.8 и преемница Qwen3.6-27B: 27B параметров, контекст 256K токенов. Веса опубликованы на Hugging Face под свободной лицензией Apache-2.0 (есть и сжатая FP8-версия), в хостинговых каталогах модель появилась 14 августа 2026 по цене $0.45/$3.20 за миллион токенов. Официального техотчёта и таблицы замеров на момент выхода нет — независимые проверки только начинаются. Судя по загрузкам на Hugging Face (100K+ за первые дни), сообщество приняло релиз активно.

Разработчикalibaba-qwen
Дата выхода14 августа 2026
Контекст262K
ДоступOpen source
ЛицензияApache-2.0
Цена входа$0.02 · ≈ 1.8 ₽
Цена вывода$2.99 · ≈ 269 ₽
Полная карточка Qwen3.8 27B: цена, характеристики, история версий

Что это значит для бизнеса

Главный кандидат для компаний, которые хотят развернуть модель у себя и не зависеть от чужих серверов: свободная лицензия Apache-2.0 разрешает любое коммерческое использование без юридических рисков, а размер позволяет работать на одной серверной видеокарте. Подойдёт для внутренних ботов, обработки документов и типовых задач, где данные нельзя отдавать наружу. Если развёртывание у себя не принципиально — через API DeepSeek V4-Flash даёт больше возможностей дешевле ($0.14/$0.28 против $0.45/$3.20). Замеров качества пока нет, поэтому перед боевым запуском прогоните на своих задачах. Для старта на собственном железе сейчас это самый безопасный выбор в базе.

Хроника Qwen3.8 27B

30 сен 2026Апдейт

Цена API изменилась: $0.02/4.4 → $0.02/4.35 за 1M токенов

Изменение зафиксировано по каталогу агрегатора OpenRouter.

30 сен 2026Апдейт

Цена API изменилась: $0.02/4.35 → $0.02/2.99 за 1M токенов

Изменение зафиксировано по каталогу агрегатора OpenRouter.

29 сен 2026Апдейт

Цена API изменилась: $0.42/3.0 → $0.06/4.4 за 1M токенов

Изменение зафиксировано по каталогу агрегатора OpenRouter.

29 сен 2026Апдейт

Цена API изменилась: $0.06/4.4 → $0.05/4.4 за 1M токенов

Изменение зафиксировано по каталогу агрегатора OpenRouter.

29 сен 2026Апдейт

Цена API изменилась: $0.05/4.4 → $0.05/4.4 за 1M токенов

Изменение зафиксировано по каталогу агрегатора OpenRouter.

29 сен 2026Апдейт

Цена API изменилась: $0.21/2.55 → $0.05/4.4 за 1M токенов

Изменение зафиксировано по каталогу агрегатора OpenRouter.