UkisAI выпустила Swift-Qwen3.8-27B с сокращёнными рассуждениями
2026-09-09 UkisAI представила Swift-Qwen3.8-27B — доработанную версию Qwen3.8-27B с 28 млрд параметров. Компания обучила модель реже использовать элементы ответа, связанные с избыточными рассуждениями. По данным вендора, на девяти тестах среднее сокращение служебных токенов достигало 19–51%, а максимальное медианное — 58,3%; ускорение на отдельных задачах составило до 1,95 раза. Независимых замеров пока нет.
Весовые коэффициенты BF16 опубликованы на Hugging Face; также доступны варианты GGUF и NVFP4. Модель сохраняет работу с текстом, кодом, изображениями и видео, поддерживает контекст до 262 144 токенов и может быть развёрнута через vLLM или SGLang. Swift Open License 1.0 разрешает бесплатное коммерческое применение организациям с годовой регулярной выручкой до 1 млн USD, а более крупным компаниям потребуется отдельная лицензия. Исследовательский API бесплатен, публичной цены промышленного доступа в USD за 1M токенов нет.
Для бизнеса релиз интересен как способ снизить задержку и вычислительные расходы в задачах программирования, аналитики и автоматизации, где длинные рассуждения не всегда улучшают результат. Доступ к исследовательскому API стоит около 0 ₽, но стоимость собственного развёртывания зависит от оборудования и нагрузки; подтверждённых расчётов вендор не приводит. Риск — ухудшение точности на отдельных задачах: в тестах UkisAI результат AIME 2026 снизился с 98,67% до 94,00%. Перед внедрением следует проверить модель на собственных сценариях и заранее согласовать лицензию при выручке выше установленного порога.