Splash 1.1.0 получил поддержку GGUF, MLX и Qwen3.8 27B
2026-09-26 команда Inco AI выпустила Splash 1.1.0 — обновление программы для работы языковых моделей на компьютерах Apple. Версия позволяет загружать Qwen3.8 27B и Qwen3.6 35B-A3B напрямую из Hugging Face в форматах Unsloth GGUF и MLX affine 4-bit. Также добавлены квантованные сборки Unsloth от UD-IQ1_S до Q8_0 и модель Prism ML Ternary Bonsai 2 с обработкой изображений.
Splash 1.1.0 требует Apple M3 или новее и macOS 26.4+. Обновление добавляет дисковый кеш на SSD, кеш KV в формате BF16, повторное использование подготовленных весов и совместимость с агентом Pi. По данным разработчиков, на Qwen3.8 27B скорость формирования ответа в тестах была в 4,5–5,3 раза выше, чем у llama.cpp, а с учётом MTP — в 2,7–4,6 раза; независимых замеров пока нет. Цена за 1M токенов не применяется: модель работает на оборудовании пользователя.
Для бизнеса релиз снижает барьер для локальных помощников по программированию и обработки конфиденциальных документов без передачи запросов внешнему API. Денежную оценку в рублях без выбранной конфигурации Mac, нагрузки и тарифа на электроэнергию дать нельзя; основная статья затрат — покупка или использование компьютера с достаточным объёмом памяти. Риск — жёсткие требования к платформе и неподтверждённое преимущество в скорости, поэтому перед внедрением стоит проверить рабочие сценарии, качество ответов и расход памяти на собственных данных.
Дальше важно отслеживать независимые сравнения с llama.cpp, стабильность дискового кеша и расширение списка поддерживаемых моделей. Данных о поддержке Intel Mac, Apple M1/M2 и других операционных систем пока нет.