Spark-X2.5-4B и Spark-X2.5-1.7B вышли с контекстом до 1 млн токенов
2026-09-01 команда SparkLLM выпустила Spark-X2.5-4B и Spark-X2.5-1.7B — две компактные языковые модели с открытыми весами. Заявленный размер контекста достигает 1 млн токенов, поддерживаются более 200 языков. Модели предназначены для диалогов, работы с документами, программным кодом и инструментами; независимых замеров качества и фактической работы на предельном контексте пока нет.
Обе модели доступны через Hugging Face, ModelScope, Ollama и другие каталоги, а 2026-09-04 разработчик добавил версии FP8 и INT8. Используется гибридная схема внимания: один слой полного внимания чередуется с тремя слоями скользящего окна. Веса распространяются по Apache 2.0, поэтому модели можно развернуть у себя и применять в коммерческих продуктах без платы за токены. По данным вендора, Spark-X2.5-4B набрала 65,1 балла в BFCL-V4 и 75,1 в τ²-bench; независимого подтверждения этих результатов пока нет.
Для бизнеса основной сценарий — локальная обработка больших инструкций, регламентов и истории операций без передачи данных внешнему API. Лицензия на веса стоит 0 рублей, однако итоговые расходы определяются оборудованием, настройкой и поддержкой; подтверждённых требований к памяти при контексте 1 млн токенов разработчик не приводит. Риск — ориентироваться на максимальный контекст как на гарантированно рабочий режим: перед внедрением стоит проверить скорость, потребление памяти и точность поиска сведений на собственных документах.
Дальше важно отслеживать независимые испытания длинного контекста, поддержку моделей в основных средствах локального запуска и стабильность квантованных сборок. Пока опубликованные сравнения следует считать данными вендора, а не подтверждённой оценкой производительности.