Кибер-Миша

LongCat-Flash-Lite-Sparse

Доступна
🇨🇳 Meituan (LongCat)·КитайОткрытые веса
Meituan выпустила LongCat-Flash-Lite-Sparse 2026-08-03 вместе с открытыми весами и техническим отчётом. Модель содержит 69B параметров, при обработке каждого токена задействует около 3B и поддерживает контекст до 1M токенов. В отличие от LongCat-Flash-Lite, новая версия заменяет плотный механизм внимания на LongCat Sparse Attention, рассчитанный на более экономную работу с длинными документами. Заявленные результаты тестов предоставлены вендором; независимых замеров пока нет.

Для бизнеса: стоит ли брать LongCat-Flash-Lite-Sparse

Модель подходит компаниям, которым нужно развернуть у себя обработку крупных архивов, кодовых баз и длинных цепочек документов без передачи данных внешнему API. Лицензия MIT допускает коммерческое использование, однако опубликованные веса занимают около 138 GB, а рекомендуемая конфигурация вендора включает один NVIDIA H20 с 141 GB памяти. Риск — высокая стоимость инфраструктуры и отсутствие независимой проверки качества; перед внедрением стоит провести испытания на собственных документах и сравнить совокупные расходы с облачными моделями.

Бенчмарки LongCat-Flash-Lite-Sparse

SWE-Bench Verified68.2данные вендора
SWE-Bench Pro40.63данные вендора
MMLU-Pro79.24данные вендора
GPQA-Diamond69.49данные вендора
LongBench-v252.5данные вендора

История версий и событий LongCat-Flash-Lite-Sparse

3 авг 2026Релиз

Meituan выпустила LongCat-Flash-Lite-Sparse с контекстом 1M токенов

Meituan опубликовала веса LongCat-Flash-Lite-Sparse на условиях MIT. Модель имеет 69B общих и около 3B активных параметров, а заявленный предел контекста составляет 1M токенов. По данным вендора, разреженный механизм LongCat Sparse Attention сокращает затраты при работе с длинным контекстом; независимых замеров пока нет.

Первоисточник ↗

Частые вопросы про LongCat-Flash-Lite-Sparse

Сколько стоит LongCat-Flash-Lite-Sparse?

Сама модель бесплатна: веса опубликованы под лицензией MIT, платить нужно только за железо, на котором вы её запускаете, либо за API того провайдера, через которого подключаетесь.

Когда вышла LongCat-Flash-Lite-Sparse?

LongCat-Flash-Lite-Sparse вышла 3 августа 2026, разработчик — Meituan (LongCat). Все последующие обновления модели мы фиксируем в истории событий на этой странице.

Какой контекст у LongCat-Flash-Lite-Sparse?

Контекстное окно — 1.0M токенов. На практике это означает, что за один запрос модель удерживает примерно 749 страниц текста.

Сколько параметров у LongCat-Flash-Lite-Sparse?

69B параметров, из них активных при генерации — 3B (архитектура Mixture-of-Experts: работает не вся модель сразу, поэтому запрос считается быстрее и дешевле).

Можно ли развернуть LongCat-Flash-Lite-Sparse у себя?

Да. Веса LongCat-Flash-Lite-Sparse выложены публично под лицензией MIT, их можно скачать и запустить на своём сервере — данные не уходят наружу. Это главный аргумент для компаний, которым нельзя отдавать документы во внешний сервис.

Доступна ли LongCat-Flash-Lite-Sparse в России?

Да. Китайские провайдеры не ограничивают доступ по региону, а открытые веса LongCat-Flash-Lite-Sparse вдобавок можно развернуть на своём сервере. Сложность остаётся только с оплатой — российские карты напрямую обычно не проходят.

Цена LongCat-Flash-Lite-Sparse: доллары и рубли за 1M токенов

Публичной цены API нет.

Характеристики LongCat-Flash-Lite-Sparse

ЛицензияMIT
ДоступОткрытые веса
АрхитектураMoE
Параметры69B
Активные параметры3B
Контекст1.0M токенов
Макс. вывод
Знания до
МодальностиТекст, Код
Релиз3 авг 2026