Ling-3.0-flash
ДоступнаМодель Ant Group (inclusionAI) со ставкой на эффективность: 124B параметров, активных всего ~5.1B — активация 1/64 (512 экспертов плюс 1 общий, 8 на токен). Внимание гибридно-линейное: 35 слоёв KDA на 7 слоёв Gated MLA. Контекст 256K (обучение по расписанию 8K → 32K → 256K); заявлена скорость до 1,000 токенов/с. По данным вендора, обгоняет собственный флагман Ling-2.6-1T в 11 тестах; в карточке: SWE-bench Pro 56.6, AIME 2026 93.2. Анонс 23 июля 2026; на старте только API, веса выложены на Hugging Face под MIT через несколько дней.
Для бизнеса
MIT и 5.1B активных — один из самых дешёвых кандидатов на self-host агентных пайплайнов; до 3 августа был бесплатный доступ на OpenRouter, постоянных цен API пока нет.
Бенчмарки
SWE-bench Pro56.6данные вендора
AIME 202693.2данные вендора
SWE-bench Multilingual72.4данные вендора
История событий
23 июл 2026Релиз
Релиз Ling-3.0-flash
Анонс и запуск API; открытые веса появились на Hugging Face под MIT через несколько дней после анонса.
Первоисточник ↗Цена API · за 1M токенов
Публичной цены API нет.
Спецификации
ЛицензияMIT
ДоступOpen source
АрхитектураMoE
Параметры124B
Активные параметры5.1B
Контекст262K токенов
Макс. вывод—
Знания до—
МодальностиТекст, Код
Релиз23 июл 2026