Кибер-Миша
Лаборатория

🇨🇳 Ant Group (inclusionAI)

Китай · моделей в базе: 8 · официальный сайт ↗

Qwen3.5 122B-A10B SingProbeДоступна
🇨🇳 Ant Group (inclusionAI)Открытые веса

inclusionAI опубликовала 2026-09-14 вариант Qwen3.5 122B-A10B со встроенным модулем SingProbe для контроля безопасности и выявления возможных галлюцинаций во время формирования ответа. Основа модели насчитывает 122 млрд параметров, из которых при работе активируются 10 млрд; базовое контекстное окно составляет 262 144 токена. SingProbe использует внутренние состояния модели и оценивает риск по мере появления каждого токена. По данным авторов исследования, дополнительная нагрузка составляет менее 0,5%, однако независимых замеров пока нет.

Ling 3.0 Flash VL FP8Доступна
🇨🇳 Ant Group (inclusionAI)Открытые веса

InclusionAI опубликовала 2026-09-08 модель Ling 3.0 Flash VL FP8 с поддержкой текста и изображений. Это отдельная мультимодальная версия семейства Ling 3.0 Flash, представленная с весами в формате FP8 для развертывания у себя. Репозиторий распространяется по лицензии MIT; данные о числе параметров, размере контекста и предельном объеме ответа пока не опубликованы. Независимых замеров качества и требований к оборудованию пока нет.

LLaDA2.2-miniДоступна
🇨🇳 Ant Group (inclusionAI)Открытые веса

inclusionAI опубликовала LLaDA2.2-mini — диффузионную языковую модель с архитектурой MoE, 16 млрд параметров и 1,4 млрд активных параметров. Контекст составляет 131 072 токена, а веса доступны на Hugging Face по лицензии Apache-2.0. Модель поддерживает удаление и вставку токенов при формировании ответа, что рассчитано на вызов инструментов, продолжительные диалоги и исправление ошибок. По данным вендора, результат BFCL v4 вырос с 28,44 у LLaDA2.1-mini до 47,68, однако независимых замеров пока нет.

Ling 3.0 Flash SanteДоступна
🇨🇳 Ant Group (inclusionAI)Проприетарная

Ling 3.0 Flash Sante — специализированная модель InclusionAI для задач здравоохранения и медицины, появившаяся в каталоге OpenRouter 2026-09-04. Она основана на Ling 3.0 Flash и использует архитектуру MoE: 5,1 млрд активных параметров при 124 млрд параметров всего, по данным вендора. Контекст составляет 262 144 токена. В каталоге доступна бесплатная версия; независимых замеров качества и медицинской надежности пока нет.

Ling-3.0-flash-VLДоступна
🇨🇳 Ant Group (inclusionAI)Открытые веса

Ant Group опубликовала Ling-3.0-flash-VL на Hugging Face 2026-09-04 как мультимодальную версию Ling-3.0-flash. Модель принимает текст и изображения, рассчитана на анализ документов, визуальные задачи и работу программных агентов с интерфейсами. По данным вендора, архитектура MoE содержит 124 млрд параметров, из которых при обработке запроса задействуется 5,1 млрд; независимых замеров качества пока нет. Веса доступны по лицензии MIT, однако подтвержденных данных о размере контекста, максимальном ответе и стоимости API пока нет.

Ling-3.0-Flash-FinДоступна
🇨🇳 Ant Group (inclusionAI)Открытые веса

Ling-3.0-Flash-Fin — специализированная финансовая версия Ling-3.0-Flash, доступная через OpenRouter с 2026-08-27. По данным каталога OpenRouter, модель содержит 124 млрд параметров и использует 5,1 млрд при обработке каждого токена. Контекст составляет 262 144 токена, максимальный ответ — 32 768 токенов. Модель рассчитана на многоэтапные задачи инвестиционного анализа, поиск информации и работу с инструментами; независимых замеров качества пока нет.

UI-Venus-2-9BДоступна
🇨🇳 Ant Group (inclusionAI)Открытые веса

Ant InclusionAI опубликовала UI-Venus-2-9B на Hugging Face 2026-08-26. Это мультимодальная модель примерно на 9 млрд параметров для управления графическими интерфейсами по снимкам экрана и текстовым командам. В карточке указана лицензия Apache-2.0, поэтому веса можно скачать и развернуть у себя. Размер контекста, предел ответа и стоимость доступа через API пока не раскрыты. Независимых замеров качества UI-Venus-2-9B пока нет.

Ling-3.0-flashДоступна
🇨🇳 Ant Group (inclusionAI)Open source

Модель Ant Group (inclusionAI) со ставкой на эффективность: 124B параметров, активных всего ~5.1B — активация 1/64 (512 экспертов плюс 1 общий, 8 на токен). Внимание гибридно-линейное: 35 слоёв KDA на 7 слоёв Gated MLA. Контекст 256K (обучение по расписанию 8K → 32K → 256K); заявлена скорость до 1,000 токенов/с. По данным вендора, обгоняет собственный флагман Ling-2.6-1T в 11 тестах; в карточке: SWE-bench Pro 56.6, AIME 2026 93.2. Анонс 23 июля 2026; на старте только API, веса выложены на Hugging Face под MIT через несколько дней.