Кибер-Миша

Inkling

ДоступнаФронтир
🇺🇸 Thinking Machines Lab·СШАОткрытые веса
Первая модель Thinking Machines Lab, выпущенная 15 июля 2026 года сразу с открытыми весами под Apache 2.0. Это 66-слойный декодер с разреженным MoE: 975B параметров всего, 41B активных (маршрутизация в 6 из 256 экспертов плюс 2 общих), предобучение — порядка 45T токенов. Вход мультимодальный — текст, изображения и аудио до 20 минут (16 кГц), выход только текст; контекст открытых весов — до 1M токенов, в хостинговом API Tinker — 256K. Управляемое усилие рассуждения и калибровка уверенности заявлены вендором; из независимых замеров пока только дебют на 41-м месте Intelligence Index у Artificial Analysis. Есть младшая версия Inkling-Small (276B/12B).
Для бизнеса

Самостоятельный хостинг 975B требует мультинодового кластера, так что практический доступ — API Tinker: $3.74/$9.36 за 1M токенов, причём это цена с 50-процентной стартовой скидкой. Apache 2.0 разрешает коммерческое использование и дистилляцию без ограничений.

Бенчмарки

Подтверждённых оценок пока нет. Мы не смешиваем заявления вендоров с независимыми замерами — методология.

История событий
15 июл 2026Релиз

Релиз Inkling с открытыми весами

MoE 975B/41B, мультимодальный вход, контекст 1M; веса на Hugging Face под Apache 2.0, хостинг через Tinker

Первоисточник ↗
Цена API · за 1M токенов
Ввод$3.74≈ 337 ₽
Вывод$9.36≈ 842 ₽

Рубли — по курсу 90 ₽/$ на 15 августа 2026. Списочные цены вендора; у агрегаторов для РФ будет наценка.

Спецификации
ЛицензияApache-2.0
ДоступОткрытые веса
АрхитектураMoE
Параметры975B
Активные параметры41B
Контекст1M токенов
Макс. вывод
Знания до
МодальностиТекст, Код, Зрение, Аудио
Релиз15 июл 2026