Nemotron-Labs-3-Puzzle-75B-A9B
ДоступнаИсследовательский релиз NVIDIA от 2026-07-06: сжатая версия Nemotron-3-Super-120B-A12B, полученная фреймворком пост-тренировочной компрессии Iterative Puzzle. Архитектура — гибрид Mamba-Transformer с LatentMoE и multi-token prediction: 75.3 млрд параметров всего, 9.3 млрд активных, контекст 1 млн токенов. Веса в BF16 выложены на Hugging Face под пермиссивной лицензией OpenMDW-1.1, метод описан в статье на arXiv. Публичных бенчмарков пока не зафиксировано; замысел — сохранить качество класса Super при заметно меньшей стоимости инференса, что стоит проверять на своих задачах.
Для бизнеса
Кандидат на дешёвый self-host вместо Super-120B: 9.3 млрд активных параметров и пермиссивная OpenMDW-1.1 без ограничений Nemotron-лицензии. Экономию и качество подтверждать своими замерами — открытых бенчмарков нет.
Бенчмарки
Подтверждённых оценок пока нет. Мы не смешиваем заявления вендоров с независимыми замерами — методология.
История событий
6 июл 2026Релиз
Публикация весов Puzzle-75B-A9B на Hugging Face
Сжатый через Iterative Puzzle вариант Nemotron-3-Super-120B-A12B.
Первоисточник ↗Цена API · за 1M токенов
Публичной цены API нет.
Спецификации
ЛицензияOpenMDW-1.1
ДоступОткрытые веса
АрхитектураГибрид (SSM)
Параметры75.3B
Активные параметры9.3B
Контекст1M токенов
Макс. вывод—
Знания до—
МодальностиТекст, Код
Релиз6 июл 2026