🇺🇸 NVIDIA
США · моделей в базе: 5 · официальный сайт ↗
NVIDIA опубликовала 2026-09-01 специализированную модель NVIDIA NemotronLabs AI for Media Sports Tennis для обработки материалов о теннисе. Это дообученная версия NVIDIA Nemotron-3 Nano Omni 30B-A3B Reasoning с 30 млрд параметров и 3 млрд активных параметров при работе. Модель принимает текст, изображения, аудио и видео; заявленный контекст базовой архитектуры составляет 131 072 токена. Результаты профильных испытаний, условия коммерческого использования и независимые замеры пока не опубликованы.
NVIDIA Nemotron 3.5 Lightning появилась в каталоге OpenRouter 2026-08-11 как модель с открытыми весами. Архитектура MoE включает 30 млрд параметров, из которых при работе задействуются 3 млрд. Контекстное окно составляет 262 144 токена. По данным вендора, модель рассчитана на высокопроизводительные агентные сценарии и специализированные задачи; независимых замеров пока нет.
Исследовательский релиз NVIDIA от 2026-07-06: сжатая версия Nemotron-3-Super-120B-A12B, полученная фреймворком пост-тренировочной компрессии Iterative Puzzle. Архитектура — гибрид Mamba-Transformer с LatentMoE и multi-token prediction: 75.3 млрд параметров всего, 9.3 млрд активных, контекст 1 млн токенов. Веса в BF16 выложены на Hugging Face под пермиссивной лицензией OpenMDW-1.1, метод описан в статье на arXiv. Публичных бенчмарков пока не зафиксировано; замысел — сохранить качество класса Super при заметно меньшей стоимости инференса, что стоит проверять на своих задачах.
Старшая модель открытой линейки Nemotron 3 от NVIDIA, веса опубликованы 2026-06-04. Гибрид Mamba-Transformer с MoE: 550 млрд параметров всего, 55 млрд активных; контекст 1 млн токенов, вывод до 16K. Назначение — агентный reasoning, кодинг, планирование и tool calling. Распространяется под Nemotron Open Model License, метод описан в препринте на arXiv. Ниже в линейке — Nemotron 3 Nano 30B-A3B (декабрь 2025) и Super 120B-A12B (март 2026). Опубликованных независимых бенчмарков пока нет.
NVIDIA выпустила Nemotron 3.5 Content Safety 2026-06-02 как специализированную модель на 4 млрд параметров для проверки запросов и ответов языковых и визуально-языковых систем. Она создана на базе Google Gemma-3-4B-it и обрабатывает текст вместе с одним изображением, возвращая оценку безопасности и категории нарушений. Контекст в каталоге OpenRouter составляет 131 072 токена, а цена — 0,20 USD за 1M входных и 0,20 USD за 1M выходных токенов. Модель поддерживает 12 языков и пользовательские политики безопасности; заявленные характеристики приведены по данным NVIDIA, независимых замеров качества пока нет.