Кибер-Миша
Трекер релизов нейросетейОбновлено 15 сен 2026

Каждый релиз LLM — с датой, ценой и первоисточником.

Фронтир и открытые веса, слухи и отключения. Цены API — сразу в рублях, заявления вендоров без независимых замеров помечены. Как мы проверяем →

187
Моделей
69
Фронтир
69
Открытых
30
Лабораторий
6
Стран
39
Релизов · 30 дн
2
Выведено
187 / 187
Qwen3.5 122B-A10B SingProbeДоступна
🇨🇳 Ant Group (inclusionAI)Открытые веса

inclusionAI опубликовала 2026-09-14 вариант Qwen3.5 122B-A10B со встроенным модулем SingProbe для контроля безопасности и выявления возможных галлюцинаций во время формирования ответа. Основа модели насчитывает 122 млрд параметров, из которых при работе активируются 10 млрд; базовое контекстное окно составляет 262 144 токена. SingProbe использует внутренние состояния модели и оценивает риск по мере появления каждого токена. По данным авторов исследования, дополнительная нагрузка составляет менее 0,5%, однако независимых замеров пока нет.

DeepSeek V4.1 FlashДоступна
🇨🇳 DeepSeekОткрытые весаФронтир

DeepSeek выпустила DeepSeek V4.1 Flash 2026-09-10 и открыла доступ через API под именем deepseek-flash. Модель принимает текст и изображения, поддерживает контекст до 1 млн токенов и выдачу до 384 тыс. токенов. Предыдущие DeepSeek V4 Flash и V4 Flash Vision Exp выведены из эксплуатации, а их API-имена временно перенаправляются на новую модель. Веса опубликованы с лицензией MIT; точные сведения об общем и активном числе параметров в проверенных первоисточниках пока не зафиксированы.

GPT-Live-1Доступна
🇺🇸 OpenAIПроприетарная

OpenAI выпустила GPT-Live-1 в API 2026-09-10 для двусторонних голосовых разговоров в реальном времени. Модель одновременно слушает и говорит, обрабатывает перебивания, паузы и фоновый шум, а сложные рассуждения и действия может передавать отдельной текстовой модели. Доступны расшифровка входящей речи, текст ответа, настройка манеры речи и поддержка телефонных сценариев. По данным OpenAI, результат GPT-Live-1 в Full Duplex Bench на 30 процентных пунктов выше GPT-Realtime-2.1; независимых замеров пока нет. Размер модели, объём контекста и предельная длина ответа не раскрыты.

Ling 3.0 Flash VL FP8Доступна
🇨🇳 Ant Group (inclusionAI)Открытые веса

InclusionAI опубликовала 2026-09-08 модель Ling 3.0 Flash VL FP8 с поддержкой текста и изображений. Это отдельная мультимодальная версия семейства Ling 3.0 Flash, представленная с весами в формате FP8 для развертывания у себя. Репозиторий распространяется по лицензии MIT; данные о числе параметров, размере контекста и предельном объеме ответа пока не опубликованы. Независимых замеров качества и требований к оборудованию пока нет.

GPT-6 Astra (batch)Доступна
🇺🇸 OpenAIПроприетарнаяФронтир

GPT-6 Astra (batch) появилась в каталоге OpenRouter 2026-09-05 как отдельная пакетная версия GPT-6 Astra. Контекст составляет 1 050 000 токенов. Стоимость через OpenRouter — 5 USD за 1M входных и 25 USD за 1M выходных токенов. Модель предназначена для комплексного анализа, разработки программного обеспечения, исследований и работы с документами, по данным описания в каталоге; независимых замеров пока нет.

LLaDA2.2-miniДоступна
🇨🇳 Ant Group (inclusionAI)Открытые веса

inclusionAI опубликовала LLaDA2.2-mini — диффузионную языковую модель с архитектурой MoE, 16 млрд параметров и 1,4 млрд активных параметров. Контекст составляет 131 072 токена, а веса доступны на Hugging Face по лицензии Apache-2.0. Модель поддерживает удаление и вставку токенов при формировании ответа, что рассчитано на вызов инструментов, продолжительные диалоги и исправление ошибок. По данным вендора, результат BFCL v4 вырос с 28,44 у LLaDA2.1-mini до 47,68, однако независимых замеров пока нет.

GPT-6 Astra Pro (batch)Доступна
🇺🇸 OpenAIПроприетарнаяФронтир

GPT-6 Astra Pro (batch) появилась в каталоге OpenRouter 2026-09-04 как отдельная конфигурация GPT-6 Astra для пакетной обработки. Модель работает в режиме reasoning.mode=pro, рассчитанном на более качественные ответы в сложных задачах. Контекст составляет 1 050 000 токенов, цена — 5 USD за 1M входных и 25 USD за 1M выходных токенов. Сведения об архитектуре, числе параметров, предельном объёме ответа и результатах независимых замеров пока отсутствуют.

GPT-6 Astra ProДоступна
🇺🇸 OpenAIПроприетарнаяФронтир

GPT-6 Astra Pro появилась в каталоге OpenRouter 2026-09-04 как отдельный вариант GPT-6 Astra для сложных задач. Модель использует тот же базовый вариант GPT-6 Astra, но работает в режиме pro с повышенным объёмом вычислений при подготовке ответа. Контекст составляет 1 050 000 токенов, максимальный ответ — 128 000 токенов, дата окончания обучающих данных — 2026-04-30. Цена через OpenRouter составляет 10 USD за 1M входных и 50 USD за 1M выходных токенов; независимых замеров преимущества режима pro пока нет.

Ling 3.0 Flash SanteДоступна
🇨🇳 Ant Group (inclusionAI)Проприетарная

Ling 3.0 Flash Sante — специализированная модель InclusionAI для задач здравоохранения и медицины, появившаяся в каталоге OpenRouter 2026-09-04. Она основана на Ling 3.0 Flash и использует архитектуру MoE: 5,1 млрд активных параметров при 124 млрд параметров всего, по данным вендора. Контекст составляет 262 144 токена. В каталоге доступна бесплатная версия; независимых замеров качества и медицинской надежности пока нет.

Ling-3.0-flash-VLДоступна
🇨🇳 Ant Group (inclusionAI)Открытые веса

Ant Group опубликовала Ling-3.0-flash-VL на Hugging Face 2026-09-04 как мультимодальную версию Ling-3.0-flash. Модель принимает текст и изображения, рассчитана на анализ документов, визуальные задачи и работу программных агентов с интерфейсами. По данным вендора, архитектура MoE содержит 124 млрд параметров, из которых при обработке запроса задействуется 5,1 млрд; независимых замеров качества пока нет. Веса доступны по лицензии MIT, однако подтвержденных данных о размере контекста, максимальном ответе и стоимости API пока нет.

Qwen3.8 Max 0902Доступна
🇨🇳 Alibaba (Qwen)ПроприетарнаяФронтир

Qwen3.8 Max 0902 — датированная версия Qwen3.8 Max, появившаяся в каталоге OpenRouter 2026-09-04. Модель принимает текст, изображения и видео, а результат возвращает в текстовом виде. Контекст составляет 1 000 000 токенов; заявленный общий объём архитектуры MoE — 2,4 трлн параметров. Работа через OpenRouter стоит 2 USD за 1M входных и 6 USD за 1M выходных токенов. Размер активной части модели, предел ответа, лицензия и результаты независимых замеров пока не раскрыты.

GPT-6 AstraДоступна
🇺🇸 OpenAIПроприетарнаяФронтир

OpenAI выпустила GPT-6 Astra 2026-09-03 и начала поэтапно открывать доступ организациям, пользователям ChatGPT и клиентам API. Модель рассчитана на сложные многоэтапные задачи, работу с программным обеспечением, исследования, документы и анализ изображений. Контекст составляет 1 050 000 токенов, максимальный ответ — 128 000 токенов, дата окончания обучающих данных — 2026-04-30. Результаты испытаний опубликованы OpenAI; независимых замеров пока нет.

VibeVoice-ASR-StreamingДоступна
🇺🇸 MicrosoftOpen source

Microsoft выпустила VibeVoice-ASR-Streaming 2026-09-03 для распознавания речи по мере поступления аудио. Модель формирует расшифровку с указанием говорящего и поддерживает пользовательские ключевые слова. Заявлена работа с 10 языками, включая русский, английский и китайский. Код и веса доступны по лицензии MIT; независимых замеров качества и задержки пока нет.

Claude Fable 5.1 (batch)Доступна
🇺🇸 AnthropicПроприетарная

Claude Fable 5.1 (batch) появилась в каталоге OpenRouter 2026-09-02 с контекстом до 1 000 000 токенов. Пакетный режим стоит 5 USD за 1M входных токенов и 25 USD за 1M выходных токенов. По описанию в каталоге, версия улучшает Claude Fable 5 в задачах программирования, длительных автоматизированных процессах и работе с документами; независимых замеров пока нет. Архитектура, число параметров, максимальный объём ответа и дата среза знаний не раскрыты.

Gemini 3.8 Flash (batch)Доступна
🇺🇸 Google DeepMindПроприетарная

Gemini 3.8 Flash (batch) появилась в каталоге OpenRouter 2026-09-02 как отдельная модель для пакетной обработки запросов. Контекстное окно составляет 1 048 576 токенов. Стоимость через OpenRouter — 0.375 USD за 1M входных и 1.875 USD за 1M выходных токенов. По данным вендора, модель улучшена относительно Gemini 3.7 Flash в задачах разработки ПО, многоэтапного рассуждения и работы с автономными сценариями; независимых замеров пока нет.

Gemini 3.8 Flash CyberДоступна
🇺🇸 Google DeepMindПроприетарнаяФронтир

Google DeepMind выпустила Gemini 3.8 Flash Cyber 2026-09-02 как специализированную модель для поиска и исправления уязвимостей. Доступ предоставляется проверенным государственным структурам, операторам критической инфраструктуры и разработчикам программного обеспечения через Fairwind Program. По данным вендора, модель получила 47,2% на CWE-Bench и свыше 70% успешных решений во внутренней проверке на проектах с 20 языками программирования. Независимых замеров производительности и точных данных о стоимости пока нет.

Gemini 3.8 FlashДоступна
🇺🇸 Google DeepMindПроприетарнаяФронтир

Google DeepMind выпустила Gemini 3.8 Flash 2026-09-02 как следующую версию Gemini 3.7 Flash. Модель принимает текст, код, изображения, аудио и видео, поддерживает контекст до 1 048 576 токенов и формирует до 65 536 токенов текста. По данным вендора, основные улучшения относятся к разработке программного обеспечения, многоэтапным задачам и работе с корпоративными знаниями; независимых замеров пока нет. Архитектура и число параметров не раскрыты.

Muse Spark 1.3 ContributorДоступна
🇺🇸 Meta AIПроприетарная

Muse Spark 1.3 Contributor появилась в каталоге OpenRouter 2026-09-02 с контекстом до 1 048 576 токенов. Модель позиционируется как экономичный вариант для экспериментов, обучения, программирования и ранних сценариев с автономными помощниками. Работа с входными данными стоит 0,1 USD за 1M токенов, генерация — 0,2 USD за 1M токенов. Данные об архитектуре, числе параметров, максимальном ответе и независимых замерах пока отсутствуют.

Muse Spark 1.3Доступна
🇺🇸 Meta AIПроприетарнаяФронтир

Meta выпустила Muse Spark 1.3 2026-09-02 и открыла доступ через Muse Code и Meta Model API. Модель рассчитана на программирование, продолжительные задачи с инструментами и параллельную работу с несколькими процессами. По данным вендора, относительно Muse Spark 1.2 она использует примерно на 20% меньше обращений к инструментам и на 25% меньше токенов; независимых замеров пока нет. Максимальный режим рассуждений задержан до завершения дополнительного тестирования безопасности.

Claude Fable 5.1Доступна
🇺🇸 AnthropicПроприетарнаяФронтир

Anthropic выпустила Claude Fable 5.1 2026-09-01 для программирования, аналитической работы и длительных многоэтапных задач. Модель доступна через Claude API под идентификатором claude-fable-5-1, а также в сервисах Anthropic, AWS, Google Cloud и Microsoft Azure. Цена составляет 10 USD за 1M входных и 50 USD за 1M выходных токенов; чтение сохранённого контекста стоит 0,25 USD за 1M токенов. По данным вендора, совокупные расходы типовой нагрузки снизились примерно на 25% относительно Claude Fable 5, однако независимых замеров пока нет.

NVIDIA NemotronLabs AI for Media Sports TennisДоступна
🇺🇸 NVIDIAОткрытые веса

NVIDIA опубликовала 2026-09-01 специализированную модель NVIDIA NemotronLabs AI for Media Sports Tennis для обработки материалов о теннисе. Это дообученная версия NVIDIA Nemotron-3 Nano Omni 30B-A3B Reasoning с 30 млрд параметров и 3 млрд активных параметров при работе. Модель принимает текст, изображения, аудио и видео; заявленный контекст базовой архитектуры составляет 131 072 токена. Результаты профильных испытаний, условия коммерческого использования и независимые замеры пока не опубликованы.

Hy4 PreviewПревью
🇨🇳 Tencent HunyuanПроприетарная

Hy4 Preview появилась в каталоге OpenRouter 2026-08-28. По данным каталога, это MoE-модель Tencent с 770B параметров, из которых при работе используются 49B. Контекст составляет 1 048 576 токенов; максимальный объём ответа и дата окончания обучающих данных не раскрыты. Модель ориентирована на программирование, выполнение последовательностей действий с инструментами и рабочие задачи, однако независимых замеров качества пока нет.

Tencent Hy4 PreviewПревью
🇨🇳 Tencent HunyuanОткрытые весаФронтир

Tencent выпустила Tencent Hy4 Preview 2026-08-28 и опубликовала веса модели под лицензией Apache-2.0. Архитектура MoE содержит 770 млрд параметров, из которых при работе задействуются 49 млрд; заявленный контекст превышает 1 млн токенов, но точный лимит не опубликован. Модель предназначена для программирования, подготовки документов, анализа и научных задач, а доступ организован через Tencent Cloud TokenHub, OpenRouter и продукты Tencent. Результаты сравнений предоставлены Tencent, независимых замеров пока нет.

ContextPilot-14BДоступна
🇨🇳 Tencent HunyuanОткрытые веса

Tencent выпустила ContextPilot-14B — модель на базе Qwen3-14B для управления рабочим контекстом в многошаговых задачах. Модель умеет планировать работу, сохранять долгосрочную память, искать нужные фрагменты и сокращать накопленную историю с помощью инструментов. В испытаниях использовалось окно 32 768 токенов; заявленный средний результат на четырех тестах с длинным контекстом составил 70,60 балла. Все результаты опубликованы авторами, независимых замеров пока нет.

ContextPilot-8BДоступна
🇨🇳 Tencent HunyuanОткрытые веса

Tencent опубликовала ContextPilot-8B на Hugging Face 2026-08-27. Это специализированная версия Qwen3-8B для управления контекстом, работы с инструментами и агентных сценариев. Веса доступны для развертывания у себя, однако репозиторий помечен лицензией «other», поэтому условия коммерческого использования нужно проверить до внедрения. Точные параметры контекстного окна, максимального ответа и стоимость облачного доступа не раскрыты. Независимых замеров качества пока нет.

ContextPilot-E4BДоступна
🇨🇳 Tencent HunyuanОткрытые веса

Tencent опубликовала ContextPilot-E4B на Hugging Face 2026-08-27, а 2026-08-28 представила связанное исследование ContextPilot. Модель дообучена на базе Google Gemma 4 E4B IT и предназначена для агентов, которые управляют рабочим контекстом в длинных многошаговых задачах. Она поддерживает планирование, структурированную память и перенос части контекста во внешнее хранилище. Авторы сообщают о более компактном рабочем контексте и улучшении результатов на задачах с длинными документами и глубоким поиском, однако независимых замеров пока нет. Точное число параметров и максимальный объём ответа не раскрыты.

Gemini Omni 1.1 FlashПревью
🇺🇸 Google DeepMindПроприетарная

Google выпустила Gemini Omni 1.1 Flash в предварительном доступе 2026-08-27. Модель принимает текст, изображения, аудио и видео, а возвращает текст, изображения и видео со звуком. Контекст составляет 131 072 токена, максимальный объём результата — 57 920 токенов. Поддерживаются создание, редактирование и продолжение видео длительностью до 10 секунд с разрешением до 4K; параметры архитектуры и независимые замеры качества пока не опубликованы.

Ling-3.0-Flash-FinДоступна
🇨🇳 Ant Group (inclusionAI)Открытые веса

Ling-3.0-Flash-Fin — специализированная финансовая версия Ling-3.0-Flash, доступная через OpenRouter с 2026-08-27. По данным каталога OpenRouter, модель содержит 124 млрд параметров и использует 5,1 млрд при обработке каждого токена. Контекст составляет 262 144 токена, максимальный ответ — 32 768 токенов. Модель рассчитана на многоэтапные задачи инвестиционного анализа, поиск информации и работу с инструментами; независимых замеров качества пока нет.

MiniMax H3 MaxДоступна
🇨🇳 MiniMaxПроприетарнаяФронтир

2026-08-27 fal Research выпустила MiniMax H3 Max — дообученную версию открытой видеомодели MiniMax H3, доступную через API fal. Модель создает ролики длительностью 5–15 секунд в разрешении 480p или 768p с синхронным звуком из текста либо исходного изображения. По данным fal, пятисекундный ролик формируется менее чем за 3 секунды, примерно в 35 раз быстрее официального сервиса MiniMax H3; независимый Design Arena также зафиксировал высокую скорость, однако замеров в реальных корпоративных нагрузках пока нет. Веса H3 Max не опубликованы, поэтому развернуть эту версию у себя нельзя.

Qwen-Drive-1.0-4BДоступна
🇨🇳 Alibaba (Qwen)Открытые веса

Qwen-Drive-1.0-4B — специализированная мультимодальная модель для восприятия дорожной обстановки, ответов на вопросы по изображениям и планирования движения. Она построена на Qwen3.5-4B и дополнена отдельными модулями трехмерного восприятия и построения траектории; заявленный размер базовой модели — 4 млрд параметров по данным вендора. Веса, два варианта модуля планирования и модуль восприятия опубликованы 2026-08-27. Для запуска рекомендован ускоритель с 24 GB памяти, однако независимых замеров качества и требований к инфраструктуре пока нет.

Gemini 3.5 TranscribeПревью
🇺🇸 Google DeepMindПроприетарная

Google представила Gemini 3.5 Transcribe 2026-08-26 и открыла модель в публичном предварительном доступе через Gemini API. Она преобразует записанную или потоковую речь в текст, автоматически определяет более 85 языков и поддерживает смену языка внутри разговора. Для записей доступны разделение реплик до 8 собеседников и временные метки на уровне слов; при включении этих функций максимальная длительность файла сокращается с 60 до 30 минут. Потоковая версия работает с сессиями продолжительностью до 10 минут. По данным Google со ссылкой на Artificial Analysis, доля ошибочно распознанных слов составляет 4,0% для потоковой и 2,6% для файловой обработки; независимых замеров полного набора функций пока нет.

GLM-5.3-FlashДоступна
🇨🇳 Z.ai (Zhipu AI)Открытые весаФронтир

Z.ai выпустила GLM-5.3-Flash 2026-08-26 как первую модель семейства GLM-5 с изначальной поддержкой текста и изображений. Модель имеет 320 млрд параметров, из которых при работе задействуются 18 млрд, и поддерживает контекст до 1 048 576 токенов. Архитектура сочетает разреженное подключение параметров, разреженное и линейное внимание; веса опубликованы по лицензии MIT. По данным вендора, GLM-5.3-Flash превосходит GLM-5.2 в прикладных и тестовых задачах при цене примерно в десять раз ниже, однако независимых замеров пока нет.

Qwen3.8 FlashДоступна
🇨🇳 Alibaba (Qwen)Проприетарная

Qwen3.8 Flash появилась в каталоге OpenRouter 2026-08-26 с контекстом до 1 000 000 токенов. Модель принимает текст, код, изображения и видео; заявлены сценарии анализа документов, кодовых баз, диаграмм и длинных видеозаписей. Работа через API стоит 0.16 USD за 1M входных и 0.47 USD за 1M выходных токенов. Архитектура, число параметров, максимальный объём ответа и дата отсечения знаний не раскрыты; независимых замеров качества пока нет.

UI-Venus-2-9BДоступна
🇨🇳 Ant Group (inclusionAI)Открытые веса

Ant InclusionAI опубликовала UI-Venus-2-9B на Hugging Face 2026-08-26. Это мультимодальная модель примерно на 9 млрд параметров для управления графическими интерфейсами по снимкам экрана и текстовым командам. В карточке указана лицензия Apache-2.0, поэтому веса можно скачать и развернуть у себя. Размер контекста, предел ответа и стоимость доступа через API пока не раскрыты. Независимых замеров качества UI-Venus-2-9B пока нет.

Qwen3.8-Flash-NextДоступна
🇨🇳 Alibaba (Qwen)Открытые весаФронтир

Alibaba Qwen выпустила Qwen3.8-Flash-Next 2026-08-24 как экспериментальную открытую модель с поддержкой текста, программного кода, изображений и видео. Модель содержит 125 млрд параметров и задействует 6 млрд при обработке запроса; отдельно заявлены 51 млрд параметров n-gram embeddings и 4 млрд параметров MTP. Базовый контекст составляет 262 144 токена, с возможностью расширения до 1 млн токенов. Архитектура объединяет Gated DeltaNet, Qwen Sparse Attention и 512 экспертов, из которых на каждом шаге работают 10 маршрутизируемых и один общий. Все опубликованные результаты тестов предоставлены вендором, независимых замеров пока нет.

DeepSeek V4 Flash Vision Exp BatchДоступна
🇨🇳 DeepSeekПроприетарная

DeepSeek V4 Flash Vision Exp Batch появилась в каталоге OpenRouter 2026-08-21 как отдельная пакетная версия экспериментальной модели с анализом изображений. Контекст составляет 1 048 576 токенов. Стоимость указана на уровне 0,11 USD за 1M входных и 0,33 USD за 1M выходных токенов. По данным описания OpenRouter, текстовые возможности соответствуют DeepSeek V4 Flash 0731; независимых замеров пока нет.

DeepSeek-V4-Flash-Vision-ExpДоступна
🇨🇳 DeepSeekОткрытые веса

Экспериментальная версия DeepSeek V4-Flash с поддержкой изображений, появившаяся 21 августа 2026 года: модель принимает картинки — скриншоты, сканы, фотографии документов — и отвечает текстом. По данным вендора, базой служит производственная сборка 0731, и на текстовых задачах vision-версия ей не уступает; собственные параметры новой версии не раскрыты. Контекст — 1M токенов, лимит ответа — 384K, поддерживается режим рассуждения. Цена в каталоге OpenRouter — $0.22/$0.66 за 1M токенов, при этом в будни действует пиковый тариф вдвое выше: 01:00–04:00 и 06:00–10:00 UTC, по московскому времени это 04:00–07:00 и 09:00–13:00. Весов в открытом доступе нет, работа только через API; официального анонса с бенчмарками DeepSeek пока не публиковала — статус экспериментальный.

GLM 5.3 BatchДоступна
🇨🇳 Z.ai (Zhipu AI)ПроприетарнаяФронтир

GLM 5.3 Batch появилась в каталоге OpenRouter 2026-08-18 как отдельный вариант GLM 5.3 для пакетной обработки запросов. Модель принимает и возвращает текст, включая программный код, а заявленный размер контекста составляет 1 048 576 токенов. Стоимость через OpenRouter — 0.7 USD за 1M входных и 2.2 USD за 1M выходных токенов. Параметры модели, архитектура, предел ответа и дата актуальности знаний не раскрыты; независимых замеров пока нет.

GLM-5.3Доступна
🇨🇳 Z.ai (Zhipu AI)Открытые весаФронтир

Z.ai выпустила GLM-5.3 2026-08-14 как развитие GLM-5.2 для программирования, длительных инженерных задач и анализа безопасности. Модель использует ту же базовую модель, а заявленные улучшения получены за счёт дополнительного обучения на практических задачах. Поддерживаются контекст до 1M токенов и три уровня глубины обработки: low, high и max. По данным вендора, результат Terminal Bench 3.0 вырос с 4,6 у GLM-5.2 до 28,3 у GLM-5.3, а DeepSWE v1.1 — с 46,2 до 66,9; независимых замеров пока нет. Показатель второго места в тесте художественных текстов не включён, поскольку официальный первоисточник его не подтверждает.

Qwen3.8 27BДоступна
🇨🇳 Alibaba (Qwen)Open source

Компактная модель новой линейки Qwen3.8 и преемница Qwen3.6-27B: 27B параметров, контекст 256K токенов. Веса опубликованы на Hugging Face под свободной лицензией Apache-2.0 (есть и сжатая FP8-версия), в хостинговых каталогах модель появилась 14 августа 2026 по цене $0.45/$3.20 за миллион токенов. Официального техотчёта и таблицы замеров на момент выхода нет — независимые проверки только начинаются. Судя по загрузкам на Hugging Face (100K+ за первые дни), сообщество приняло релиз активно.

UI-Mate-27BДоступна
🇨🇳 Tencent HunyuanОткрытые веса

Tencent опубликовала UI-Mate-27B 2026-08-14 в каталоге Hugging Face с доступными весами. Это мультимодальная модель на 27 млрд параметров, предназначенная для управления настольными приложениями по снимкам экрана и пользовательским командам. Архитектура основана на семействе Qwen3.5 и сочетает механизмы внимания с линейной обработкой последовательностей. Независимых замеров качества и надежности работы в реальных корпоративных интерфейсах пока нет.

UI-Mate-9BДоступна
🇨🇳 Tencent HunyuanОткрытые веса

Tencent опубликовала UI-Mate-9B 2026-08-14 как модель с открытыми весами для управления графическими интерфейсами. Модель анализирует изображения экрана и формирует действия для настольных приложений, включая сценарии с PyAutoGUI. Объём указан в названии вендора как 9B параметров; число активных параметров, размер контекста и максимальный объём ответа не раскрыты. В карточке заявлена ориентация на OSWorld и WindowsAgentArena, однако независимых замеров пока нет.

DeepSeek-V4-Pro-0813Доступна
🇨🇳 DeepSeekОткрытые весаФронтир

Производственная сборка флагмана DeepSeek V4-Pro, выпущенная 13 августа 2026 года взамен апрельского превью 0423, — вендор обозначает её как GA-релиз линейки. Архитектура прежняя: sparse-MoE на 1.6T параметров с 49B активных на токен, контекст 1M токенов; веса опубликованы на Hugging Face под лицензией MIT. Цена в каталоге OpenRouter — $1.32/$3.96 за 1M токенов против $0.87/$1.74 у превью-сборки; лимит ответа — до 943K токенов. Независимые индексы агрегатора Artificial Analysis: 53.2 (интеллект), 68.8 (код), 49.6 (агентные сценарии). Превью-эндпоинт 0423 продолжает работать по прежней цене.

Gemini 3.7 FlashДоступна
🇺🇸 Google DeepMindПроприетарная

Google выпустила новый Flash всего через три недели после Gemini 3.6 Flash — беспрецедентно короткий цикл, который выглядит как работа над ошибками: 3.6 сообщество встретило холодно из-за отсутствия роста качества. У 3.7 картина другая: в пользовательском рейтинге веб-разработки модель скакнула с 19-го на 8-е место, а цена упала в четыре раза относительно 3.6 — $0.375/$1.875 за миллион токенов при контексте 1M. Официальной таблицы замеров и техотчёта на момент выхода нет; есть батч-режим с ещё вдвое меньшей ценой.

Grok 4.6Доступна
🇺🇸 xAI (SpaceXAI)ПроприетарнаяФронтир

Обновление флагмана SpaceXAI через месяц с небольшим после Grok 4.5: в API-каталогах модель появилась 12 августа 2026 по цене $2/$6 за миллион токенов с контекстом 500K. Линейка продолжает курс на программирование и агентские задачи, заданный совместной тренировкой с Cursor; сообщество активно обсуждает первые замеры, но официальной таблицы и независимых проверок на момент выхода мало. Цена та же, что у 4.5 в базовом тарифе.

Qwen3.8 2.4T A95BДоступна
🇨🇳 Alibaba (Qwen)Открытые весаФронтир

Alibaba сдержала июльское обещание открыть веса флагманской линейки: Qwen3.8 на 2.4 триллиона параметров (из них активны 95B на токен) выложена на Hugging Face 8–12 августа 2026. Вместе с Kimi K3 (2.8T) это крупнейшие открытые модели в истории — но, в отличие от свободной Apache-лицензии младших Qwen, здесь собственная лицензия с ограничениями. Контекст 1M токенов, в API-каталогах — $2/$6 за миллион, есть сжатая FP8-версия. Официальных замеров открытой версии на момент релиза нет; флагман линейки Alibaba позиционировала сразу за Claude Fable 5 — это заявление вендора по внутренним тестам.

NVIDIA Nemotron 3.5 LightningДоступна
🇺🇸 NVIDIAОткрытые веса

NVIDIA Nemotron 3.5 Lightning появилась в каталоге OpenRouter 2026-08-11 как модель с открытыми весами. Архитектура MoE включает 30 млрд параметров, из которых при работе задействуются 3 млрд. Контекстное окно составляет 262 144 токена. По данным вендора, модель рассчитана на высокопроизводительные агентные сценарии и специализированные задачи; независимых замеров пока нет.

Muse Glimmer 30B (batch)Доступна
🇺🇸 Meta AIОткрытые веса

Muse Glimmer 30B (batch) появилась в каталоге OpenRouter 2026-08-09 как отдельная пакетная версия модели Meta с контекстом 131 072 токена. По данным вендора, это плотная мультимодальная модель с открытыми весами, полученная на основе Muse Spark и рассчитанная на работу автономных помощников на потребительском оборудовании; независимых замеров пока нет. Стоимость через OpenRouter составляет 0,35 USD за 1M входных и 1,50 USD за 1M выходных токенов. Максимальный объём ответа, лицензия и дата актуальности знаний не раскрыты.

Muse Spark 1.2Превью
🇺🇸 Meta AIПроприетарная

Meta выпустила Muse Spark 1.2 в режиме публичного предварительного доступа 2026-08-05. Модель ориентирована на разработку программного обеспечения: создание и проверку кода, поиск сложных ошибок, анализ крупных репозиториев и выполнение многоэтапных задач. Она принимает текст, код, изображения, аудио и видео; заявленный OpenRouter объём контекста составляет 1 048 576 токенов. Тариф Contributor у OpenRouter стоит 0,10 USD за 1M входных и 0,20 USD за 1M выходных токенов; параметры архитектуры и независимые замеры качества пока не опубликованы.

LongCat-Flash-Lite-SparseДоступна
🇨🇳 Meituan (LongCat)Открытые веса

Meituan выпустила LongCat-Flash-Lite-Sparse 2026-08-03 вместе с открытыми весами и техническим отчётом. Модель содержит 69B параметров, при обработке каждого токена задействует около 3B и поддерживает контекст до 1M токенов. В отличие от LongCat-Flash-Lite, новая версия заменяет плотный механизм внимания на LongCat Sparse Attention, рассчитанный на более экономную работу с длинными документами. Заявленные результаты тестов предоставлены вендором; независимых замеров пока нет.

Qwen3.8 MaxДоступна
🇨🇳 Alibaba (Qwen)ПроприетарнаяФронтир

Общедоступная версия флагмана Alibaba, сменившая июльское превью: с 3 августа 2026 модель доступна через API по объявленной цене $2/$6 за миллион токенов, контекст 1M. Основа та же — мультимодальная модель на 2.4 триллиона параметров, которую Alibaba позиционирует сразу за Claude Fable 5 по внутренним тестам (независимых подтверждений пока мало). Хостинговая версия отличается от открытых весов Qwen3.8 2.4T A95B: здесь полный фирменный стек без забот о железе.

DeepSeek-V4-Flash-0731Доступна
🇨🇳 DeepSeekОткрытые веса

Производственная сборка DeepSeek V4-Flash, выпущенная 31 июля 2026 года взамен апрельского превью. Архитектура и размер не менялись — тот же sparse-MoE на 284B параметров с 13B активных и контекстом 1M токенов; весь прирост дал переработанный пост-трейнинг под кодинг, агентные сценарии, рассуждение и вызов инструментов. По данным вендора, сборка обходит V4-Pro-Preview на всех девяти опубликованных агентных и кодинговых бенчмарках, включая 82.7 на Terminal-Bench 2.1 против 61.8 у превью Flash; независимых воспроизведений на момент релиза мало. API работает на прежнем эндпоинте, добавлена нативная поддержка формата OpenAI Responses и адаптация под Codex CLI. Веса выложены на Hugging Face под MIT, цена по каталогу OpenRouter — $0.06/$0.12 за 1M токенов.

Inkling-SmallДоступна
🇺🇸 Thinking Machines LabОткрытые веса

Thinking Machines Lab выпустила Inkling-Small 2026-07-30 с открытыми весами под лицензией Apache 2.0. Модель использует архитектуру MoE: из 276 млрд параметров при работе активны 12 млрд. Она принимает текст, изображения и аудио, формирует текстовый ответ и поддерживает контекст до 1 млн токенов; на бесплатном маршруте OpenRouter заявлено 262 144 токена. По данным вендора, Inkling-Small сопоставима с более крупной Inkling в задачах рассуждения и программирования, однако независимых замеров пока нет.

Qwen3.7-FlashДоступна
🇨🇳 Alibaba (Qwen)Проприетарная

Бюджетный член линейки Qwen3.7, выпущенный 27 июля 2026 без официального анонса — модель просто появилась в API и на OpenRouter. Параметры и архитектура не раскрыты (сообщество предполагает небольшой sparse-MoE), технического отчёта нет. Принимает текст и изображения, контекст 1M токенов, максимум вывода 66K. Базовая цена $0.03/$0.13 за 1M токенов — на момент релиза это дешевейшая мультимодальная модель с таким контекстом, но тарификация ступенчатая: на промптах свыше 32K токенов ставка растёт до $0.20/$0.80. Бенчмарков вендор не публиковал, независимых замеров пока нет.

Claude Opus 5 (Fast)Превью
🇺🇸 AnthropicПроприетарнаяФронтир

Claude Opus 5 (Fast) — ускоренный режим Claude Opus 5, доступный в каталоге OpenRouter с 2026-07-24. Модель сохраняет возможности и контекст до 1 000 000 токенов, но формирует ответ быстрее при цене 10 USD за 1M входных и 50 USD за 1M выходных токенов. По данным Anthropic, скорость вывода может быть до 2,5 раза выше стандартного режима; независимых замеров для этой конфигурации пока нет. Режим имеет статус исследовательской предварительной версии, а параметры и архитектура модели не раскрыты.

Claude Opus 5Доступна
🇺🇸 AnthropicПроприетарнаяФронтир

Флагман линейки Opus, вышел 24 июля 2026. Контекст 1 млн токенов, вывод до 128K, цена $5/$25 за 1M токенов; fast-режим стоит вдвое дороже ($10/$50) и работает примерно в 2,5 раза быстрее, по данным вендора. Регулируемый уровень усилий (effort dial) позволяет менять баланс цена/качество без смены модели. Anthropic заявляет качество, близкое к Fable 5, за полцены, и лидерство на собственных замерах (Frontier-Bench v0.1, OSWorld 2.0, ARC-AGI 3) — это вендорские цифры; из независимого пока есть только 61 балл в Intelligence Index от Artificial Analysis. Позиционируется как основная модель для инженерных задач и автоматизации знаний.

Ling-3.0-flashДоступна
🇨🇳 Ant Group (inclusionAI)Open source

Модель Ant Group (inclusionAI) со ставкой на эффективность: 124B параметров, активных всего ~5.1B — активация 1/64 (512 экспертов плюс 1 общий, 8 на токен). Внимание гибридно-линейное: 35 слоёв KDA на 7 слоёв Gated MLA. Контекст 256K (обучение по расписанию 8K → 32K → 256K); заявлена скорость до 1,000 токенов/с. По данным вендора, обгоняет собственный флагман Ling-2.6-1T в 11 тестах; в карточке: SWE-bench Pro 56.6, AIME 2026 93.2. Анонс 23 июля 2026; на старте только API, веса выложены на Hugging Face под MIT через несколько дней.

Gemini 3.5 Flash CyberПревью
🇺🇸 Google DeepMindПроприетарная

Специализированная ветка Gemini 3.5 Flash для поиска и исправления уязвимостей в коде, представленная 21 июля 2026 года. Работает внутри агента CodeMender; из-за двойного назначения Google не выводит её в общий доступ — модель раздаётся только правительствам и проверенным партнёрам в рамках закрытого пилота. Модальности — текст и код, контекст 1 млн токенов; цены не раскрыты, бенчмарков нет. Заявление вендора, что модель находит уязвимости дешевле в пересчёте на токен, чем крупные модели, независимо не проверялось.

Gemini 3.5 Flash-LiteДоступна
🇺🇸 Google DeepMindПроприетарная

Самая дешёвая модель ветки 3.5 — $0,30/$2,50 за 1 млн токенов — выпущена 21 июля 2026 года вместе с Gemini 3.6 Flash. Рассчитана на поточные задачи: агентный поиск, разбор документов, массовую классификацию; контекст 1 млн токенов, заявленная скорость порядка 350 токенов/с. По данным вендора, опережает полновесную Gemini 3 Flash прошлого поколения: 54,2% против 49,6% на SWE-Bench Pro и 74,0% против 65,1% на OSWorld-Verified. Независимых замеров пока нет. Доступна в Gemini API и работает внутри поиска Google.

Gemini 3.6 FlashДоступна
🇺🇸 Google DeepMindПроприетарная

Рабочая модель flash-уровня, выпущенная 21 июля 2026 года одновременно с Gemini 3.5 Flash-Lite и Flash Cyber. Сменила Gemini 3.5 Flash в Gemini API, AI Studio, приложении Gemini и Antigravity; контекст 1 млн токенов, срез знаний — март 2026. По данным вендора, тратит примерно на 17% меньше выходных токенов на ту же задачу и поднимает DeepSWE с 37% до 49%, MLE-Bench с 49,7% до 63,9%, OSWorld-Verified с 78,4% до 83,0%. Выход подешевел относительно 3.5 Flash с $9,00 до $7,50 за 1 млн токенов при той же цене входа $1,50. Независимых замеров пока нет.

Laguna S 2.1Доступна
🇺🇸 PoolsideОткрытые весаФронтир

Флагманская открытая модель Poolside для агентной разработки ПО: MoE на 118B параметров с 8B активных, контекст 1M токенов, два режима — с рассуждением и без. Выпущена 21 июля 2026 года под пермиссивной лицензией OpenMDW-1.1; срез знаний — 30 ноября 2025 года. Обучена меньше чем за девять недель на 4096 NVIDIA H200, RL-стадия впервые у Poolside выполнена в FP8, в пост-тренинге задействовано 409 тыс. агентных сред. По данным вендора — 70.2% на Terminal-Bench 2.1 и 78.5% на SWE-bench Multilingual; независимых замеров пока нет. Веса опубликованы в BF16/FP8/INT4/NVFP4.

Qwen3.8-Max-PreviewПревью
🇨🇳 Alibaba (Qwen)ПроприетарнаяФронтир

Превью следующего флагмана Alibaba, показанное 19 июля 2026, — крупнейшая модель компании: 2.4T параметров, sparse-MoE; количество активных параметров, контекст и цены официально не раскрыты. По внутренним оценкам вендора модель уступает по совокупной производительности только Fable 5 от Anthropic — бенчмарк-таблицы, model card и лицензии на момент превью не было, независимых замеров нет. Доступ — через подписку Alibaba Token Plan и кодинг-платформы Qoder/QoderWork. Команда обещала открыть веса «в ближайшее время»; по сообщениям прессы, полная версия Qwen3.8-Max вышла в общую доступность в начале августа 2026.

Kimi K3Доступна
🇨🇳 Moonshot AIОткрытые весаФронтир

MoE-модель на 2.8T параметров со 104B активных на токен (896 экспертов, 16 активных) — крупнейшая открытая модель на момент выхода. В архитектуре — Kimi Delta Attention и Attention Residuals, зрение через энкодер MoonViT-V2; веса опубликованы в MXFP4-квантовании. Контекст 1M токенов, вывод до 32K. API запущен 16 июля 2026, веса выложены 26 июля — но уже не под Modified MIT, как у K2: собственная лицензия с порогом по выручке для MaaS-провайдеров и требованием атрибуции при аудитории свыше 100M MAU. По данным вендора: SWE-bench Verified 76.8, GPQA Diamond 93.5, Terminal-Bench 2.1 88.3; независимых замеров пока мало.

Cotype Pro 3Доступна
🇷🇺 МТС / MWS AI (Cotype)Проприетарная

Модель третьего поколения от MWS AI (экс-MTS AI, группа МТС), представленная 15 июля 2026 года вместе с лёгкой Cotype Light 3 (9 млрд параметров). Основной сценарий — корпоративные ИИ-агенты, самостоятельно выполняющие многошаговые бизнес-задачи. 27 млрд параметров, контекст 262 тыс. токенов (около 600 страниц текста). На внутреннем тесте MWS AI из 178 агентских сценариев Pro 3 выполняет 92,2% задач с воспроизводимостью 79,1%, по данным вендора; на независимом бенчмарке MERA модель заняла 3-е место, уступив моделям в несколько раз крупнее. Поставляется для развёртывания в закрытом контуре заказчика (включая Astra Linux) с дообучением на корпоративных данных и интеграцией через MWS AI Agents Platform; публичного прайса за токены нет — продажи по договору, цены в рублях обсуждаются индивидуально.

InklingДоступна
🇺🇸 Thinking Machines LabОткрытые весаФронтир

Первая модель Thinking Machines Lab, выпущенная 15 июля 2026 года сразу с открытыми весами под Apache 2.0. Это 66-слойный декодер с разреженным MoE: 975B параметров всего, 41B активных (маршрутизация в 6 из 256 экспертов плюс 2 общих), предобучение — порядка 45T токенов. Вход мультимодальный — текст, изображения и аудио до 20 минут (16 кГц), выход только текст; контекст открытых весов — до 1M токенов, в хостинговом API Tinker — 256K. Управляемое усилие рассуждения и калибровка уверенности заявлены вендором; из независимых замеров пока только дебют на 41-м месте Intelligence Index у Artificial Analysis. Есть младшая версия Inkling-Small (276B/12B).

GPT-5.6 Luna BatchДоступна
🇺🇸 OpenAIПроприетарная

GPT-5.6 Luna Batch появилась в каталоге OpenRouter 2026-07-09 как отдельная пакетная версия GPT-5.6 Luna. Контекст модели составляет 1 050 000 токенов. Стоимость через каталог указана на уровне 0,10 USD за 1M входных и 0,60 USD за 1M выходных токенов. По данным вендора каталога, модель рассчитана на массовые задачи, включая диалоги, классификацию и простые автоматизированные процессы; независимых замеров пока нет.

GPT-5.6 Luna Pro (batch)Доступна
🇺🇸 OpenAIПроприетарнаяФронтир

GPT-5.6 Luna Pro (batch) появилась в каталоге OpenRouter 2026-07-09 как вариант пакетной обработки запросов. Это та же базовая модель GPT-5.6 Luna, работающая в режиме reasoning.mode=pro для сложных задач. Контекст составляет 1 050 000 токенов. Цена через OpenRouter — 0.10 USD за 1M входных и 0.60 USD за 1M выходных токенов.

GPT-5.6 Luna ProДоступна
🇺🇸 OpenAIПроприетарнаяФронтир

GPT-5.6 Luna Pro появилась в каталоге OpenRouter 2026-07-09 с контекстом до 1 050 000 токенов. Это тот же базовый вариант GPT-5.6 Luna, но сервис запускает его с параметром reasoning.mode=pro для более тщательной работы над сложными запросами. Стоимость через OpenRouter составляет 0,20 USD за 1M входных и 1,20 USD за 1M выходных токенов. Параметры архитектуры, максимальный объём ответа и результаты независимых замеров пока не опубликованы.

GPT-5.6 LunaДоступна
🇺🇸 OpenAIПроприетарная

Нижний ярус GPT-5.6 для массовых конвейерных задач: классификация, экстракция, суммаризация, черновики. Контекст тот же, что у старших ярусов, — 1,5 млн токенов при выводе до 128 тыс.; срез знаний — 31 января 2026. Превью 26 июня 2026, общая доступность с 9 июля 2026. Стартовая цена $1/$6 за 1 млн токенов; 30 июля 2026, по данным отраслевых источников, её снизили на 80%, точный новый прайс в справочниках пока не зафиксирован. Примечательно, что на Terminal-Bench 2.1 Luna показывает 84,3% — выше среднего яруса Terra (82,5%); независимых подтверждений этого замера пока нет.

GPT-5.6 Sol (batch)Доступна
🇺🇸 OpenAIПроприетарнаяФронтир

GPT-5.6 Sol (batch) появилась в каталоге OpenRouter 2026-07-09 как отдельный пакетный вариант GPT-5.6 Sol. Контекст составляет 1 050 000 токенов, а стоимость — 1 USD за 1M входных и 5 USD за 1M выходных токенов. Каталог позиционирует модель для сложных рассуждений, программирования и многошаговых рабочих процессов; независимых замеров пока нет. Архитектура, число параметров, предел ответа и дата актуальности знаний не раскрыты.

GPT-5.6 Sol Pro (batch)Доступна
🇺🇸 OpenAIПроприетарнаяФронтир

GPT-5.6 Sol Pro (batch) появилась в каталоге OpenRouter 2026-07-09 как отдельный пакетный вариант GPT-5.6 Sol. Контекст составляет 1 050 000 токенов. По данным OpenRouter, используется та же базовая модель, но режим рассуждений установлен в значение pro для более сложных задач. Независимых замеров качества и скорости пока нет.

GPT-5.6 Sol ProДоступна
🇺🇸 OpenAIПроприетарнаяФронтир

GPT-5.6 Sol Pro появилась в каталоге OpenRouter 2026-07-09 как отдельная конфигурация GPT-5.6 Sol. Это та же базовая модель, но сервис запускает её с режимом reasoning.mode=pro, который увеличивает объём работы модели для сложных задач. Контекст составляет 1 050 000 токенов, максимальный ответ — 128 000 токенов, дата окончания обучающих данных — 2026-02-16. Отдельных независимых замеров качества именно этой конфигурации пока нет.

GPT-5.6 SolДоступна
🇺🇸 OpenAIПроприетарнаяФронтир

Флагманский ярус семейства GPT-5.6, показан в превью 26 июня 2026 и открыт для всех 9 июля 2026 после проверки американского центра CAISI при Минторге США. Контекст 1,5 млн токенов, вывод до 128 тыс., на входе текст, изображения и аудио; срез знаний — 31 января 2026. Добавлены уровень усилия рассуждений max и режим ultra с порождением субагентов для длинных автономных задач. Цена API — $5/$30 за 1 млн токенов входа/выхода. На Terminal-Bench 2.1 — 88,8% (91,9% в режиме ultra), в независимом индексе Artificial Analysis Coding Agent — 80,0. Заявленная скорость 750 ток/с достигается только на железе Cerebras в закрытом превью для избранных клиентов — независимых замеров пока нет.

GPT-5.6 Terra (batch)Доступна
🇺🇸 OpenAIПроприетарная

GPT-5.6 Terra (batch) появилась в каталоге OpenRouter 2026-07-09 как пакетная версия GPT-5.6 Terra. Контекстное окно составляет 1 050 000 токенов. Цена указана на уровне 1 USD за 1M входных и 6 USD за 1M выходных токенов. Модель предназначена для отложенной обработки текстовых и программных задач; независимых замеров качества и скорости пока нет.

GPT-5.6 Terra Pro (batch)Доступна
🇺🇸 OpenAIПроприетарнаяФронтир

GPT-5.6 Terra Pro (batch) появилась в каталоге OpenRouter 2026-07-09 как пакетный вариант GPT-5.6 Terra Pro. Контекст модели составляет 1 050 000 токенов. Стоимость через OpenRouter указана на уровне 1 USD за 1M входных и 6 USD за 1M выходных токенов. По данным каталога, версия использует ту же базовую модель GPT-5.6 Terra, но работает в режиме pro для более сложных задач; независимых замеров качества пока нет.

GPT-5.6 Terra ProДоступна
🇺🇸 OpenAIПроприетарная

GPT-5.6 Terra Pro появилась в каталоге OpenRouter 2026-07-09 как отдельная конфигурация GPT-5.6 Terra. Контекстное окно составляет 1 050 000 токенов. Версия использует ту же базовую модель, но работает в режиме reasoning.mode=pro, рассчитанном на более сложные задачи. Цена через OpenRouter составляет 2 USD за 1M входных и 12 USD за 1M выходных токенов. Независимых замеров качества и скорости пока нет.

GPT-5.6 TerraДоступна
🇺🇸 OpenAIПроприетарная

Средний ярус линейки GPT-5.6 с теми же 1,5 млн токенов контекста, выводом до 128 тыс. и мультимодальным входом (текст, изображения, аудио), что у флагманского Sol. Превью 26 июня 2026, общая доступность с 9 июля 2026. OpenAI позиционирует Terra как замену GPT-5.5 при цене примерно вдвое ниже: $2,50/$15 за 1 млн токенов на старте, а 30 июля 2026 цену, по данным отраслевых источников, снизили ещё на 20%. На Terminal-Bench 2.1 — 82,5%, что близко к результату GPT-5.5 на предыдущей версии этого бенчмарка. Срез знаний — 31 января 2026.

Muse Spark 1.1Доступна
🇺🇸 Meta AIПроприетарнаяФронтир

Вторая модель Meta Superintelligence Labs и первая, за которую Meta берёт деньги: релиз 2026-07-09 одновременно открыл публичное превью Meta Model API (пока только для разработчиков из США). Мультимодальная reasoning-модель под агентные задачи — tool use, computer use, кодинг; контекст 1 млн токенов, на вход принимает текст, изображения, аудио, видео и PDF. Цена $1.25/$4.25 за 1 млн токенов ввода/вывода, новым аккаунтам дают $20 кредитов. API совместим одновременно с форматами OpenAI Chat Completions и Anthropic Messages, что снижает стоимость миграции. По данным вендора, модель стоит в одном ряду с Claude Opus 4.8 и GPT-5.5; независимых замеров пока нет. Архитектура и число параметров не раскрыты.

Grok 4.5Доступна
🇺🇸 xAI (SpaceXAI)ПроприетарнаяФронтир

Флагман xAI (с февраля 2026 компания поглощена SpaceX и работает под брендом SpaceXAI), выпущен 2026-07-08. Первая модель Grok, обученная совместно с Cursor (Anysphere): по заявлению компании — на триллионах токенов реальных сессий разработчиков в Cursor плюс STEM-задачи и научные статьи. MoE-архитектура; общее число параметров не раскрыто, в утечках фигурирует фундамент «V9» на ~1.5 трлн, подтверждения нет. Позиционируется под software engineering, агентные задачи и knowledge work, отдельно — юридические и финансовые сценарии; вендор заявляет примерно в 4.2 раза меньше выходных токенов на задачу, чем у конкурентов. Цена $2/$6 за 1 млн токенов, ускоренный вариант для Cursor — $4/$18. Бенчмарк-картина смешанная: по данным вендора модель впереди на Terminal-Bench 2.1 (83.3%) и DeepSWE 1.0, но уступает Claude Opus 4.8 на DeepSWE 1.1 и SWE-bench Pro.

Hunyuan Hy3Доступна
🇨🇳 Tencent HunyuanOpen source

Открытая MoE-модель Tencent: 295B параметров, 21B активных (192 эксперта, top-8) плюс MTP-слой на 3.8B для ускоренной генерации. Три переключаемых режима инференса с разной глубиной рассуждений. Превью показано в апреле 2026, релиз — 6 июля 2026 под Apache-2.0; есть FP8-вариант. По данным вендора: SWE-bench Verified 78.0, SWE-bench Pro 57.9, GPQA Diamond 90.4 — уровень GLM-5.2 и DeepSeek-V4 при меньшем числе активных параметров; независимые замеры пока единичны. До 21 июля действовал бесплатный доступ через OpenRouter.

Hy3Доступна
🇨🇳 Tencent HunyuanОткрытые веса

Tencent выпустила Hy3 2026-07-06 и открыла веса модели по лицензии Apache-2.0. Это модель с разреженной архитектурой: 295 млрд параметров всего и 21 млрд используются при обработке каждого фрагмента текста. Контекст составляет 262 144 токена; модель поддерживает прямые ответы и два уровня углублённого анализа. В OpenRouter работа с 1M входных и выходных токенов на момент обнаружения стоила 0.0825 USD и 0.33 USD соответственно.

Nemotron-Labs-3-Puzzle-75B-A9BДоступна
🇺🇸 NVIDIAОткрытые веса

Исследовательский релиз NVIDIA от 2026-07-06: сжатая версия Nemotron-3-Super-120B-A12B, полученная фреймворком пост-тренировочной компрессии Iterative Puzzle. Архитектура — гибрид Mamba-Transformer с LatentMoE и multi-token prediction: 75.3 млрд параметров всего, 9.3 млрд активных, контекст 1 млн токенов. Веса в BF16 выложены на Hugging Face под пермиссивной лицензией OpenMDW-1.1, метод описан в статье на arXiv. Публичных бенчмарков пока не зафиксировано; замысел — сохранить качество класса Super при заметно меньшей стоимости инференса, что стоит проверять на своих задачах.

Laguna XS 2.1Доступна
🇺🇸 PoolsideОткрытые веса

Компактная модель Poolside для локальной агентной разработки: MoE 33B всего и 3B активных, контекст 256K. Вышла 2 июля 2026 года под OpenMDW-1.1 вместе с открытыми DFlash-спекуляторами, которые, по данным вендора, примерно удваивают скорость локальной генерации. Заявлено 63.1% на SWE-bench Multilingual — на 5.4 п.п. выше предшественницы; независимых замеров пока нет. Поддерживается в vLLM, SGLang, TensorRT-LLM, HF Transformers и Ollama; веса — в BF16/FP8/INT4/NVFP4.

Claude Sonnet 5Доступна
🇺🇸 AnthropicПроприетарная

Модель среднего сегмента, релиз 30 июня 2026. Контекст 200K токенов, вывод до 64K, цена $2/$10 за 1M токенов — стартовая ставка, которую Anthropic позже сделала постоянной вместо планового перехода на $3/$15. Основной упор на агентные сценарии: работа с браузером и терминалом, многошаговые автономные задачи; вендор заявляет уровень около Opus 4.8 при меньшей цене, независимых замеров пока нет. Встроены рантайм-фильтры против наступательного кибер-применения; в тестах вендора модель ни разу не собрала рабочий эксплойт. Модель по умолчанию на планах Free и Pro в Claude.ai.

Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image)Доступна
🇺🇸 Google DeepMindПроприетарная

Nano Banana 2 Lite, представленная в каталоге как Gemini 3.1 Flash Lite Image, появилась в OpenRouter 2026-06-30. Модель принимает текстовые запросы и предназначена для быстрого создания изображений; размер контекста составляет 65 536 токенов. Стоимость через OpenRouter указана на уровне 0,25 USD за 1M входных и 1,50 USD за 1M выходных токенов. Параметры архитектуры, размер модели, максимальный объём ответа и граница знаний не раскрыты. Заявления о скорости и экономичности приведены по данным вендора, независимых замеров пока нет.

Seed 2.1 ProДоступна
🇨🇳 ByteDance SeedПроприетарнаяФронтир

Флагманская агентная модель ByteDance (в API — Doubao-Seed-2.1-pro), вышла 23 июня 2026. Архитектура и параметры не раскрыты; контекст 256K, вход — текст, изображения, видео и GUI-скриншоты, включая мобильные агентные сценарии. ByteDance заявляет качество на уровне GPT-5.5 и первые места на GDPVal и MobileWorld — все цифры вендорские, независимых замеров нет. Доступ только через Doubao и Volcano Engine; цены опубликованы в юанях: ¥6/¥30 за 1M токенов вход/выход, тарифа в USD нет.

Seed 2.1 TurboДоступна
🇨🇳 ByteDance SeedПроприетарная

Удешевлённый и ускоренный тир линейки Seed 2.1 (в API — Doubao-Seed-2.1-turbo), выпущен одновременно с Pro 23 июня 2026. ByteDance позиционирует качество как сопоставимое с Pro при вдвое меньшей цене (¥3/¥15 за 1M токенов) и меньшей задержке; независимых замеров нет. Та же мультимодальность (текст, изображения, видео) и контекст 256K; параметры не раскрыты, веса не публикуются. Доступ через Doubao и Volcano Engine, тарифа в USD нет.

Gemini 3 Pro ImageДоступна
🇺🇸 Google DeepMindПроприетарнаяФронтир

Gemini 3 Pro Image, также представленная как Nano Banana Pro, появилась в каталоге OpenRouter 2026-06-18 как отдельная стабильная модель для создания и редактирования изображений. Через OpenRouter заявлено контекстное окно 131 072 токена и цена 2 USD за 1M входных и 12 USD за 1M выходных токенов. Модель принимает текст и изображения, поддерживает управление композицией, локальные правки и создание материалов в разрешении до 4K. Все характеристики качества приведены по данным Google; сопоставимых независимых замеров стабильной версии пока нет.

Kimi K2.7 CodeДоступна
🇨🇳 Moonshot AIОткрытые веса

Открытая агентно-кодовая модель Moonshot на базе K2.6: MoE на 1T параметров, 32B активных (384 эксперта, 8 на токен), внимание MLA, энкодер MoonViT на 400M — принимает текст, изображения и видео. Режим рассуждений принудительный (forced thinking) с сохранением цепочки между ходами диалога; заявлена экономия около 30% thinking-токенов против K2.6. Контекст 256K, вывод до 32K, лицензия Modified MIT. Вышла 18 июня 2026. Бенчмарки в карточке — собственные (Kimi Code Bench v2 62.0, MCP Atlas 76.0), стандартных публичных замеров пока нет.

GLM-5.2Доступна
🇨🇳 Z.ai (Zhipu AI)Open sourceФронтир

Открытый флагман Z.ai (Zhipu): MoE на 753B параметров (число активных не раскрыто), контекст 1M токенов, вывод до 163,840 токенов в режиме рассуждений. Главное изменение против GLM-5.1 — механизм IndexShare, переиспользующий индексы sparse-attention, плюс ускоренное спекулятивное декодирование (по данным вендора, до +20% к acceptance length). Ориентирована на длинные кодовые и агентные сессии. Лицензия MIT без региональных ограничений, релиз 17 июня 2026. Vendor-цифры: SWE-bench Pro 62.1, GPQA Diamond 91.2, AIME 2026 99.2, HLE 40.5; независимых замеров пока нет. Цены API на релизе не опубликованы.

GLM 5.2 BatchДоступна
🇨🇳 Z.ai (Zhipu AI)Проприетарная

GLM 5.2 Batch появилась в каталоге OpenRouter 2026-06-16 как отдельная пакетная версия GLM 5.2. Модель принимает текст и код, а объём контекста составляет 1 048 576 токенов. Стоимость указана на уровне 0,7 USD за 1M входных и 2,2 USD за 1M выходных токенов. По данным вендора, модель рассчитана на длительные рабочие процессы и задачи программной разработки; независимых замеров пока нет.

MiniMax-M3Доступна
🇨🇳 MiniMaxОткрытые весаФронтир

Нативно-мультимодальная MoE-модель: 428B параметров, 23B активных; текст, изображения и видео смешиваются с первого шага обучения, а не подключаются отдельным энкодером. Механизм MiniMax Sparse Attention даёт, по данным вендора, 9-кратное ускорение prefill и 15-кратное decode на контексте 1M против M2. Заявленные SWE-bench Verified 80.5 и SWE-bench Pro 59.0 — уровень закрытых флагманов, но независимых подтверждений пока нет. Выпущена 16 июня 2026, веса доступны под MiniMax Community License.

DiffusionGemma 26B-A4BДоступна
🇺🇸 Google DeepMindOpen source

Первая открытая текстово-диффузионная модель Google, выпущенная 10 июня 2026 года на базе Gemma 4 26B-A4B. Вместо автогенеративного вывода по одному токену модель параллельно «расшумляет» блоки по 256 токенов; по данным вендора, это даёт свыше 1000 токенов/с на одном H100 и свыше 700 токенов/с на RTX 5090 — до 4 раз быстрее сравнимых авторегрессионных моделей. MoE-архитектура: 25,2 млрд параметров всего, около 3,8 млрд активных на шаг; контекст 256 тыс. токенов, на входе текст, изображения и видео. Лицензия Apache-2.0, инструктивные веса на Hugging Face; после квантизации помещается примерно в 18 ГБ VRAM. Модель экспериментальная, независимых замеров качества пока нет.

Claude Fable 5Доступна
🇺🇸 AnthropicПроприетарнаяФронтир

Первая публичная модель Mythos-класса — уровня, который Anthropic ставит выше Opus. Вышла 9 июня 2026: контекст 1 млн токенов, вход текст+изображения+код, цена $10/$50 за 1M токенов. Рассчитана на длительную автономную работу: по данным вендора, модель удерживает фокус на миллионах токенов и сама проверяет результат через циклы верификации; публичных бенчмарков вендор не приводит, независимых замеров пока нет. Поверх модели стоят классификаторы безопасности (кибер, биология/химия, защита от дистилляции); при их срабатывании — по данным вендора, менее 5% сессий — запрос обрабатывает Claude Opus 4.8. С 12 июня по 1 июля 2026 доступ был приостановлен экспортным предписанием США, затем восстановлен глобально. Срез знаний — 30 ноября 2025.

North Mini Code 1.0Доступна
🇨🇦 CohereOpen source

Первая модель кодовой линейки North у Cohere и первый релиз компании, адресованный напрямую разработчикам: MoE 30B всего с 3B активных, контекст 256K, генерация до 64K токенов. Выпущена 9 июня 2026 года под Apache 2.0 и заточена под агентный кодинг и работу в терминале с прицелом на развёртывание внутри контура предприятия. Минимальная конфигурация — один H100 в FP8 или FP4; на Artificial Analysis Coding Index набирает 33.4. По данным вендора, даёт до 2.8 раза большую пропускную способность, чем Devstral Small 2. Доступна на Hugging Face, через Cohere API, Model Vault и OpenRouter.

Nemotron 3 Ultra 550B-A55BДоступна
🇺🇸 NVIDIAОткрытые весаФронтир

Старшая модель открытой линейки Nemotron 3 от NVIDIA, веса опубликованы 2026-06-04. Гибрид Mamba-Transformer с MoE: 550 млрд параметров всего, 55 млрд активных; контекст 1 млн токенов, вывод до 16K. Назначение — агентный reasoning, кодинг, планирование и tool calling. Распространяется под Nemotron Open Model License, метод описан в препринте на arXiv. Ниже в линейке — Nemotron 3 Nano 30B-A3B (декабрь 2025) и Super 120B-A12B (март 2026). Опубликованных независимых бенчмарков пока нет.

Gemma 4 12BДоступна
🇺🇸 Google DeepMindOpen source

Открытая 12-миллиардная модель, выпущенная 3 июня 2026 года как дополнение к апрельской линейке Gemma 4. Главное отличие — безэнкодерная мультимодальность: изображения и звук проецируются напрямую в основной стек, что снижает задержку и потребление памяти; это первая средняя Gemma с нативным аудиовходом. Контекст 256 тыс. токенов, лицензия Apache-2.0, веса опубликованы на Hugging Face. По данным вендора, работает на ноутбуке с 16 ГБ памяти; независимых бенчмарков в справочниках пока не зафиксировано.

Qwen3.7-PlusДоступна
🇨🇳 Alibaba (Qwen)Проприетарная

Мультимодальный собрат Qwen3.7-Max: MoE нераскрытого размера с вводом изображений и GUI-grounding — модель возвращает координаты элементов интерфейса, что рассчитано на screen-агентов, автоматизацию браузера и смешанные GUI+CLI сценарии. Превью показано 20 мая 2026 на Alibaba Cloud Summit, общая доступность — 3 июня 2026. Контекст 1M токенов, доступ только по API (Model Studio/DashScope, регионы Пекин, Сингапур, US-Virginia), совместимость с OpenAI-форматами. По данным вендора, лидирует в GUI-grounding: 79.0 на ScreenSpot Pro и 81.0 на AndroidWorld; независимых подтверждений пока нет. Цена $0.40/$1.60 за 1M токенов — примерно в шесть раз ниже, чем у Max.

MAI-Code-1-FlashДоступна
🇺🇸 MicrosoftПроприетарная

Компактная кодинговая модель Microsoft из семейства MAI, представленного на Build 2026 (2026-06-02); всего в семействе семь моделей, включая MAI-Image-2.5 и MAI-Voice-2. Около 5 млрд активных параметров, оптимизирована под дешёвый инференс; раскатывается как опция в пикере моделей GitHub Copilot и в VS Code. Microsoft заявляет преимущество в 16 пунктов над Claude Haiku 4.5 на SWE-bench Pro — независимых подтверждений этому нет. Обучена, по данным вендора, на «чистых, отслеживаемых» корпоративных данных без дистилляции сторонних моделей. Отдельные цены API не опубликованы.

MAI-Thinking-1Доступна
🇺🇸 MicrosoftПроприетарнаяФронтир

Первая полностью собственная frontier-reasoning-модель Microsoft, показанная на Build 2026 (2026-06-02) — фактический разрыв с зависимостью от моделей OpenAI. Разреженный MoE с ~35 млрд активных параметров (общее число не раскрыто), контекст 256K токенов, работает с текстом и кодом. Microsoft подчёркивает, что модель обучена с нуля на коммерчески лицензированных данных без дистилляции сторонних моделей. Заявленные результаты — AIME 2025 97.0% и паритет с Claude Opus 4.6 на SWE-bench Pro; это данные вендора, независимых замеров пока нет. На момент анонса доступ шёл через Microsoft Foundry по заявке, цены API не опубликованы.

Nemotron 3.5 Content SafetyДоступна
🇺🇸 NVIDIAОткрытые веса

NVIDIA выпустила Nemotron 3.5 Content Safety 2026-06-02 как специализированную модель на 4 млрд параметров для проверки запросов и ответов языковых и визуально-языковых систем. Она создана на базе Google Gemma-3-4B-it и обрабатывает текст вместе с одним изображением, возвращая оценку безопасности и категории нарушений. Контекст в каталоге OpenRouter составляет 131 072 токена, а цена — 0,20 USD за 1M входных и 0,20 USD за 1M выходных токенов. Модель поддерживает 12 языков и пользовательские политики безопасности; заявленные характеристики приведены по данным NVIDIA, независимых замеров качества пока нет.

Step-3.7-FlashДоступна
🇨🇳 StepFunOpen source

Мультимодальный sparse-MoE от StepFun: 196B параметров, 11B активных, преемник Step-3.5-Flash. Нативный вход изображений и видео, три переключаемых уровня рассуждений (high/medium/low); позиционируется под кодовых агентов и поисковые сценарии. Контекст 256K. Выпущена 29 мая 2026 под Apache-2.0, веса на Hugging Face. Публичных бенчмарков в карточке нет — независимых замеров тоже пока нет.

Alice AI LLM FlashДоступна
🇷🇺 Яндекс (Alice AI / YandexGPT)Проприетарная

Лёгкая и быстрая версия флагманской Alice AI LLM, открытая для бизнеса 28 мая 2026 года в Yandex AI Studio. Позиционируется под массовые повторяющиеся задачи: модерация пользовательского контента, классификация обращений в поддержку, диалоги с клиентами — по оценке Яндекса, это около 60% корпоративных запросов к его моделям. Стоит почти в пять раз дешевле флагманской Alice AI LLM (у которой тариф 0,5 ₽ вход / 2 ₽ выход за 1000 токенов); точные цены Flash вендор публикует в тарифах AI Studio, в открытых анонсах цифры не приводились. По данным вендора, обходит GPT-5.4 mini в 56% случаев, в диалоговых сценариях — в 73%. Технические параметры (размер, контекст) не раскрыты.

Claude Opus 4.8Доступна
🇺🇸 AnthropicПроприетарная

Апгрейд флагмана поколения 4.x поверх Opus 4.7, вышел 28 мая 2026. Контекст 500K токенов, вывод до 64K, цена $5/$25 ($10/$50 в fast-режиме — втрое дешевле прежнего fast, по данным вендора). Вендор заявляет 81,5% на SWE-bench Verified, 89% на GPQA Diamond и 84% на Online-Mind2Web; независимых подтверждений нет. Улучшения — агентное рассуждение, ревью кода, работа с браузером и точность цитирования. После выхода Fable 5 модель также служит fallback при срабатывании её классификаторов безопасности. Срез знаний — 30 ноября 2025.

Gemini 3.1 Flash ImageДоступна
🇺🇸 Google DeepMindПроприетарная

Gemini 3.1 Flash Image, также известная как Nano Banana 2, — модель Google DeepMind для генерации и редактирования изображений по текстовым, графическим и видеоматериалам. Стабильная версия стала доступна через Gemini API 2026-05-28; размер контекста составляет 131 072 токена, предельный объём ответа — 32 768 токенов. Поддерживаются изображения разрешением 512, 1K, 2K и 4K, поиск актуальных данных в интернете и последовательное редактирование в диалоге. Улучшения качества, согласованности объектов и отображения текста заявлены по данным вендора; независимых замеров пока нет.

LFM2.5-8B-A1BДоступна
🇺🇸 Liquid AIОткрытые веса

Reasoning-модель Liquid AI для работы на устройстве: MoE на 8.3B параметров с 1.5B активных (32 эксперта, 4 на токен) поверх гибридного стека из 18 свёрточных LIV-блоков и 6 слоёв GQA-внимания. Выпущена 28 мая 2026 года как развитие LFM2-8B-A1B: предобучение расширено с 12T до 38T токенов, контекст поднят до 131K, словарь удвоен до 128K токенов. Модель всегда отвечает с явной цепочкой рассуждений; отдельные стадии пост-тренинга посвящены снижению галлюцинаций и борьбе с зацикливанием рассуждений. По данным вендора — 88.76 на MATH500 и 56.47 на IFBench; укладывается в ~6 ГБ памяти на ноутбучных чипах и выдаёт около 30 ток/с на смартфоне.

Claude Opus 4.8 FastДоступна
🇺🇸 AnthropicПроприетарнаяФронтир

Claude Opus 4.8 Fast появился в каталоге OpenRouter 2026-05-27 как ускоренный вариант Claude Opus 4.8. Модель поддерживает контекст до 1 000 000 токенов и, по данным вендора, сохраняет возможности основной версии при более высокой скорости выдачи. Стоимость составляет 10 USD за 1M входных и 50 USD за 1M выходных токенов — вдвое выше тарифа обычного режима. Независимых замеров скорости и качества пока нет.

Hy-MT2-7BДоступна
🇨🇳 Tencent HunyuanOpen source

Tencent выпустила Hy-MT2-7B 2026-05-21 как специализированную модель для перевода между 33 языками, включая пять пар с китайскими диалектами и языками меньшинств. Модель поддерживает перевод с учетом контекста, терминологических словарей, заданного стиля и структурированных разделителей. Контекст составляет 8192 токена, а в официальных настройках Tencent рекомендует ограничивать ответ 4096 токенами. Через OpenRouter работа модели стоит 0.074 USD за 1M входных и 0.295 USD за 1M выходных токенов; независимых замеров качества пока нет.

Grok Build 0.1Превью
🇺🇸 xAI (SpaceXAI)Проприетарная

Grok Build 0.1 — закрытая модель xAI для автоматизации разработки программного обеспечения, доступная через OpenRouter с 2026-05-20. Она принимает текст и изображения, формирует текст и программный код, а также поддерживает вызов внешних инструментов и структурированный вывод. Контекст составляет 256 000 токенов. Стоимость через OpenRouter — 1 USD за 1M входных и 2 USD за 1M выходных токенов. Модель находится в раннем доступе; данные об архитектуре, числе параметров, предельном объёме ответа и независимых испытаниях пока не опубликованы.

Qwen3.7-MaxДоступна
🇨🇳 Alibaba (Qwen)ПроприетарнаяФронтир

Закрытый текстовый флагман линейки Qwen3.7, представленный Alibaba 19–20 мая 2026 года с позиционированием «агентная модель». Sparse-MoE нераскрытого размера с контекстом 1M токенов и режимом расширенного рассуждения; весов нет, доступ только через API Alibaba Cloud Model Studio (DashScope) и агрегаторы вроде OpenRouter. По данным вендора: 60.6 на SWE-bench Pro, 69.7 на Terminal-Bench 2.0 и 76.4 на MCP-Atlas — заявлено преимущество над Claude Opus 4.7 в агентном кодинге, независимые замеры пока фрагментарны. Цена $2.5/$7.5 за 1M токенов, кэшированный вход дешевле на 90% ($0.25).

Gemini 3.5 FlashДоступна
🇺🇸 Google DeepMindПроприетарная

Быстрая модель линейки 3.5, показанная на Google I/O 19 мая 2026 года и сразу запущенная в Gemini API, приложении Gemini и AI Mode поиска Google. Контекст 1 млн токенов, вывод до 65,5 тыс., цена $1,50/$9,00 за 1 млн токенов входа/выхода. По данным вендора, обходит Gemini 3.1 Pro в коде и вызове инструментов при примерно четырёхкратной скорости; независимых замеров не зафиксировано. С 21 июля 2026 фактически вытеснена Gemini 3.6 Flash с более дешёвым выходом.

Gemini 3.5 ProПревью
🇺🇸 Google DeepMindПроприетарнаяФронтир

Флагман линейки Gemini 3.5, анонсированный на Google I/O 19 мая 2026 года, но до сих пор не вышедший в общий доступ. Заявлены MoE-архитектура, контекст 2 млн токенов и упор на глубокое мультимодальное рассуждение; срез знаний — январь 2026. Обещанный на июнь запуск сорван: 21 июля Google ограничился формулировкой «тестируем с партнёрами», модель видна только в Antigravity и LMArena. Цены не объявлены, бенчмарков нет — кроме заявлений вендора, оценивать пока нечего.

Claude Opus 4.7 FastДоступна
🇺🇸 AnthropicПроприетарнаяФронтир

Claude Opus 4.7 Fast появился в каталоге OpenRouter 2026-05-12 как ускоренный вариант Claude Opus 4.7. Контекст модели составляет 1 000 000 токенов. По данным вендора, возможности совпадают с основной версией, а отличие заключается в более высокой скорости выдачи ответа. Независимых замеров скорости и качества пока нет.

Qwen3.6-27BДоступна
🇨🇳 Alibaba (Qwen)Открытые веса

Плотная (dense) модель на 27B параметров, выпущенная 12 мая 2026 под Apache-2.0 с расчётом на агентный кодинг при самостоятельном хостинге. Нативный контекст 262K токенов, срез знаний — 31 января 2026. По данным вендора набирает 77.2 на SWE-bench Verified — выше, чем 397B MoE-модель Qwen3.5, которую она заменяет в нише self-hosted кодинга. В 4-битной квантизации занимает около 17 GB и работает на одной потребительской GPU; поддерживаются vLLM, SGLang и llama.cpp, модель подключается к агентным средам заменой конфигурации.

ERNIE 5.1Доступна
🇨🇳 BaiduПроприетарнаяФронтир

Закрытый флагман Baidu, вышел 8 мая 2026. MoE-архитектура; точные размеры не раскрыты — заявлено около 1/3 общих и 1/2 активных параметров от ERNIE 5.0 при стоимости претрейна порядка 6% от сопоставимых моделей. Контекст 128K, вывод до 65,536 токенов; доступ только через облако — Qianfan и ernie.baidu.com, API OpenAI-совместимый. На LMArena Search Arena набрала 1223 балла — 4-е место глобально и 1-е среди китайских моделей. Остальные цифры (например, AIME26 99.6 с инструментами) — по данным вендора, независимых замеров нет.

Gemini 3.1 Flash LiteДоступна
🇺🇸 Google DeepMindПроприетарная

Gemini 3.1 Flash Lite появилась в каталоге OpenRouter 2026-05-07 как проприетарная мультимодальная модель Google для высоконагруженных сценариев. Контекстное окно составляет 1 048 576 токенов, а заявленные форматы входных данных включают текст, изображения, аудио, видео и PDF. Стоимость через OpenRouter — 0,25 USD за 1M входных и 1,50 USD за 1M выходных токенов. Архитектура, число параметров, предел ответа и дата отсечения знаний не раскрыты; независимых замеров качества и скорости пока нет.

GPT-5.5-CyberПревью
🇺🇸 OpenAIПроприетарная

Вариант GPT-5.5 со смягчёнными отказами для авторизованных задач безопасности: триаж уязвимостей, проверка патчей, анализ малвари, red teaming, контролируемая валидация эксплойтов. Анонсирован 7 мая 2026 в статусе ограниченного превью в рамках программы Trusted Access: физлица проходят верификацию личности на chatgpt.com/cyber, организации подключаются через представителя OpenAI. С 1 июня 2026 доступ к самым пермиссивным моделям требует фишинг-устойчивой аутентификации аккаунта. Цены, контекст и лимиты вывода публично не раскрыты. По заявлению вендора, кража учётных данных, скрытность, персистентность и эксплуатация чужих систем блокируются и в этом варианте — независимой проверки границ дозволенного нет.

Grok 4.3Доступна
🇺🇸 xAI (SpaceXAI)Проприетарная

Reasoning-модель xAI среднего ценового сегмента: анонс 2026-04-30, общедоступна с 2026-05-06. MoE-архитектура, контекст 1 млн токенов, вывод до 64K, срез знаний — 2025-11-30. При выходе xAI снизила цену ввода примерно на 40% относительно предшественника: $1.25/$2.50 за 1 млн токенов, кэшированный ввод — $0.20. Упор сделан на агентный tool calling и следование инструкциям; GPQA Diamond 86% — по данным вендора, независимых замеров мало. До выхода Grok 4.5 в июле 2026 была флагманом линейки, сейчас — рабочая модель с длинным контекстом.

Grok 4.3 BatchДоступна
🇺🇸 xAI (SpaceXAI)ПроприетарнаяФронтир

Grok 4.3 Batch — пакетный вариант Grok 4.3, появившийся в каталоге OpenRouter 2026-04-30. По данным OpenRouter, модель принимает текст и изображения, возвращает текст и поддерживает контекст до 1 000 000 токенов. Стоимость составляет 1 USD за 1M входных и 2 USD за 1M выходных токенов. Параметры, предел ответа и дата отсечения знаний не раскрыты; независимых замеров пока нет.

Qwen3.5 Plus 2026-04-20Доступна
🇨🇳 Alibaba (Qwen)Проприетарная

Qwen3.5 Plus 2026-04-20 появилась в каталоге OpenRouter 2026-04-27 как отдельная датированная версия модели Alibaba. Она принимает текст, изображения и видео, а результат возвращает в текстовом виде. Контекст составляет 1 000 000 токенов по данным каталога. Архитектура, число параметров, предел ответа и дата среза знаний не раскрыты; независимых замеров пока нет.

Qwen3.6-35B-A3BДоступна
🇨🇳 Alibaba (Qwen)Открытые веса

Qwen3.6-35B-A3B появилась в каталоге OpenRouter 2026-04-27 как модель с открытыми весами для работы с текстом, кодом и изображениями. По данным вендора, архитектура MoE содержит 35 млрд параметров, из которых при обработке одного токена используются 3 млрд. Контекстное окно составляет 262 144 токена, а стоимость через OpenRouter — 0.14 USD за 1M входных и 1 USD за 1M выходных токенов. Данных о максимальном объёме ответа, лицензии и сроке актуальности знаний пока нет; независимых замеров качества и скорости также пока нет.

Qwen3.6 FlashДоступна
🇨🇳 Alibaba (Qwen)Проприетарная

Qwen3.6 Flash появилась в каталоге OpenRouter 2026-04-27 как быстрая модель линейки Qwen 3.6. По данным каталога, она принимает текст, изображения и видео, а объём контекста достигает 1 000 000 токенов. Базовая цена составляет 0,1875 USD за 1M входных токенов и 1,125 USD за 1M выходных токенов; для больших запросов может действовать ступенчатая тарификация, но её условия не раскрыты в данных кандидата. Архитектура, число параметров, предел ответа и результаты независимых испытаний пока не опубликованы.

DeepSeek V4-FlashДоступна
🇨🇳 DeepSeekОткрытые веса

Эффективный компаньон флагманского V4-Pro, представленный 24 апреля 2026 года вместе со всем семейством V4. Sparse-MoE на 284B параметров с 13B активных на токен, контекст 1M токенов; веса открыты на Hugging Face под MIT вместе с техническим отчётом. 20 июля 2026 семейство достигло общей доступности, а 31 июля API-эндпоинт deepseek-v4-flash был переведён на переобученную сборку 0731, которая фактически заменила апрельский чекпоинт. Отдельных бенчмарков именно апрельской версии справочники не фиксируют — актуальные цифры вендор публикует для сборки 0731.

DeepSeek V4-ProДоступна
🇨🇳 DeepSeekОткрытые весаФронтир

Флагман семейства DeepSeek V4, выпущенный 24 апреля 2026 года: sparse-MoE на 1.6T параметров с 49B активных на токен и контекстом 1M токенов. Веса опубликованы на Hugging Face под лицензией MIT вместе с техническим отчётом — на момент релиза это одна из крупнейших открытых моделей. 20 июля 2026 семейство V4 вышло из превью в общую доступность. Цена API — $0.87/$1.74 за 1M токенов по каталогу OpenRouter, эндпоинт совместим одновременно с форматами OpenAI ChatCompletions и Anthropic. Систематических независимых замеров именно V4-Pro пока немного: агентные таблицы, которые публикует сам вендор, в основном сравнивают сборки внутри линейки.

GPT-5.5 (batch)Доступна
🇺🇸 OpenAIПроприетарнаяФронтир

GPT-5.5 (batch) появилась в каталоге OpenRouter 2026-04-24 как отдельный вариант GPT-5.5 для пакетной обработки запросов. Контекст составляет 1 050 000 токенов, максимальный ответ — 128 000 токенов; модель принимает текст и изображения, а возвращает текст. Цена составляет 2,5 USD за 1M входных и 15 USD за 1M выходных токенов, то есть вдвое ниже стандартного тарифа GPT-5.5. Для запросов длиннее 272 000 входных токенов OpenAI применяет повышающие коэффициенты: 2× для входа и 1,5× для выхода. Архитектура и число параметров не раскрыты, независимых замеров именно пакетного варианта пока нет.

GPT-5.5 Pro BatchДоступна
🇺🇸 OpenAIПроприетарнаяФронтир

GPT-5.5 Pro Batch появилась в каталоге OpenRouter 2026-04-24 как отдельный вариант GPT-5.5 Pro для пакетной обработки запросов. Контекст составляет 1 050 000 токенов: по данным вендора, до 922 000 токенов на вход и до 128 000 токенов на выход. Стоимость через OpenRouter — 15 USD за 1M входных и 90 USD за 1M выходных токенов. Архитектура, число параметров и граница обучающих данных не раскрыты; независимых замеров качества и скорости пока нет.

GPT-5.5 ProДоступна
🇺🇸 OpenAIПроприетарнаяФронтир

GPT-5.5 Pro появилась в каталоге OpenRouter 2026-04-24 как отдельная модель OpenAI для сложных задач, требующих углублённого анализа. Контекст составляет 1 050 000 токенов: по данным каталога, до 922 000 токенов приходится на вход и до 128 000 — на ответ. Стоимость через OpenRouter указана на уровне 30 USD за 1M входных и 180 USD за 1M выходных токенов. Архитектура, число параметров, дата среза знаний и независимые результаты испытаний пока не раскрыты.

GPT-5.5Доступна
🇺🇸 OpenAIПроприетарнаяФронтир

Флагман OpenAI весны 2026: вышел в ChatGPT 23 апреля 2026 (варианты Thinking и Pro), в API — на день позже, 24 апреля, из-за отдельного контура защит для API. Контекст 800 тыс. токенов на входе, до 128 тыс. на выходе; цена $3/$20 за 1 млн токенов. По данным вендора, на Terminal-Bench 2.0 — 82,7%, на FrontierMath — 51,7% (уровни 1–3) и 35,4% (уровень 4), на закрытом наборе экспертных задач по кибербезопасности — 71,4%. 5 мая 2026 GPT-5.5 Instant заменил GPT-5.3 Instant как модель по умолчанию для бесплатных пользователей. Из инженерных курьёзов: OpenAI признала унаследованный с обучения GPT-5.1 сбой reward-сигналов, из-за которого модель навязчиво поминала гоблинов и гремлинов; проблемный пресет личности отозвали. С выходом GPT-5.6 в июле 2026 остаётся в API, но по соотношению цена/качество проигрывает ярусу Terra.

Hy3 PreviewПревью
🇨🇳 Tencent HunyuanПроприетарная

Tencent Hy3 Preview появилась в каталоге OpenRouter 2026-04-22 как предварительная версия модели с архитектурой MoE. Контекст составляет 262 144 токена. Модель поддерживает отключённый, низкий и высокий уровни рассуждений и ориентирована на автоматизацию многоэтапных рабочих процессов. Цена через OpenRouter составляет 0,18 USD за 1M входных и 0,60 USD за 1M выходных токенов. Размер модели, лимит ответа, дата среза знаний и результаты независимых замеров пока не раскрыты.

GPT-5.4 Image 2Доступна
🇺🇸 OpenAIПроприетарнаяФронтир

GPT-5.4 Image 2 появилась в каталоге OpenRouter 2026-04-21 как отдельная модель OpenAI для работы с текстом, кодом и изображениями. Контекст составляет 272 000 токенов. Стоимость через OpenRouter указана на уровне 8 USD за 1M входных и 15 USD за 1M выходных токенов. Архитектура, число параметров, предел ответа и дата отсечения знаний не раскрыты. Независимых замеров качества и скорости пока нет.

Kimi K2.6Доступна
🇨🇳 Moonshot AIОткрытые веса

Moonshot AI выпустила Kimi K2.6 2026-04-20, а модель доступна через API-каталог OpenRouter. Она принимает текст и изображения, работает с программным кодом и поддерживает контекст до 262144 токенов. Стоимость у провайдера Moonshot AI составляет 0.95 USD за 1M входных и 4 USD за 1M выходных токенов. По данным вендора, модель рассчитана на длительные задачи разработки, создание интерфейсов и координацию нескольких программных исполнителей; независимых замеров этих возможностей пока недостаточно.

Qwen3.6 Max PreviewПревью
🇨🇳 Alibaba (Qwen)ПроприетарнаяФронтир

Qwen3.6 Max Preview — закрытая текстовая модель Alibaba Qwen, представленная 2026-04-18 и доступная через API. Контекст составляет 262144 токена, максимальный ответ — 65536 токенов. Модель рассчитана на программирование, работу с инструментами, структурированные ответы и задачи, требующие следования сложным инструкциям. По данным вендора, качество программирования, работы с базой знаний и выполнения инструкций выросло относительно Qwen3.6 Plus; независимых замеров пока нет. Архитектура, число параметров и дата окончания обучения официально не раскрыты.

Claude Opus 4.7Доступна
🇺🇸 AnthropicПроприетарнаяФронтир

Claude Opus 4.7 появилась в каталоге OpenRouter 2026-04-16 с контекстом до 1 000 000 токенов. Стоимость через каталог составляет 5 USD за 1M входных и 25 USD за 1M выходных токенов. По описанию вендора, модель развивает возможности Claude Opus 4.6 в программировании и длительной работе автономных помощников. Архитектура, число параметров, предел ответа и дата среза знаний не раскрыты; независимых замеров пока нет.

Claude Mythos 5Превью
🇺🇸 AnthropicПроприетарнаяФронтир

Закрытая версия Fable 5: та же базовая модель Mythos-класса, но с ослабленными предохранителями — для проверенных организаций в защитной кибербезопасности и исследованиях. Раскрыта 7 апреля 2026 как Claude Mythos Preview; 9 июня участников Project Glasswing перевели на Mythos 5. С 12 июня доступ был приостановлен экспортным предписанием США, с 1 июля восстановлен только для одобренных американских организаций. Цена $10/$50 за 1M токенов, модальности — текст и код; контекст и параметры вендор не раскрывает, публичных бенчмарков нет. Общедоступного API у модели нет.

GLM 5.1Доступна
🇨🇳 Z.ai (Zhipu AI)Открытые веса

GLM 5.1 появилась в каталоге OpenRouter 2026-04-07 и доступна через API под идентификатором z-ai/glm-5.1. Модель ориентирована на программирование и длительные многоэтапные задачи; по данным вендора, она способна непрерывно выполнять одну задачу более 8 часов, независимых замеров пока нет. Контекст составляет 204 800 токенов, максимальный ответ — 131 072 токена. Стоимость по данным каталога на момент обнаружения — 1.26 USD за 1M входных токенов и 3.96 USD за 1M выходных токенов. Архитектура, число параметров, дата среза знаний и условия лицензии не раскрыты.

Gemma 4 26B A4B ITДоступна
🇺🇸 Google DeepMindОткрытые веса

Google DeepMind выпустила инструктивную модель Gemma 4 26B A4B IT 2026-04-03. Архитектура MoE содержит 25,2 млрд параметров, из которых при обработке каждого фрагмента текста задействуются 3,8 млрд, по данным вендора. Модель принимает текст, изображения и видео, возвращает текст и поддерживает контекст до 262 144 токенов. Максимальный ответ составляет 32 768 токенов; независимых замеров качества и производительности пока недостаточно для оценки преимуществ в рабочих сценариях.

Gemma 4 31BДоступна
🇺🇸 Google DeepMindOpen source

Старшая плотная модель семейства Gemma 4, вышедшего 2 апреля 2026 года четырьмя размерами (E2B, E4B, 26B MoE, 31B dense); с этого поколения Gemma впервые перешла на лицензию Apache-2.0. Позиционируется как открытая модель для продвинутого рассуждения на персональных компьютерах. На момент релиза занимала третье место среди открытых моделей в текстовом рейтинге LMArena — по данным вендора. 31 млрд параметров, модальности — текст, изображения, код; размер контекста в справочниках не зафиксирован. Веса доступны на Hugging Face и в AI Studio.

Qwen3.6 PlusДоступна
🇨🇳 Alibaba (Qwen)Проприетарная

Qwen3.6 Plus появилась в каталоге OpenRouter 2026-04-02 с контекстом до 1 000 000 токенов. По описанию в каталоге, модель использует сочетание линейного внимания и разреженной архитектуры MoE. Стоимость составляет 0,325 USD за 1M входных и 1,95 USD за 1M выходных токенов. Размер модели, число активных параметров, максимальный объём ответа и дата актуальности знаний не раскрыты. Независимых замеров качества и скорости пока нет.

GLM-5V-TurboДоступна
🇨🇳 Z.ai (Zhipu AI)Проприетарная

Z.ai выпустила GLM-5V-Turbo 2026-04-01 как мультимодальную модель для программирования, анализа интерфейсов и выполнения длительных последовательностей действий. Модель принимает текст, изображения и видео, формирует текст и поддерживает контекст до 202 752 токенов с ответом до 131 072 токенов. В OpenRouter работа стоит 1,20 USD за 1M входных и 4,00 USD за 1M выходных токенов. Параметры модели, дата среза знаний и условия лицензирования не раскрыты; опубликованные оценки качества исходят от Z.ai, независимых замеров пока нет.

MiniMax M2.7Доступна
🇨🇳 MiniMaxОткрытые весаФронтир

MiniMax выпустила MiniMax M2.7 2026-03-18 для программирования, работы с инструментами и многоэтапных рабочих процессов. Модель имеет архитектуру MoE, около 229 млрд параметров и контекст 196 608 токенов; число активных параметров официально не раскрыто. Веса доступны для развертывания у себя, а сама модель также работает через MiniMax Agent и MiniMax API. По данным вендора, результат на SWE-Pro составляет 56,22%, однако независимых замеров полного набора заявленных возможностей пока недостаточно.

Mistral Medium 3.5Доступна
🇫🇷 Mistral AIОткрытые веса

Плотная модель Mistral AI на 128B параметров, объединившая в одних весах чат, рассуждение и агентный кодинг: она заменила сразу Mistral Medium 3.1, Magistral и Devstral 2. Релиз датирован 18 марта 2026 года; контекст 256K, вывод до 32K токенов, вход мультимодальный (текст и изображения), усилие рассуждения настраивается на каждый запрос, срез знаний — 31 октября 2025 года. По данным вендора — 77.6% на SWE-bench Verified и 91.4% на τ³-Telecom; независимых замеров в справочниках пока нет. Веса открыты на Hugging Face, лицензия — модифицированная MIT с исключением для компаний с крупной выручкой.

GPT-5.4 Mini (batch)Доступна
🇺🇸 OpenAIПроприетарная

GPT-5.4 Mini (batch) появилась в каталоге OpenRouter 2026-03-17 как отдельная модель для пакетной обработки больших объёмов запросов. Контекст составляет 400 000 токенов; поддерживаются текстовые запросы, программный код и изображения. Цена через OpenRouter — 0,375 USD за 1M входных и 2,25 USD за 1M выходных токенов. Данные об архитектуре, числе параметров, максимальном объёме ответа и границе знаний не опубликованы; независимых замеров качества и скорости пока нет.

GPT-5.4 Nano (batch)Доступна
🇺🇸 OpenAIПроприетарная

GPT-5.4 Nano (batch) появилась в каталоге OpenRouter 2026-03-17 как отдельная пакетная версия компактной модели OpenAI. Контекст составляет 400 000 токенов; поддерживаются текстовые и графические входные данные. Цена указана на уровне 0.10 USD за 1M входных и 0.625 USD за 1M выходных токенов. Это данные каталога OpenRouter; независимых замеров скорости, качества и фактических ограничений пока нет.

Mistral Small 4Доступна
🇫🇷 Mistral AIПроприетарная

Mistral Small 4 появилась в каталоге OpenRouter 2026-03-16 в режиме пакетной обработки. Модель поддерживает контекст до 262 144 токенов. Стоимость составляет 0,15 USD за 1M входных и 0,60 USD за 1M выходных токенов. Архитектура, число параметров, предел ответа и дата актуальности знаний не раскрыты; независимых замеров пока нет.

Qwen3.5-9BДоступна
🇨🇳 Alibaba (Qwen)Открытые веса

Qwen3.5-9B — мультимодальная модель Alibaba Qwen с 9 млрд параметров, опубликованная 2026-03-10. Она принимает текст, изображения и видео, формирует текст и поддерживает контекст до 262144 токенов. Максимальный ответ достигает 81920 токенов, по данным вендора. В OpenRouter пакетная версия появилась по цене 0.17 USD за 1M входных и 0.25 USD за 1M выходных токенов; независимых замеров качества и скорости этой конфигурации пока нет.

GPT-5.4 (batch)Доступна
🇺🇸 OpenAIПроприетарнаяФронтир

Пакетная версия GPT-5.4 появилась в каталоге OpenRouter 2026-03-05. Модель принимает до 922 000 входных токенов и формирует до 128 000 выходных токенов; заявленный общий контекст составляет 1 050 000 токенов. Стоимость через OpenRouter — 1,25 USD за 1M входных и 7,50 USD за 1M выходных токенов. Архитектура, число параметров и дата отсечения знаний не раскрыты; независимых замеров качества пакетной версии пока нет.

GPT-5.4 Pro (batch)Доступна
🇺🇸 OpenAIПроприетарнаяФронтир

GPT-5.4 Pro (batch) появилась в каталоге OpenRouter 2026-03-05 как отдельная пакетная версия GPT-5.4 Pro. Модель поддерживает контекст до 1 050 000 токенов, включая до 128 000 токенов ответа, по данным каталога. Стоимость составляет 15 USD за 1M входных и 90 USD за 1M выходных токенов. Данные об архитектуре, числе параметров и границе знаний не раскрыты; независимых замеров пока нет.

GPT-5.4Доступна
🇺🇸 OpenAIПроприетарная

Массовый релиз 5 марта 2026: MoE-архитектура, выделенный режим Thinking, контекст 400 тыс. токенов, вывод до 100 тыс., срез знаний — 31 октября 2025. Варианты mini и nano добавлены 17 марта 2026; mini открыт бесплатному ярусу ChatGPT, nano — только в API. Результаты: SWE-bench Verified 74,9%, GPQA Diamond 86,5%, OSWorld-Verified 75,0% против 47,3% у GPT-5.2 — цифры вендора. OpenAI также заявляла сокращение фактических ошибок на 33% относительно GPT-5.2 и встроенный computer use; независимых подтверждений нет. Точные цены API в справочниках не зафиксированы; в отзывах отмечали высокую стоимость mini/nano относительно аналогов поколения GPT-5.

Gemini 3.1 ProДоступна
🇺🇸 Google DeepMindПроприетарнаяФронтир

Действующий флагман Google, выпущенный 19 февраля 2026 года как промежуточный апгрейд Gemini 3 Pro — первый случай использования номера «.1» в линейке Gemini. MoE-архитектура, контекст 2 млн токенов, вывод до 65,5 тыс. токенов, срез знаний — сентябрь 2025, нативная работа с инструментами. По данным вендора, набирает 77,1% на ARC-AGI-2 — более чем вдвое выше Gemini 3 Pro — и 84,2% на MMMU; независимых подтверждений в справочниках нет. Доступен в Gemini API, Vertex AI, приложении Gemini, NotebookLM и Gemini CLI. Пока Gemini 3.5 Pro не вышла из партнёрского тестирования, остаётся самой сильной общедоступной моделью Google.

Claude Opus 4.6Доступна
🇺🇸 AnthropicПроприетарная

Флагман Anthropic начала 2026 года, релиз 5 февраля. Первый Opus с контекстом 1 млн токенов — в бете: базовое окно 200K, вход свыше 200K тарифицируется $10/$37,5 при стандартной цене $5/$25. Ставка на автономный многофайловый кодинг и computer use: вендор заявлял 72,5% на OSWorld и 76% точности needle-ретривала на 1M контексте (против 18,5% у Sonnet 4.5); независимых подтверждений этих цифр нет. Срез знаний — 31 августа 2025. Практически вытеснен Opus 4.8 и Opus 5, но остаётся доступен в API и на облачных платформах.

GPT-5.3-CodexДоступна
🇺🇸 OpenAIПроприетарная

Специализированная модель для агентной разработки: релиз 5 февраля 2026, продолжение линейки Codex после GPT-5.2-Codex (декабрь 2025). Контекст 400 тыс. токенов на входе и до 128 тыс. на выходе — под длинные сессии работы с репозиторием. Цена $1,25/$10 за 1 млн токенов, заметно ниже универсальных флагманов. Заявленный фокус — качество кода и автономные инженерные циклы; публичных бенчмарков в справочниках на момент составления карточки не зафиксировано.

T-Pro 2.1Доступна
🇷🇺 Т-Банк / Т-Технологии (T-Pro)Открытые веса

Открытая русскоязычная модель «Т-Технологий» (группа Т-Банка) на базе Qwen3-32B с переработанной кириллической токенизацией (примерно на 30% эффективнее для русского, по данным вендора) и гибридным режимом рассуждений — первая российская открытая модель с таким режимом. T-Pro 2.0 вышла 18 июля 2025 года, обновление T-Pro 2.1 (улучшенные следование инструкциям и вызов инструментов: IFEval-ru 0,8065, BFCL 65,96 ru / 72,27 en) — 23 декабря 2025 года; параллельно обновлена лёгкая T-Lite 2.1 на 8 млрд параметров. Контекст — 32 тыс. токенов, до 128 тыс. с RoPE-скейлингом. Лицензия Apache 2.0, веса бесплатно доступны в коллекции t-tech на Hugging Face; платного API у банка нет, тарифов в рублях соответственно тоже — только собственный хостинг. На разработку потрачено около 120 млн рублей, по данным компании.

OLMo 3 Think 32BДоступна
🇺🇸 Allen Institute for AI (Ai2)Open source

Полностью открытая reasoning-модель Allen Institute for AI: плотные 32B, у которых опубликованы не только веса, но и код обучения, данные (корпус Dolma 3 объёмом около 6T токенов), промежуточные чекпоинты и вся методика пост-тренинга. Семейство OLMo 3 анонсировано 20 ноября 2025 года, релиз Think 32B в справочниках датирован 15 декабря 2025-го; лицензия Apache 2.0. Модель генерирует явные цепочки рассуждений и позиционируется как воспроизводимая база для исследований RL поверх открытого пайплайна. Позднее Ai2 выпустила усиленный вариант Olmo 3.1 32B Think с удлинённой RL-стадией и приростом на AIME и IFBench.

GPT-5.2Доступна
🇺🇸 OpenAIПроприетарная

Рабочая модель OpenAI конца 2025 года: релиз 11 декабря 2025, контекст 400 тыс. токенов, вывод до 128 тыс., на входе текст и изображения. Цена $2/$12 за 1 млн токенов. Позиционировалась как усиление базовой линии по рассуждениям, коду, следованию инструкциям и длинному контексту; публичных бенчмарков в трекерах не зафиксировано. К середине 2026 фактически вытеснена GPT-5.4 и ярусами GPT-5.6, но остаётся доступной в API. Полезна как историческая точка отсчёта: именно с ней OpenAI сравнивала GPT-5.4 по фактическим ошибкам и computer-use.

GPT-5.2 (batch)Доступна
🇺🇸 OpenAIПроприетарнаяФронтир

GPT-5.2 (batch) появилась в каталоге OpenRouter 2025-12-10 как отдельная пакетная версия GPT-5.2 с контекстом до 400 000 токенов. Стоимость составляет 0,875 USD за 1M входных и 7 USD за 1M выходных токенов. По данным вендора каталога, модель рассчитана на сложные многошаговые задачи и работу с длинным контекстом; независимых замеров пока нет. Архитектура, число параметров, предел ответа и дата актуальности знаний не раскрыты.

GPT-5.2 Pro (batch)Доступна
🇺🇸 OpenAIПроприетарнаяФронтир

GPT-5.2 Pro (batch) появилась в каталоге OpenRouter 2025-12-10 как отдельная версия GPT-5.2 Pro для пакетной обработки запросов. Модель поддерживает контекст до 400 000 токенов. Стоимость составляет 10,5 USD за 1M входных и 84 USD за 1M выходных токенов. По данным вендора, версия рассчитана на сложные задачи с последовательным рассуждением, программирование и работу с длинным контекстом; независимых замеров пока нет.

Devstral 2 2512Устаревает
🇫🇷 Mistral AIОткрытые весаФронтир

Mistral выпустила Devstral 2 2512 2025-12-09 для автоматизации задач разработки: анализа репозиториев, изменения нескольких файлов и работы с инструментами. Это плотная модель на 123 млрд параметров с контекстом 262144 токена и открытыми весами по модифицированной лицензии MIT. По данным Mistral, модель набрала 72,2% на SWE-bench Verified; независимых замеров в сопоставимой конфигурации пока нет. С 2026-05-22 модель имеет статус deprecated, а для новых интеграций Mistral рекомендует Mistral Medium 3.5.

Amazon Nova 2 LiteДоступна
🇺🇸 AmazonПроприетарная

Массовая reasoning-модель второго поколения линейки Nova, общедоступна в Amazon Bedrock с 2025-12-02 через глобальный cross-region inference. Контекст до 1 млн токенов, три уровня интенсивности размышления (low/medium/high), встроенные инструменты — code interpreter и web grounding, есть поддержка удалённых MCP-серверов и structured output. Мультимодальный ввод: текст, изображения, видео, документы. Цена на Bedrock — $0.30/$2.50 за 1 млн токенов ввода/вывода. Amazon позиционирует модель под чат-ботов поддержки, обработку документов и автоматизацию бизнес-процессов.

Amazon Nova 2 ProПревью
🇺🇸 AmazonПроприетарная

Старшая модель поколения Nova 2: анонсирована 2025-12-02 и по состоянию на август 2026 остаётся в превью — ранний доступ идёт через программу Amazon Nova Forge. Заявленные сценарии — многодокументный анализ, video reasoning и миграции софта; как и Lite, поддерживает extended thinking с тремя уровнями интенсивности, встроенные инструменты (code interpreter, web grounding) и контекст до 1 млн токенов. Цены не опубликованы, архитектура и параметры не раскрыты. Независимых бенчмарков нет.

Mistral Large 3Доступна
🇫🇷 Mistral AIОткрытые весаФронтир

Флагман Mistral AI и крупнейшая открытая модель компании: разреженный MoE на 675B параметров с 41B активных, обученный с нуля на 3000 NVIDIA H200. Выпущен 2 декабря 2025 года в составе семейства Mistral 3 — вместе с плотными моделями 14B/8B/3B — под лицензией Apache 2.0. Вход мультимодальный (текст и изображения), контекст 256K, вывод до 32K токенов; срез знаний — 31 октября 2025 года. Веса опубликованы на Hugging Face в BF16 и NVFP4; FP8-вариант разворачивается на одной ноде B200 или H200.

Alice AI LLMДоступна
🇷🇺 Яндекс (Alice AI / YandexGPT)Проприетарная

Флагманская текстовая модель Яндекса нового поколения, открытая для бизнеса 25 ноября 2025 года в Yandex AI Studio; в потребительских продуктах семейство работает под брендом «Алиса AI» (ребрендинг октября 2025). Тариф — 0,5 ₽ за 1000 входных и 2 ₽ за 1000 выходных токенов с НДС. Контекст — 32 тыс. токенов (по данным обзоров), что заметно меньше, чем у YandexGPT 5.1 Pro (128 тыс.). По техотчёту компании модель инициализирована весами открытой Qwen3, но дообучена на собственных данных, все параметры пересчитаны; токенизация оптимизирована под кириллицу — до 5 символов на токен. По данным вендора, превосходит DeepSeek V3.1 и Qwen3-235B в 60% бизнес-задач; сильные стороны — диалоговые сценарии, работа с документами и редактура текста.

GigaChat 3 LightningДоступна
🇷🇺 Сбер (GigaChat)Открытые веса

Лёгкая открытая модель линейки GigaChat 3: MoE на 10 млрд параметров с 1,8 млрд активных на токен, MLA-сжатие KV-кеша и Multi-Token Prediction (ускорение генерации ~40%, по данным вендора). Контекст — 256 тыс. токенов, причём на длинном контексте модель держит качество стабильнее одноклассников (0,705 на 132 тыс. токенов, по данным вендора). Обучена с нуля на 5,5 трлн синтетических токенов на 10+ языках. Распространяется бесплатно под MIT через Hugging Face и GitVerse; денег вендор за веса не берёт, отдельного тарифа в GigaChat API у Lightning нет (платная сетка API — это GigaChat 2: 0,065–0,65 ₽ за 1000 токенов). В марте 2026 обновлена до версии 3.1; скорость — до 333 токенов/с на vLLM с MTP, квантованная версия запускается даже в бесплатном Colab.

GigaChat 3 UltraДоступна
🇷🇺 Сбер (GigaChat)Открытые веса

Флагманская модель Сбера поколения GigaChat 3: MoE-архитектура на 702 млрд параметров (36 млрд активных на токен) с MLA и Multi-Token Prediction, обучена с нуля на 14 трлн токенов без инициализации зарубежными весами. Контекст — 131 тыс. токенов. Веса открыты под лицензией MIT: preview-версия вышла 21 ноября 2025 года на AI Journey, в марте 2026 заменена улучшенной GigaChat-3.1-Ultra (FP8, ускорение инференса на 38%, по данным вендора). С 15 июля 2026 модель доступна в GigaChat API в режиме freemium для физлиц; отдельных публичных тарифов на Ultra на август 2026 не найдено — платная сетка API строится вокруг линейки GigaChat 2 (от 0,065 ₽ за 1000 токенов у Lite до 0,65 ₽ у Max). На лидерборде MERA версия 3.1 набирает 0,712 — выше GPT-5.2 (0,707), по данным на июль 2026. Самостоятельное развёртывание требует кластера из десятков GPU.

GPT-5.1 (batch)Доступна
🇺🇸 OpenAIПроприетарнаяФронтир

GPT-5.1 (batch) появилась в каталоге OpenRouter 2025-11-13 как отдельная тарифная версия GPT-5.1 для пакетной обработки. Контекст составляет 400 000 токенов. Входные данные стоят 0.625 USD за 1M токенов, результат — 5 USD за 1M токенов. По данным вендора, GPT-5.1 лучше GPT-5 следует инструкциям и справляется с универсальными задачами рассуждения; независимых замеров для версии batch пока нет.

Claude Haiku 4.5Доступна
🇺🇸 AnthropicПроприетарная

Младшая модель линейки Claude, релиз 15 октября 2025. Контекст 200K токенов, цена $1/$5 за 1M токенов. Anthropic позиционирует её как уровень, близкий к Sonnet 4.5, при кратно меньшей цене и большей скорости; на SWE-bench Verified вендор заявлял 73,3%. Целевые сценарии — чувствительные к задержке: клиентские боты, массовая классификация и экстракция, суб-агенты в многоагентных оркестрациях. Параметры не раскрыты.

GPT-5 Pro (batch)Доступна
🇺🇸 OpenAIПроприетарнаяФронтир

GPT-5 Pro (batch) появилась в каталоге OpenRouter 2025-10-06 как отдельная версия GPT-5 Pro для пакетной обработки запросов. Контекстное окно составляет 400 000 токенов. Стоимость через OpenRouter — 7,5 USD за 1M входных и 60 USD за 1M выходных токенов. По данным вендора, модель рассчитана на сложные задачи рассуждения и разработки ПО; независимых замеров пока нет. Архитектура, число параметров, лимит ответа и дата среза знаний не раскрыты.

YandexGPT 5.1 ProДоступна
🇷🇺 Яндекс (Alice AI / YandexGPT)Проприетарная

Старшая модель линейки YandexGPT, доступ для бизнеса открыт 28 августа 2025 года в Yandex Cloud AI Studio. Тариф — 0,40 ₽ за 1000 токенов, втрое дешевле предыдущей версии. Контекст — 128 тыс. токенов (по данным обзоров), есть режим рассуждений: модель тратит внутренние «токены размышлений» на сложные задачи. По данным вендора, выигрывает у GPT-4.1 в 56% случаев на потоке пользовательских и бизнес-задач, превосходит предыдущую версию в 58% случаев, а доля выдуманных и некорректных ответов снижена почти вдвое — до 16%. После запуска семейства Alice AI (ноябрь 2025) остаётся в линейке AI Studio как модель с большим контекстом для документоёмких задач.

Mistral Medium 3.1 (batch)Доступна
🇫🇷 Mistral AIПроприетарная

Mistral Medium 3.1 (batch) появилась в каталоге OpenRouter 2025-08-13 как вариант пакетной обработки запросов с контекстом до 131 072 токенов. Тариф составляет 0,4 USD за 1M входных и 2 USD за 1M выходных токенов. По описанию в каталоге, это обновление Mistral Medium 3 для корпоративных задач; независимых замеров качества пока нет. Архитектура, число параметров, предел ответа и дата среза знаний не раскрыты.

GPT-5 (batch)Доступна
🇺🇸 OpenAIПроприетарнаяФронтир

GPT-5 (batch) появился в каталоге OpenRouter 2025-08-07 как отдельный вариант GPT-5 для пакетной обработки запросов. Контекст модели составляет 400 000 токенов. Стоимость указана на уровне 0,625 USD за 1M входных и 5 USD за 1M выходных токенов. Данные об архитектуре, числе параметров, предельном объёме ответа и границе знаний не раскрыты. Независимых замеров качества этой пакетной версии пока нет.

GPT-5 Mini (batch)Доступна
🇺🇸 OpenAIПроприетарная

GPT-5 Mini (batch) появилась в каталоге OpenRouter 2025-08-07 как отдельный вариант GPT-5 Mini для пакетной обработки запросов. Контекстное окно составляет 400 000 токенов. Стоимость через OpenRouter указана на уровне 0,125 USD за 1M входных и 1 USD за 1M выходных токенов. Сведения об архитектуре, числе параметров, максимальном ответе и дате среза знаний не раскрыты; независимых замеров качества пока нет.

GPT-5 Nano (batch)Доступна
🇺🇸 OpenAIПроприетарная

GPT-5 Nano (batch) появилась в каталоге OpenRouter 2025-08-07 как отдельный пакетный вариант GPT-5 Nano. Контекстное окно составляет 400 000 токенов. Стоимость через OpenRouter — 0,025 USD за 1M входных и 0,20 USD за 1M выходных токенов. Архитектура, число параметров, максимальный объём ответа и независимые результаты испытаний не раскрыты.

gpt-oss-120bДоступна
🇺🇸 OpenAIОткрытые веса

Открытая reasoning-модель OpenAI: MoE на 117 млрд параметров всего при 5,1 млрд активных на токен, релиз 5 августа 2025 под лицензией Apache-2.0. Контекст 128 тыс. токенов, работает с текстом и кодом; веса опубликованы на Hugging Face, техотчёт — на arXiv (2508.10925). По заявлению вендора, модель рассчитана на запуск на одном GPU с 80 ГБ памяти. Первый релиз открытых весов OpenAI со времён GPT-2 (2019); вышла в паре с младшей gpt-oss-20b для локальных сценариев.

GPT-OSS 20B BatchДоступна
🇺🇸 OpenAIОткрытые веса

GPT-OSS 20B Batch появилась в каталоге OpenRouter 2025-08-05 как отдельный пакетный вариант GPT-OSS 20B. Модель имеет 21 млрд параметров, из которых при обработке запроса используются 3,6 млрд, и поддерживает контекст до 131 072 токенов, по данным вендора. Стоимость составляет 0,05 USD за 1M входных и 0,20 USD за 1M выходных токенов. Веса доступны по лицензии Apache 2.0; независимых замеров качества и скорости пакетного варианта пока нет.

Falcon-H1 34BДоступна
🇦🇪 Technology Innovation InstituteОткрытые веса

Старшая модель гибридной линейки Falcon-H1 от Technology Innovation Institute (Абу-Даби): в каждом блоке параллельно работают обычное внимание и Mamba-2 (SSM), причём соотношение головок двух типов настраивается. 34B параметров, контекст 256K, вывод до 16K токенов, срез знаний — 31 марта 2025 года. По данным вендора, инструкт-версия сопоставима с моделями класса 70B, а на длинных последовательностях даёт до 4x по входной и до 8x по выходной пропускной способности против Qwen2.5-32B; независимые сводные замеры в справочниках не зафиксированы. Нативно поддерживает 18 языков, включая русский. Линейка анонсирована в мае 2025 года, полный технический отчёт вышел в конце июля 2025-го; лицензия Falcon LLM License 2.0 на базе Apache 2.0.

o3 (batch)Доступна
🇺🇸 OpenAIПроприетарнаяФронтир

OpenAI o3 (batch) появилась в каталоге OpenRouter 2025-04-16 как отдельная пакетная версия модели o3. Контекст составляет 200 000 токенов. Стоимость через OpenRouter — 1 USD за 1M входных и 4 USD за 1M выходных токенов. По данным вендора, модель рассчитана на задачи программирования, математики, естественных наук, технического письма и анализа изображений; независимых замеров именно пакетной версии пока нет.

o4 Mini (Batch)Доступна
🇺🇸 OpenAIПроприетарная

o4 Mini (Batch) появилась в каталоге OpenRouter 2025-04-16 как отдельный вариант o4 Mini для пакетной обработки. Контекст модели составляет 200 000 токенов. Стоимость через OpenRouter — 0,55 USD за 1M входных и 2,20 USD за 1M выходных токенов. По данным каталога, модель поддерживает работу с текстом, программным кодом и изображениями; независимых замеров этой пакетной версии пока нет.

GPT-4.1 BatchДоступна
🇺🇸 OpenAIПроприетарная

GPT-4.1 Batch — вариант GPT-4.1 для пакетной обработки запросов, появившийся в каталоге OpenRouter. Контекстное окно составляет 1 047 576 токенов. Стоимость через этот маршрут — 1 USD за 1M входных и 4 USD за 1M выходных токенов. По данным OpenAI, семейство GPT-4.1 рассчитано на выполнение инструкций, программирование и обработку длинного контекста; независимых замеров именно пакетного варианта пока нет.

GPT-4.1 Mini (batch)Доступна
🇺🇸 OpenAIПроприетарная

GPT-4.1 Mini (batch) появилась в каталоге OpenRouter как отдельный вариант GPT-4.1 Mini для пакетной обработки запросов. Контекст составляет 1 047 576 токенов. Стоимость указана на уровне 0,20 USD за 1M входных и 0,80 USD за 1M выходных токенов. Данные об архитектуре, числе параметров и максимальном объёме ответа не опубликованы.

GPT-4.1 Nano (Batch)Доступна
🇺🇸 OpenAIПроприетарная

GPT-4.1 Nano (Batch) появилась в каталоге OpenRouter как отдельный вариант GPT-4.1 Nano для пакетной обработки. Контекстное окно составляет 1 047 576 токенов. Стоимость через OpenRouter — 0,05 USD за 1M входных и 0,20 USD за 1M выходных токенов. Данные об архитектуре, числе параметров и максимальном объёме ответа не опубликованы; независимых замеров этой пакетной версии пока нет.

GigaChat 2 MaxДоступна
🇷🇺 Сбер (GigaChat)Проприетарная

Коммерческий флагман GigaChat API для юрлиц: представлен 13 марта 2025 в составе линейки GigaChat 2.0 (Lite / Pro / Max), на момент релиза занимал 1-е место на русскоязычном бенчмарке MERA, опережая DeepSeek-V3 и Qwen2.5. Контекст — 128 тыс. токенов, размер модели вендор не раскрывает. Тариф — 0,65 ₽ за 1000 токенов, вход и выход по одной цене; для сравнения GigaChat 2 Pro — 0,5 ₽, GigaChat 2 Lite — 0,065 ₽ за 1000 токенов (тарифы с 1 февраля 2026, по данным агрегаторов официальной тарифной сетки; сайт developers.sber.ru недоступен из-за рубежа). Есть пакеты токенов для юрлиц и freemium-лимиты, доступно развёртывание on-premise по договору. С 17 июля 2026 модели первого поколения отключены с автоматическим перенаправлением на второе поколение.

YandexGPT 5 LiteДоступна
🇷🇺 Яндекс (Alice AI / YandexGPT)Открытые веса

Лёгкая модель пятого поколения YandexGPT: 8 млрд параметров, плотная архитектура, контекст 32 тыс. токенов. Веса открыты на Hugging Face с начала 2025 года (pretrain- и instruct-версии плюс GGUF-квантования) под собственной лицензией Яндекса — не Apache и не MIT, условия коммерческого использования надо читать в тексте лицензии. Обучена без использования весов сторонних моделей; instruct-версия прошла SFT и RLHF, совпадающие с алайнментом YandexGPT 5 Pro. По данным вендора, на бенчмарках сопоставима с Llama-3.1-8B и Qwen-2.5-7B и превосходит их в ряде русскоязычных сценариев. В облачном API лёгкий тариф Яндекса — от 0,20 ₽ за 1000 токенов, по данным вендора.

o3 Mini (batch)Доступна
🇺🇸 OpenAIПроприетарная

OpenAI o3 Mini (batch) появилась в каталоге OpenRouter 2025-01-31 как отдельная пакетная версия o3 Mini. Контекст модели составляет 200 000 токенов. Стоимость через этот маршрут — 0,55 USD за 1M входных и 2,20 USD за 1M выходных токенов. По данным вендора, модель ориентирована на научные, математические и программные задачи; независимых замеров для этой пакетной версии пока нет.

Ministral 8BУстаревает
🇫🇷 Mistral AIОткрытые веса

Mistral выпустила Ministral 8B 2024-10-09, а официальный анонс опубликовала 2024-10-16. Модель содержит 8 млрд параметров и поддерживает контекст до 128 000 токенов; для отдельных способов запуска на момент анонса действовало ограничение 32 000 токенов. По данным вендора, чередующаяся схема скользящего внимания сокращает требования к памяти и ускоряет работу модели, независимых замеров пока нет. Стартовая цена API составляла 0.10 USD за 1M входных и 0.10 USD за 1M выходных токенов.

GPT-4o mini (batch)Доступна
🇺🇸 OpenAIПроприетарная

GPT-4o mini (batch) появилась в каталоге OpenRouter как отдельная пакетная версия GPT-4o mini. Модель принимает текст и изображения, возвращает текст и поддерживает контекст до 128 000 токенов. Стоимость составляет 0.075 USD за 1M входных и 0.3 USD за 1M выходных токенов по данным OpenRouter. Архитектура, число параметров, предел ответа и дата актуальности знаний не раскрыты; независимых замеров пакетной версии пока нет.

GPT-4o (batch)Доступна
🇺🇸 OpenAIПроприетарная

GPT-4o (batch) появился в каталоге OpenRouter как отдельный вариант GPT-4o для пакетной обработки запросов. Модель принимает текст и изображения, возвращая текст, а заявленный размер контекста составляет 128 000 токенов. Стоимость через OpenRouter указана на уровне 1,25 USD за 1M входных и 5 USD за 1M выходных токенов. Параметры архитектуры, максимальный объём ответа и независимые замеры этой конфигурации не опубликованы.

GPT-4 Turbo (batch)Доступна
🇺🇸 OpenAIПроприетарная

GPT-4 Turbo (batch) появилась в каталоге OpenRouter как отдельная пакетная сборка GPT-4 Turbo. Контекст составляет 128 000 токенов, а данные для обучения, по данным вендора, охватывают период до 2023-12. Модель принимает текст, программный код и изображения; для запросов с изображениями заявлены JSON-режим и вызов функций. Цена указана на уровне 5 USD за 1M входных и 15 USD за 1M выходных токенов. Независимых замеров качества и скорости этой сборки пока нет.

GPT-3.5 Turbo (batch)Доступна
🇺🇸 OpenAIПроприетарная

GPT-3.5 Turbo (batch) появился в каталоге OpenRouter как отдельный вариант для пакетной обработки запросов. Контекстное окно составляет 16 385 токенов, модель работает с текстом и программным кодом. Стоимость через каталог указана на уровне 0,25 USD за 1M входных и 0,75 USD за 1M выходных токенов. Данные обучения ограничены 2021-09; параметры, архитектура и максимальный объём ответа не раскрыты.

Дайджест релизов

Новые модели, цены и честные вердикты — коротко в телеграме, без спама.

Подписаться