🇨🇳 DeepSeek
Китай · моделей в базе: 7 · официальный сайт ↗
DeepSeek выпустила DeepSeek V4.1 Flash 2026-09-10 и открыла доступ через API под именем deepseek-flash. Модель принимает текст и изображения, поддерживает контекст до 1 млн токенов и выдачу до 384 тыс. токенов. Предыдущие DeepSeek V4 Flash и V4 Flash Vision Exp выведены из эксплуатации, а их API-имена временно перенаправляются на новую модель. Веса опубликованы с лицензией MIT; точные сведения об общем и активном числе параметров в проверенных первоисточниках пока не зафиксированы.
DeepSeek V4 Flash Vision Exp Batch появилась в каталоге OpenRouter 2026-08-21 как отдельная пакетная версия экспериментальной модели с анализом изображений. Контекст составляет 1 048 576 токенов. Стоимость указана на уровне 0,11 USD за 1M входных и 0,33 USD за 1M выходных токенов. По данным описания OpenRouter, текстовые возможности соответствуют DeepSeek V4 Flash 0731; независимых замеров пока нет.
Экспериментальная версия DeepSeek V4-Flash с поддержкой изображений, появившаяся 21 августа 2026 года: модель принимает картинки — скриншоты, сканы, фотографии документов — и отвечает текстом. По данным вендора, базой служит производственная сборка 0731, и на текстовых задачах vision-версия ей не уступает; собственные параметры новой версии не раскрыты. Контекст — 1M токенов, лимит ответа — 384K, поддерживается режим рассуждения. Цена в каталоге OpenRouter — $0.22/$0.66 за 1M токенов, при этом в будни действует пиковый тариф вдвое выше: 01:00–04:00 и 06:00–10:00 UTC, по московскому времени это 04:00–07:00 и 09:00–13:00. Весов в открытом доступе нет, работа только через API; официального анонса с бенчмарками DeepSeek пока не публиковала — статус экспериментальный.
Производственная сборка флагмана DeepSeek V4-Pro, выпущенная 13 августа 2026 года взамен апрельского превью 0423, — вендор обозначает её как GA-релиз линейки. Архитектура прежняя: sparse-MoE на 1.6T параметров с 49B активных на токен, контекст 1M токенов; веса опубликованы на Hugging Face под лицензией MIT. Цена в каталоге OpenRouter — $1.32/$3.96 за 1M токенов против $0.87/$1.74 у превью-сборки; лимит ответа — до 943K токенов. Независимые индексы агрегатора Artificial Analysis: 53.2 (интеллект), 68.8 (код), 49.6 (агентные сценарии). Превью-эндпоинт 0423 продолжает работать по прежней цене.
Производственная сборка DeepSeek V4-Flash, выпущенная 31 июля 2026 года взамен апрельского превью. Архитектура и размер не менялись — тот же sparse-MoE на 284B параметров с 13B активных и контекстом 1M токенов; весь прирост дал переработанный пост-трейнинг под кодинг, агентные сценарии, рассуждение и вызов инструментов. По данным вендора, сборка обходит V4-Pro-Preview на всех девяти опубликованных агентных и кодинговых бенчмарках, включая 82.7 на Terminal-Bench 2.1 против 61.8 у превью Flash; независимых воспроизведений на момент релиза мало. API работает на прежнем эндпоинте, добавлена нативная поддержка формата OpenAI Responses и адаптация под Codex CLI. Веса выложены на Hugging Face под MIT, цена по каталогу OpenRouter — $0.06/$0.12 за 1M токенов.
Эффективный компаньон флагманского V4-Pro, представленный 24 апреля 2026 года вместе со всем семейством V4. Sparse-MoE на 284B параметров с 13B активных на токен, контекст 1M токенов; веса открыты на Hugging Face под MIT вместе с техническим отчётом. 20 июля 2026 семейство достигло общей доступности, а 31 июля API-эндпоинт deepseek-v4-flash был переведён на переобученную сборку 0731, которая фактически заменила апрельский чекпоинт. Отдельных бенчмарков именно апрельской версии справочники не фиксируют — актуальные цифры вендор публикует для сборки 0731.
Флагман семейства DeepSeek V4, выпущенный 24 апреля 2026 года: sparse-MoE на 1.6T параметров с 49B активных на токен и контекстом 1M токенов. Веса опубликованы на Hugging Face под лицензией MIT вместе с техническим отчётом — на момент релиза это одна из крупнейших открытых моделей. 20 июля 2026 семейство V4 вышло из превью в общую доступность. Цена API — $0.87/$1.74 за 1M токенов по каталогу OpenRouter, эндпоинт совместим одновременно с форматами OpenAI ChatCompletions и Anthropic. Систематических независимых замеров именно V4-Pro пока немного: агентные таблицы, которые публикует сам вендор, в основном сравнивают сборки внутри линейки.