Кибер-Миша
Лаборатория

🇺🇸 Google DeepMind

США · моделей в базе: 20 · официальный сайт ↗

Gemini 3.8 Flash (batch)Доступна
🇺🇸 Google DeepMindПроприетарная

Gemini 3.8 Flash (batch) появилась в каталоге OpenRouter 2026-09-02 как отдельная модель для пакетной обработки запросов. Контекстное окно составляет 1 048 576 токенов. Стоимость через OpenRouter — 0.375 USD за 1M входных и 1.875 USD за 1M выходных токенов. По данным вендора, модель улучшена относительно Gemini 3.7 Flash в задачах разработки ПО, многоэтапного рассуждения и работы с автономными сценариями; независимых замеров пока нет.

Gemini 3.8 Flash CyberДоступна
🇺🇸 Google DeepMindПроприетарная

Google DeepMind выпустила Gemini 3.8 Flash Cyber 2026-09-02 как специализированную модель для поиска и исправления уязвимостей. Доступ предоставляется проверенным государственным структурам, операторам критической инфраструктуры и разработчикам программного обеспечения через Fairwind Program. По данным вендора, модель получила 47,2% на CWE-Bench и свыше 70% успешных решений во внутренней проверке на проектах с 20 языками программирования. Независимых замеров производительности и точных данных о стоимости пока нет.

Gemini 3.8 FlashДоступна
🇺🇸 Google DeepMindПроприетарная

Google DeepMind выпустила Gemini 3.8 Flash 2026-09-02 как следующую версию Gemini 3.7 Flash. Модель принимает текст, код, изображения, аудио и видео, поддерживает контекст до 1 048 576 токенов и формирует до 65 536 токенов текста. По данным вендора, основные улучшения относятся к разработке программного обеспечения, многоэтапным задачам и работе с корпоративными знаниями; независимых замеров пока нет. Архитектура и число параметров не раскрыты.

Gemini Omni 1.1 FlashПревью
🇺🇸 Google DeepMindПроприетарная

Google выпустила Gemini Omni 1.1 Flash в предварительном доступе 2026-08-27. Модель принимает текст, изображения, аудио и видео, а возвращает текст, изображения и видео со звуком. Контекст составляет 131 072 токена, максимальный объём результата — 57 920 токенов. Поддерживаются создание, редактирование и продолжение видео длительностью до 10 секунд с разрешением до 4K; параметры архитектуры и независимые замеры качества пока не опубликованы.

Gemini 3.5 TranscribeПревью
🇺🇸 Google DeepMindПроприетарная

Google представила Gemini 3.5 Transcribe 2026-08-26 и открыла модель в публичном предварительном доступе через Gemini API. Она преобразует записанную или потоковую речь в текст, автоматически определяет более 85 языков и поддерживает смену языка внутри разговора. Для записей доступны разделение реплик до 8 собеседников и временные метки на уровне слов; при включении этих функций максимальная длительность файла сокращается с 60 до 30 минут. Потоковая версия работает с сессиями продолжительностью до 10 минут. По данным Google со ссылкой на Artificial Analysis, доля ошибочно распознанных слов составляет 4,0% для потоковой и 2,6% для файловой обработки; независимых замеров полного набора функций пока нет.

Gemini 3.7 FlashДоступна
🇺🇸 Google DeepMindПроприетарная

Google выпустила новый Flash всего через три недели после Gemini 3.6 Flash — беспрецедентно короткий цикл, который выглядит как работа над ошибками: 3.6 сообщество встретило холодно из-за отсутствия роста качества. У 3.7 картина другая: в пользовательском рейтинге веб-разработки модель скакнула с 19-го на 8-е место, а цена упала в четыре раза относительно 3.6 — $0.375/$1.875 за миллион токенов при контексте 1M. Официальной таблицы замеров и техотчёта на момент выхода нет; есть батч-режим с ещё вдвое меньшей ценой.

Gemini 3.5 Flash CyberПревью
🇺🇸 Google DeepMindПроприетарная

Специализированная ветка Gemini 3.5 Flash для поиска и исправления уязвимостей в коде, представленная 21 июля 2026 года. Работает внутри агента CodeMender; из-за двойного назначения Google не выводит её в общий доступ — модель раздаётся только правительствам и проверенным партнёрам в рамках закрытого пилота. Модальности — текст и код, контекст 1 млн токенов; цены не раскрыты, бенчмарков нет. Заявление вендора, что модель находит уязвимости дешевле в пересчёте на токен, чем крупные модели, независимо не проверялось.

Gemini 3.5 Flash-LiteДоступна
🇺🇸 Google DeepMindПроприетарная

Самая дешёвая модель ветки 3.5 — $0,30/$2,50 за 1 млн токенов — выпущена 21 июля 2026 года вместе с Gemini 3.6 Flash. Рассчитана на поточные задачи: агентный поиск, разбор документов, массовую классификацию; контекст 1 млн токенов, заявленная скорость порядка 350 токенов/с. По данным вендора, опережает полновесную Gemini 3 Flash прошлого поколения: 54,2% против 49,6% на SWE-Bench Pro и 74,0% против 65,1% на OSWorld-Verified. Независимых замеров пока нет. Доступна в Gemini API и работает внутри поиска Google.

Gemini 3.6 FlashДоступна
🇺🇸 Google DeepMindПроприетарная

Рабочая модель flash-уровня, выпущенная 21 июля 2026 года одновременно с Gemini 3.5 Flash-Lite и Flash Cyber. Сменила Gemini 3.5 Flash в Gemini API, AI Studio, приложении Gemini и Antigravity; контекст 1 млн токенов, срез знаний — март 2026. По данным вендора, тратит примерно на 17% меньше выходных токенов на ту же задачу и поднимает DeepSWE с 37% до 49%, MLE-Bench с 49,7% до 63,9%, OSWorld-Verified с 78,4% до 83,0%. Выход подешевел относительно 3.5 Flash с $9,00 до $7,50 за 1 млн токенов при той же цене входа $1,50. Независимых замеров пока нет.

Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image)Доступна
🇺🇸 Google DeepMindПроприетарная

Nano Banana 2 Lite, представленная в каталоге как Gemini 3.1 Flash Lite Image, появилась в OpenRouter 2026-06-30. Модель принимает текстовые запросы и предназначена для быстрого создания изображений; размер контекста составляет 65 536 токенов. Стоимость через OpenRouter указана на уровне 0,25 USD за 1M входных и 1,50 USD за 1M выходных токенов. Параметры архитектуры, размер модели, максимальный объём ответа и граница знаний не раскрыты. Заявления о скорости и экономичности приведены по данным вендора, независимых замеров пока нет.

Gemini 3 Pro ImageДоступна
🇺🇸 Google DeepMindПроприетарная

Gemini 3 Pro Image, также представленная как Nano Banana Pro, появилась в каталоге OpenRouter 2026-06-18 как отдельная стабильная модель для создания и редактирования изображений. Через OpenRouter заявлено контекстное окно 131 072 токена и цена 2 USD за 1M входных и 12 USD за 1M выходных токенов. Модель принимает текст и изображения, поддерживает управление композицией, локальные правки и создание материалов в разрешении до 4K. Все характеристики качества приведены по данным Google; сопоставимых независимых замеров стабильной версии пока нет.

DiffusionGemma 26B-A4BДоступна
🇺🇸 Google DeepMindOpen source

Первая открытая текстово-диффузионная модель Google, выпущенная 10 июня 2026 года на базе Gemma 4 26B-A4B. Вместо автогенеративного вывода по одному токену модель параллельно «расшумляет» блоки по 256 токенов; по данным вендора, это даёт свыше 1000 токенов/с на одном H100 и свыше 700 токенов/с на RTX 5090 — до 4 раз быстрее сравнимых авторегрессионных моделей. MoE-архитектура: 25,2 млрд параметров всего, около 3,8 млрд активных на шаг; контекст 256 тыс. токенов, на входе текст, изображения и видео. Лицензия Apache-2.0, инструктивные веса на Hugging Face; после квантизации помещается примерно в 18 ГБ VRAM. Модель экспериментальная, независимых замеров качества пока нет.

Gemma 4 12BДоступна
🇺🇸 Google DeepMindOpen source

Открытая 12-миллиардная модель, выпущенная 3 июня 2026 года как дополнение к апрельской линейке Gemma 4. Главное отличие — безэнкодерная мультимодальность: изображения и звук проецируются напрямую в основной стек, что снижает задержку и потребление памяти; это первая средняя Gemma с нативным аудиовходом. Контекст 256 тыс. токенов, лицензия Apache-2.0, веса опубликованы на Hugging Face. По данным вендора, работает на ноутбуке с 16 ГБ памяти; независимых бенчмарков в справочниках пока не зафиксировано.

Gemini 3.1 Flash ImageДоступна
🇺🇸 Google DeepMindПроприетарная

Gemini 3.1 Flash Image, также известная как Nano Banana 2, — модель Google DeepMind для генерации и редактирования изображений по текстовым, графическим и видеоматериалам. Стабильная версия стала доступна через Gemini API 2026-05-28; размер контекста составляет 131 072 токена, предельный объём ответа — 32 768 токенов. Поддерживаются изображения разрешением 512, 1K, 2K и 4K, поиск актуальных данных в интернете и последовательное редактирование в диалоге. Улучшения качества, согласованности объектов и отображения текста заявлены по данным вендора; независимых замеров пока нет.

Gemini 3.5 FlashДоступна
🇺🇸 Google DeepMindПроприетарная

Быстрая модель линейки 3.5, показанная на Google I/O 19 мая 2026 года и сразу запущенная в Gemini API, приложении Gemini и AI Mode поиска Google. Контекст 1 млн токенов, вывод до 65,5 тыс., цена $1,50/$9,00 за 1 млн токенов входа/выхода. По данным вендора, обходит Gemini 3.1 Pro в коде и вызове инструментов при примерно четырёхкратной скорости; независимых замеров не зафиксировано. С 21 июля 2026 фактически вытеснена Gemini 3.6 Flash с более дешёвым выходом.

Gemini 3.5 ProПревью
🇺🇸 Google DeepMindПроприетарная

Флагман линейки Gemini 3.5, анонсированный на Google I/O 19 мая 2026 года, но до сих пор не вышедший в общий доступ. Заявлены MoE-архитектура, контекст 2 млн токенов и упор на глубокое мультимодальное рассуждение; срез знаний — январь 2026. Обещанный на июнь запуск сорван: 21 июля Google ограничился формулировкой «тестируем с партнёрами», модель видна только в Antigravity и LMArena. Цены не объявлены, бенчмарков нет — кроме заявлений вендора, оценивать пока нечего.

Gemini 3.1 Flash LiteДоступна
🇺🇸 Google DeepMindПроприетарная

Gemini 3.1 Flash Lite появилась в каталоге OpenRouter 2026-05-07 как проприетарная мультимодальная модель Google для высоконагруженных сценариев. Контекстное окно составляет 1 048 576 токенов, а заявленные форматы входных данных включают текст, изображения, аудио, видео и PDF. Стоимость через OpenRouter — 0,25 USD за 1M входных и 1,50 USD за 1M выходных токенов. Архитектура, число параметров, предел ответа и дата отсечения знаний не раскрыты; независимых замеров качества и скорости пока нет.

Gemma 4 26B A4B ITДоступна
🇺🇸 Google DeepMindОткрытые веса

Google DeepMind выпустила инструктивную модель Gemma 4 26B A4B IT 2026-04-03. Архитектура MoE содержит 25,2 млрд параметров, из которых при обработке каждого фрагмента текста задействуются 3,8 млрд, по данным вендора. Модель принимает текст, изображения и видео, возвращает текст и поддерживает контекст до 262 144 токенов. Максимальный ответ составляет 32 768 токенов; независимых замеров качества и производительности пока недостаточно для оценки преимуществ в рабочих сценариях.

Gemma 4 31BДоступна
🇺🇸 Google DeepMindOpen source

Старшая плотная модель семейства Gemma 4, вышедшего 2 апреля 2026 года четырьмя размерами (E2B, E4B, 26B MoE, 31B dense); с этого поколения Gemma впервые перешла на лицензию Apache-2.0. Позиционируется как открытая модель для продвинутого рассуждения на персональных компьютерах. На момент релиза занимала третье место среди открытых моделей в текстовом рейтинге LMArena — по данным вендора. 31 млрд параметров, модальности — текст, изображения, код; размер контекста в справочниках не зафиксирован. Веса доступны на Hugging Face и в AI Studio.

Gemini 3.1 ProДоступна
🇺🇸 Google DeepMindПроприетарная

Действующий флагман Google, выпущенный 19 февраля 2026 года как промежуточный апгрейд Gemini 3 Pro — первый случай использования номера «.1» в линейке Gemini. MoE-архитектура, контекст 2 млн токенов, вывод до 65,5 тыс. токенов, срез знаний — сентябрь 2025, нативная работа с инструментами. По данным вендора, набирает 77,1% на ARC-AGI-2 — более чем вдвое выше Gemini 3 Pro — и 84,2% на MMMU; независимых подтверждений в справочниках нет. Доступен в Gemini API, Vertex AI, приложении Gemini, NotebookLM и Gemini CLI. Пока Gemini 3.5 Pro не вышла из партнёрского тестирования, остаётся самой сильной общедоступной моделью Google.