DiffusionGemma 26B-A4B
ДоступнаПервая открытая текстово-диффузионная модель Google, выпущенная 10 июня 2026 года на базе Gemma 4 26B-A4B. Вместо автогенеративного вывода по одному токену модель параллельно «расшумляет» блоки по 256 токенов; по данным вендора, это даёт свыше 1000 токенов/с на одном H100 и свыше 700 токенов/с на RTX 5090 — до 4 раз быстрее сравнимых авторегрессионных моделей. MoE-архитектура: 25,2 млрд параметров всего, около 3,8 млрд активных на шаг; контекст 256 тыс. токенов, на входе текст, изображения и видео. Лицензия Apache-2.0, инструктивные веса на Hugging Face; после квантизации помещается примерно в 18 ГБ VRAM. Модель экспериментальная, независимых замеров качества пока нет.
Для бизнеса
Интересна там, где узкое место — скорость генерации, а не качество рассуждений; для продакшена пока стоит считать её исследовательской.
Бенчмарки
Подтверждённых оценок пока нет. Мы не смешиваем заявления вендоров с независимыми замерами — методология.
История событий
10 июн 2026Релиз
Релиз DiffusionGemma 26B-A4B
Первая открытая text-diffusion модель Google; веса на Hugging Face под Apache-2.0.
Первоисточник ↗Цена API · за 1M токенов
Публичной цены API нет.
Спецификации
ЛицензияApache-2.0
ДоступOpen source
АрхитектураMoE
Параметры25.2B
Активные параметры3.8B
Контекст262K токенов
Макс. вывод—
Знания до—
МодальностиТекст, Код, Зрение, Видео
Релиз10 июн 2026