Кибер-Миша

GLM 5.3 FlashX

Доступна
🇨🇳 Z.ai (Zhipu AI)·КитайОткрытые веса
GLM 5.3 FlashX — ускоренный вариант мультимодальной GLM 5.3 Flash от Z.ai, доступный через API с 2026-09-18. Модель имеет 320 млрд параметров, из которых при работе задействуются 18 млрд, и поддерживает контекст до 1 048 576 токенов. Она принимает текст, изображения и видео, возвращая текстовый ответ длиной до 131 072 токенов. По данным вендора, скорость может достигать 200 токенов в секунду; независимых замеров пока нет.

Для бизнеса: стоит ли брать GLM 5.3 FlashX

Модель подходит для обработки крупных документов, анализа визуальных материалов, программирования и многоэтапной автоматизации, где важна скорость ответа. Обработка 1M входных и 1M выходных токенов стоит 1.62 USD. Риск — фактическая скорость и стабильность могут зависеть от поставщика API и нагрузки; перед внедрением следует провести пилот на собственных данных и зафиксировать требования к времени ответа.

Бенчмарки GLM 5.3 FlashX

Подтверждённых оценок пока нет. Мы не смешиваем заявления вендоров с независимыми замерами — методология.

История версий и событий GLM 5.3 FlashX

18 сен 2026Релиз

GLM 5.3 FlashX появилась в каталоге OpenRouter

OpenRouter добавил ускоренный вариант GLM 5.3 FlashX с контекстом 1 048 576 токенов. Цена составляет 0.37 USD за 1M входных и 1.25 USD за 1M выходных токенов. По данным вендора, предельная скорость достигает 200 токенов в секунду; независимых замеров пока нет.

Первоисточник ↗

Частые вопросы про GLM 5.3 FlashX

Сколько стоит GLM 5.3 FlashX?

Через API — $0.37 за миллион входящих токенов и $1.25 за миллион исходящих, то есть ≈ 33 ₽ и ≈ 113 ₽ по курсу 90 ₽/$. Это списочная цена вендора: посредники и агрегаторы добавляют свою наценку. Веса GLM 5.3 FlashX открыты, поэтому платить за API необязательно — модель можно развернуть на своём железе и платить только за него.

Когда вышла GLM 5.3 FlashX?

GLM 5.3 FlashX вышла 18 сентября 2026, разработчик — Z.ai (Zhipu AI). Все последующие обновления модели мы фиксируем в истории событий на этой странице.

Какой контекст у GLM 5.3 FlashX?

Контекстное окно — 1.0M токенов, максимальный ответ — до 131K токенов. На практике это означает, что за один запрос модель удерживает примерно 749 страниц текста.

Сколько параметров у GLM 5.3 FlashX?

320B параметров, из них активных при генерации — 18B (архитектура Mixture-of-Experts: работает не вся модель сразу, поэтому запрос считается быстрее и дешевле).

Можно ли развернуть GLM 5.3 FlashX у себя?

Да. Веса GLM 5.3 FlashX выложены публично под лицензией MIT, их можно скачать и запустить на своём сервере — данные не уходят наружу. Это главный аргумент для компаний, которым нельзя отдавать документы во внешний сервис.

Доступна ли GLM 5.3 FlashX в России?

Да. Китайские провайдеры не ограничивают доступ по региону, а открытые веса GLM 5.3 FlashX вдобавок можно развернуть на своём сервере. Сложность остаётся только с оплатой — российские карты напрямую обычно не проходят.

Цена GLM 5.3 FlashX: доллары и рубли за 1M токенов

Ввод$0.37≈ 33 ₽
Вывод$1.25≈ 113 ₽

Рубли — по курсу 90 ₽/$ на 15 августа 2026. Списочные цены вендора; у агрегаторов для РФ будет наценка.

Характеристики GLM 5.3 FlashX

ЛицензияMIT
ДоступОткрытые веса
АрхитектураMoE
Параметры320B
Активные параметры18B
Контекст1.0M токенов
Макс. вывод131K токенов
Знания до—
МодальностиТекст, Код, Зрение, Видео
Релиз18 сен 2026