GLM-5.3-Flash
ДоступнаФронтирДля бизнеса: стоит ли брать GLM-5.3-Flash
Модель подходит компаниям, которым нужны анализ крупных репозиториев, автоматизация длительных инженерных задач и обработка изображений без передачи данных закрытому поставщику. Через OpenRouter работа стоит 0.075 USD за 1M входных и 0.25 USD за 1M выходных токенов. Главный риск при развертывании у себя — размер весов: несмотря на 18 млрд активных параметров, хранить и обслуживать нужно модель на 320 млрд параметров; до закупки оборудования следует проверить доступные форматы сжатия, скорость и качество на собственных задачах.
Бенчмарки GLM-5.3-Flash
История версий и событий GLM-5.3-Flash
Цена API изменилась: $0.03/0.9 → $0.15/0.5 за 1M токенов
Изменение зафиксировано по каталогу агрегатора OpenRouter.
Первоисточник ↗Цена API изменилась: $0.15/0.5 → $0.04/0.5 за 1M токенов
Изменение зафиксировано по каталогу агрегатора OpenRouter.
Первоисточник ↗Цена API изменилась: $0.15/0.5 → $0.04/0.5 за 1M токенов
Изменение зафиксировано по каталогу агрегатора OpenRouter.
Первоисточник ↗Цена API изменилась: $0.03/0.9 → $0.04/0.5 за 1M токенов
Изменение зафиксировано по каталогу агрегатора OpenRouter.
Первоисточник ↗Цена API изменилась: $0.04/0.5 → $0.02/0.5 за 1M токенов
Изменение зафиксировано по каталогу агрегатора OpenRouter.
Первоисточник ↗Цена API изменилась: $0.15/0.5 → $0.03/0.9 за 1M токенов
Изменение зафиксировано по каталогу агрегатора OpenRouter.
Первоисточник ↗Цена API изменилась: $0.04/0.14 → $0.04/0.5 за 1M токенов
Изменение зафиксировано по каталогу агрегатора OpenRouter.
Первоисточник ↗Цена API изменилась: $0.15/0.5 → $0.04/0.5 за 1M токенов
Изменение зафиксировано по каталогу агрегатора OpenRouter.
Первоисточник ↗Цена API изменилась: $0.15/0.5 → $0.04/0.6 за 1M токенов
Изменение зафиксировано по каталогу агрегатора OpenRouter.
Первоисточник ↗Цена API изменилась: $0.04/0.6 → $0.04/0.14 за 1M токенов
Изменение зафиксировано по каталогу агрегатора OpenRouter.
Первоисточник ↗Цена API изменилась: $0.15/0.5 → $0.04/0.6 за 1M токенов
Изменение зафиксировано по каталогу агрегатора OpenRouter.
Первоисточник ↗Цена API изменилась: $0.07/0.25 → $0.06/0.2 за 1M токенов
Изменение зафиксировано по каталогу агрегатора OpenRouter.
Первоисточник ↗Цена API изменилась: $0.15/0.5 → $0.09/0.3 за 1M токенов
Изменение зафиксировано по каталогу агрегатора OpenRouter.
Первоисточник ↗Цена API изменилась: $0.07/0.25 → $0.1/0.33 за 1M токенов
Изменение зафиксировано по каталогу агрегатора OpenRouter.
Первоисточник ↗Цена API изменилась: $0.15/0.5 → $0.1/0.33 за 1M токенов
Изменение зафиксировано по каталогу агрегатора OpenRouter.
Первоисточник ↗Цена API изменилась: $0.1/0.33 → $0.09/0.3 за 1M токенов
Изменение зафиксировано по каталогу агрегатора OpenRouter.
Первоисточник ↗Цена API изменилась: $0.07/0.25 → $0.07/0.23 за 1M токенов
Изменение зафиксировано по каталогу агрегатора OpenRouter.
Первоисточник ↗Цена API изменилась: $0.07/0.23 → $0.07/0.25 за 1M токенов
Изменение зафиксировано по каталогу агрегатора OpenRouter.
Первоисточник ↗Цена API изменилась: $0.07/0.25 → $0.15/0.5 за 1M токенов
Изменение зафиксировано по каталогу агрегатора OpenRouter.
Первоисточник ↗Цена API изменилась: $0.15/0.5 → $0.07/0.25 за 1M токенов
Изменение зафиксировано по каталогу агрегатора OpenRouter.
Первоисточник ↗Zhipu выпустила открытые веса GLM-5.3-Flash
Zhipu выпустила GLM-5.3-Flash с 320 млрд параметров, из которых активны 18 млрд. Модель поддерживает изображения, программный код и контекст до 1 млн токенов. Веса опубликованы по лицензии MIT, а для развёртывания заявлена поддержка SGLang, vLLM и TokenSpeed. Результат около 206 токенов в секунду на DGX Station GB300 остаётся неподтверждённым пользовательским замером и в карточку не включён.
Первоисточник ↗Z.ai выпустила открытую мультимодальную модель GLM-5.3-Flash
Z.ai представила GLM-5.3-Flash с 320 млрд параметров, из которых при работе задействуются 18 млрд. Модель принимает текст и изображения, ориентирована на программирование и длительные многоэтапные задачи. Веса опубликованы по лицензии MIT, поэтому модель можно развернуть у себя. Заявленные результаты тестов предоставлены вендором; независимых замеров пока нет.
Первоисточник ↗Z.ai выпустила открытые веса GLM-5.3-Flash
Z.ai опубликовала веса GLM-5.3-Flash на Hugging Face под лицензией MIT. Модель получила 320 млрд параметров, 18 млрд активных параметров, встроенную работу с изображениями и контекст до 1 млн токенов. Для развертывания у себя заявлена поддержка SGLang, vLLM и TokenSpeed.
Первоисточник ↗Z.ai выпустила GLM-5.3-Flash с открытыми весами
Z.ai открыла доступ к GLM-5.3-Flash и опубликовала веса модели под лицензией MIT. Модель содержит 320 млрд параметров, из которых при работе активируются 18 млрд, и принимает текст и изображения. По данным вендора, новая гибридная архитектура снижает вычислительные затраты по сравнению с GLM-5.3 и поддерживает контекст до 1 млн токенов. Независимых замеров производительности и требований к инфраструктуре пока нет.
Первоисточник ↗Z.ai выпустила GLM-5.3-Flash с открытыми весами
2026-08-26 Z.ai официально выпустила GLM-5.3-Flash и открыла веса модели под лицензией MIT. Модель получила 320 млрд параметров, из которых при работе задействуются 18 млрд, поддержку изображений и контекст до 1 млн токенов. Все опубликованные результаты тестов предоставлены Z.ai; независимых замеров пока нет.
Первоисточник ↗Zhipu выпустила GLM-5.3-Flash с открытыми весами
Zhipu официально выпустила GLM-5.3-Flash, ранее проходившую закрытое тестирование под именем Ox Alpha. Модель получила 320 млрд параметров при 18 млрд активных, мультимодальный ввод и контекст до 1 048 576 токенов. Веса доступны на Hugging Face по лицензии MIT, а для развертывания у себя заявлена поддержка SGLang, vLLM, TokenSpeed и KTransformers. Представленные результаты тестов получены или собраны вендором; независимых замеров пока нет.
Первоисточник ↗Z.ai выпустила GLM-5.3-Flash с открытыми весами
Z.ai перевела GLM-5.3-Flash в статус доступной модели 2026-08-26. Опубликованы веса по лицензии MIT и заявлена поддержка развертывания через SGLang, vLLM и TokenSpeed. Модель насчитывает 320 млрд параметров при 18 млрд активных и поддерживает контекст до 1 млн токенов. Результаты тестов опубликованы самим вендором, независимых замеров пока нет.
Первоисточник ↗GLM-5.3-Flash вышла с открытыми весами и контекстом 1 млн токенов
Zhipu открыла API и веса GLM-5.3-Flash 2026-08-26. Модель включает 320 млрд параметров при 18 млрд используемых во время работы и распространяется по лицензии MIT. Контекст достигает 1 млн токенов, заявлена работа с текстом, кодом, изображениями и видео. До 2026-09-09 действует скидка 50%; показатели качества приведены по данным вендора, независимых замеров пока недостаточно.
Первоисточник ↗Z.ai открыла веса GLM-5.3-Flash на Hugging Face
Z.ai опубликовала веса GLM-5.3-Flash на Hugging Face 2026-08-25, переведя существующую модель в статус доступной для самостоятельного развёртывания. Карточка указывает 320 млрд параметров, 18 млрд активных параметров, мультимодальную работу и лицензию MIT. Поддерживаются SGLang, vLLM, TokenSpeed и KTransformers. Заявленные преимущества перед GLM-5.2 приведены самим вендором; независимых замеров пока нет.
Первоисточник ↗Z.ai опубликовала открытые веса GLM-5.3-Flash
Z.ai разместила на Hugging Face контрольную точку GLM-5.3-Flash в формате BF16 под лицензией MIT. По данным вендора, модель содержит 320 млрд параметров, из которых при работе используются 18 млрд. Она принимает текст и изображения, а также ориентирована на программирование; независимых замеров качества и требований к оборудованию пока нет.
Первоисточник ↗Частые вопросы про GLM-5.3-Flash
Сколько стоит GLM-5.3-Flash?
Через API — $0.15 за миллион входящих токенов и $0.5 за миллион исходящих, то есть ≈ 14 ₽ и ≈ 45 ₽ по курсу 90 ₽/$. Это списочная цена вендора: посредники и агрегаторы добавляют свою наценку. Веса GLM-5.3-Flash открыты, поэтому платить за API необязательно — модель можно развернуть на своём железе и платить только за него.
Когда вышла GLM-5.3-Flash?
GLM-5.3-Flash вышла 26 августа 2026, разработчик — Z.ai (Zhipu AI). Все последующие обновления модели мы фиксируем в истории событий на этой странице.
Какой контекст у GLM-5.3-Flash?
Контекстное окно — 1M токенов. На практике это означает, что за один запрос модель удерживает примерно 714 страниц текста.
Сколько параметров у GLM-5.3-Flash?
320000000000 параметров, из них активных при генерации — 18000000000 (архитектура Mixture-of-Experts: работает не вся модель сразу, поэтому запрос считается быстрее и дешевле).
Можно ли развернуть GLM-5.3-Flash у себя?
Да. Веса GLM-5.3-Flash выложены публично под лицензией MIT, их можно скачать и запустить на своём сервере — данные не уходят наружу. Это главный аргумент для компаний, которым нельзя отдавать документы во внешний сервис.
Доступна ли GLM-5.3-Flash в России?
Да. Китайские провайдеры не ограничивают доступ по региону, а открытые веса GLM-5.3-Flash вдобавок можно развернуть на своём сервере. Сложность остаётся только с оплатой — российские карты напрямую обычно не проходят.
Цена GLM-5.3-Flash: доллары и рубли за 1M токенов
Рубли — по курсу 90 ₽/$ на 15 августа 2026. Списочные цены вендора; у агрегаторов для РФ будет наценка.