Модели/GLM 5.3 Flash

GLM 5.3 Flash

Z AI
textproprietary
разработчик Z AI релиз 26.08.2026 лицензия Proprietary

Модель GLM 5.3 Flash от Z AI с индексом интеллекта 41.8. Контекстное окно — 1 млн токенов, скорость вывода около 89 токенов/с. Стоимость — $0.15 за 1М входных и $0.5 за 1М выходных токенов.

Ключевые метрикиverified
AIKraft Index41.8#30 из 642
Контекст1mтокенов
Output speed89.0 t/sизмерено
TTFT2.4 sизмерено
Blended цена₽20$0.24 / 1M
МодальностьТекстоваябез рассуждения

Обзор

GLM-5.3-Flash — модель от Z AI. Подходит для генерации и обработки текста, диалоговых сценариев и прикладных задач с невысокой задержкой.

Контекстное окно — 1 млн токенов, скорость вывода — ~90 токенов/с. Композитный индекс интеллекта — 41.8 из 100#29 из 640 в рейтинге AIKraft. Доступ из РФ — через сторонние прокси-сервисы. Цена — $0.15 за 1M входных и $0.5 за 1M выходных токенов.

Бенчмарки

Результаты на эвалах
Coding Index: 71.5
БенчмаркЗначение
GPQA Diamond91.2%
Terminal-Bench v2.184.3%
LCR80%
SciCode51.6%
τ-bench Banking47.2%
HLE39.9%
41.8/ 100место в рейтинге#30
композитный индекс · вклад эвалов
GPQA Diamond91
Terminal-Bench v2.184
LCR80
SciCode52
τ-bench Banking47
HLE40
взвешенная композиция реальных эваловметодология →

Производительность и цена

Скорость, стоимость и положение на Pareto-фронте
скорость и TTFT — измеренные значения, не заявленные вендором
Скорость
89.0 t/s
Output speed
2.4 s
TTFT
Контекстное окно
1m заявленный контекст
Цена за 1M токенов
Input входные$0.15₽13
Output выходные$0.50₽42
Blended 3:1$0.24₽20
курс ЦБ РФ · $1 = ₽84.1
Калькулятор стоимости в ₽
M ток.
M ток.
≈ стоимость в месяц
Pareto-фронт среди соседей
GLM 5.3 Flash соседи пунктир — Pareto-граница

Провайдеры / API

Где доступна модель: цены, контекст и аптайм по хостерам
▲ — лучшее значение · данные: OpenRouter (цены, контекст, аптайм 24ч) и Artificial Analysis (скорость и TTFT офиц. API)
Из России напрямую работает 5 из 12 провайдеров этой модели. Колонка «Из РФ» — наша собственная проверка от 19.08.2026: запрос к API провайдера с российского IP плюс сверка с официальным списком поддерживаемых стран вендора. Проверяется сетевой доступ и политика вендора, а не возможность оплаты российской картой.
ПровайдерInput $/1MOutput $/1MСкоростьTTFTКонтекстАптайм 24чИз РФ
Z AI офиц. API $0.15 $0.50 89.0 t/s 2.4 s 1M 99.7% да
OpenInference $0.07 $0.25 1M 99.8%
GMICloud $0.07 $0.25 1M 98.4% да
DeepInfra $0.07 $0.25 1M 99.0% да
Morph $0.08 $0.28 1M 99.9%
InferenceNet $0.09 $0.28 1M 96.0%
Relace $0.09 $0.30 1M 99.8%
Wafer $0.10 $0.35 1M 99.8%
Phala $0.13 $0.42 1M 98.8% да
Novita $0.13 $0.44 1M 99.4% да
StreamLake $0.14 $0.47 1M 99.2%
Sail Research $0.14 $0.47 1M 99.5%

Сравнения и подборки

Прямые сравнения с конкурентами и подборки, в которые входит GLM 5.3 Flash
против Claude Fable 5.1против GPT-6 Astraпротив Claude Opus 5против Claude Fable 5против Muse Spark 1.3против GPT-5.6 Solпротив Grok 4.7против GLM-5.3Самые дешёвые AI-моделиМодели с длинным контекстом Все сравненияКаталог моделей
Нужна эта модель в вашей компании?
Развернём её (self-host или API), подключим под ваши задачи и обучим команду. Бесплатный ИИ-аудит — 30 минут.
Получить аудит

Сравнение

Похожие модели
ближайшие по AIKraft Index · radar по реальным эвалам
МодельIndexКодКонтекстЦена $/1MСкорость
Kimi K343.6761.0m$639
Grok 4.642.874500k$371
GPT-5.6 Sol42.3771m$867
GPT-5.6 Terra42.1771m$4.5107
GLM 5.3 Flash41.8721m$0.2489
Claude Opus 4.841.8741m$100
Gemini 3.8 Flash40.9761m$1.5371
Claude Opus 4.740.7741m$100
Qwen3.8 Max40.2721m$30
GLM 5.3 Flash41.8
Claude Opus 4.841.8
GPT-5.6 Terra42.1