Модели/GLM-4.7-Flash (Reasoning)

GLM-4.7-Flash (Reasoning) Reasoning

Z AI
textreasoningproprietary
разработчик Z AI релиз 19.01.2026 лицензия Proprietary

Модель GLM-4.7-Flash от Z AI с индексом интеллекта 14.9. Поддерживает пошаговые рассуждения, контекстное окно — 200 тыс. токенов, скорость вывода около 0 токенов/с. Стоимость — $0.07 за 1М входных и $0.4 за 1М выходных токенов.

Ключевые метрикиоценка
AIKraft Index14.9#276 из 669
Контекст200kтокенов
Output speed0.0 t/sизмерено
TTFT0.0 sизмерено
Blended цена₽13$0.15 / 1M
МодальностьТекстоваяс рассуждением

Обзор

GLM-4.7-Flash — модель от Z AI. Ориентирована на задачи, где важны глубина рассуждений и длинный горизонт: агентное программирование, анализ больших кодовых баз, научный ресёрч и многошаговая работа с инструментами.

Контекстное окно — 200 тыс. токенов, скорость вывода — ~0 токенов/с. Композитный индекс интеллекта — 14.9 из 100 — #275 из 669 в рейтинге AIKraft. Доступ из РФ — через сторонние прокси-сервисы. Цена — $0.07 за 1M входных и $0.4 за 1M выходных токенов.

Уровни рассуждений

GLM-4.7-Flash — уровни reasoning
разные уровни усилий одной модели · каждый — отдельная карточка
УровеньIntelligenceЦена in/out $/1MКонтекстСкорость t/s
Non-reasoning10.6$0.07 / $0.4200k0↗
Reasoning · эта страница14.9$0.07 / $0.4200k0•

Бенчмарки

Результаты на эвалах
БенчмаркЗначение
τ²-bench98.8%
IFBench60.8%
GPQA Diamond58.1%
LCR41.7%
Terminal-Bench Hard22%
HLE7.6%
14.9/ 100место в рейтинге#276
композитный индекс · вклад эвалов
τ²-bench99
IFBench61
GPQA Diamond58
LCR42
Terminal-Bench Hard22
HLE8
взвешенная композиция реальных эваловметодология →

Производительность и цена

Скорость, стоимость и положение на Pareto-фронте
скорость и TTFT — измеренные значения, не заявленные вендором
Скорость
0.0 t/s
Output speed
0.0 s
TTFT
Контекстное окно
200k заявленный контекст
Цена за 1M токенов
Input входные$0.07₽6
Output выходные$0.40₽33
Blended 3:1$0.15₽13
курс ЦБ РФ · $1 = ₽83.48
Калькулятор стоимости в ₽
M ток.
M ток.
≈ стоимость в месяц—
Pareto-фронт среди соседей
GLM-4.7-Flash соседи пунктир — Pareto-граница

Провайдеры / API

Где доступна модель: цены, контекст и аптайм по хостерам
▲ — лучшее значение · данные: OpenRouter (цены, контекст, аптайм 24ч) и Artificial Analysis (скорость и TTFT офиц. API)
Из России напрямую работает 3 из 3 провайдеров этой модели. Колонка «Из РФ» — наша собственная проверка от 19.08.2026: запрос к API провайдера с российского IP плюс сверка с официальным списком поддерживаемых стран вендора. Проверяется сетевой доступ и политика вендора, а не возможность оплаты российской картой.
ПровайдерInput $/1MOutput $/1MСкоростьTTFTКонтекстАптайм 24чИз РФ
Z AI офиц. API $0.07 $0.40 — — 200K — да
Venice $0.06 $0.40 — — 128K 99.1% да
Cloudflare $0.06 $0.40 — — 131K 98.9% да

Сравнения и подборки

Прямые сравнения с конкурентами и подборки, в которые входит GLM-4.7-Flash
AI-модели с рассуждениями (reasoning)Самые дешёвые AI-моделиМодели с длинным контекстом Все сравненияКаталог моделей
Нужна эта модель в вашей компании?
Развернём её (self-host или API), подключим под ваши задачи и обучим команду. Бесплатный ИИ-аудит — 30 минут.
Получить аудит

Сравнение

Похожие модели
ближайшие по AIKraft Index · radar по реальным эвалам
МодельIndexКодКонтекстЦена $/1MСкорость
Qwen3.6 35B A3B15.228262k$0.84157
Qwen3.5 35B A3B15.137262k$0.690
Gemini 2.5 Pro Preview15471m$00
GLM-4.614.9—200k$0.980
GLM-4.7-Flash14.9—200k$0.150
Granite 4.2 30B14.830131k$0.2878
DeepSeek V3.1 Terminus14.844128k$1.910
Gemma 4 31B14.743256k$036
Grok 3 mini Reasoning14.6—1m$0.350
GLM-4.7-Flash14.9
GLM-4.614.9
Gemini 2.5 Pro Preview15