Модели/GLM-4.6 (Non-reasoning)

GLM-4.6 (Non-reasoning) Non-reasoning

Z AI
textproprietary
разработчик Z AI релиз 30.09.2025 лицензия Proprietary

Модель GLM-4.6 от Z AI с индексом интеллекта 14.9. Контекстное окно — 200 тыс. токенов, скорость вывода около 0 токенов/с. Стоимость — $0.575 за 1М входных и $2.2 за 1М выходных токенов.

Ключевые метрикиоценка
AIKraft Index14.9#275 из 669
Контекст200kтокенов
Output speed0.0 t/sизмерено
TTFT0.0 sизмерено
Blended цена₽82$0.98 / 1M
МодальностьТекстоваябез рассуждения

Обзор

GLM-4.6 — модель от Z AI. Подходит для генерации и обработки текста, диалоговых сценариев и прикладных задач с невысокой задержкой.

Контекстное окно — 200 тыс. токенов, скорость вывода — ~0 токенов/с. Композитный индекс интеллекта — 14.9 из 100 — #276 из 669 в рейтинге AIKraft. Доступ из РФ — через сторонние прокси-сервисы. Цена — $0.575 за 1M входных и $2.2 за 1M выходных токенов.

Уровни рассуждений

GLM-4.6 — уровни reasoning
разные уровни усилий одной модели · каждый — отдельная карточка
УровеньIntelligenceЦена in/out $/1MКонтекстСкорость t/s
Non-reasoning · эта страница14.9$0.57 / $2.2200k0•
Reasoning18.5$0.55 / $2.2200k0↗

Бенчмарки

Результаты на эвалах
Math Index: 44.3
БенчмаркЗначение
MMLU-Pro78.4%
τ²-bench76.9%
GPQA Diamond63.2%
LiveCodeBench56.1%
AIME '2544.3%
IFBench36.7%
Terminal-Bench Hard28.8%
LCR26.3%
HLE5.5%
14.9/ 100место в рейтинге#275
композитный индекс · вклад эвалов
MMLU-Pro78
τ²-bench77
GPQA Diamond63
LiveCodeBench56
AIME '2544
IFBench37
взвешенная композиция реальных эваловметодология →

Производительность и цена

Скорость, стоимость и положение на Pareto-фронте
скорость и TTFT — измеренные значения, не заявленные вендором
Скорость
0.0 t/s
Output speed
0.0 s
TTFT
Контекстное окно
200k заявленный контекст
Цена за 1M токенов
Input входные$0.57₽48
Output выходные$2.20₽184
Blended 3:1$0.98₽82
курс ЦБ РФ · $1 = ₽83.48
Калькулятор стоимости в ₽
M ток.
M ток.
≈ стоимость в месяц—
Pareto-фронт среди соседей
GLM-4.6 соседи пунктир — Pareto-граница

Провайдеры / API

Где доступна модель: цены, контекст и аптайм по хостерам
▲ — лучшее значение · данные: OpenRouter (цены, контекст, аптайм 24ч) и Artificial Analysis (скорость и TTFT офиц. API)
Из России напрямую работает 4 из 4 провайдеров этой модели. Колонка «Из РФ» — наша собственная проверка от 19.08.2026: запрос к API провайдера с российского IP плюс сверка с официальным списком поддерживаемых стран вендора. Проверяется сетевой доступ и политика вендора, а не возможность оплаты российской картой.
ПровайдерInput $/1MOutput $/1MСкоростьTTFTКонтекстАптайм 24чИз РФ
Z AI офиц. API $0.60 $2.20 — — 203K 99.6% да
Venice $0.43 $1.75 — — 198K 99.7% да
DeepInfra $0.50 $2.00 — — 203K 99.9% да
Novita $0.55 $2.20 — — 205K 99.9% да

Сравнения и подборки

Прямые сравнения с конкурентами и подборки, в которые входит GLM-4.6
Самые дешёвые AI-моделиМодели с длинным контекстом Все сравненияКаталог моделей
Нужна эта модель в вашей компании?
Развернём её (self-host или API), подключим под ваши задачи и обучим команду. Бесплатный ИИ-аудит — 30 минут.
Получить аудит

Сравнение

Похожие модели
ближайшие по AIKraft Index · radar по реальным эвалам
МодельIndexКодКонтекстЦена $/1MСкорость
o115.240200k$26.250
Qwen3.6 35B A3B15.228262k$0.84157
Qwen3.5 35B A3B15.137262k$0.690
Gemini 2.5 Pro Preview15471m$00
GLM-4.614.9—200k$0.980
GLM-4.7-Flash14.9—200k$0.150
Granite 4.2 30B14.830131k$0.2878
DeepSeek V3.1 Terminus14.844128k$1.910
Gemma 4 31B14.743256k$036
GLM-4.614.9
GLM-4.7-Flash14.9
Gemini 2.5 Pro Preview15