Новости про GLM-5.1
9 материалов с упоминанием GLM-5.1: релизы, бенчмарки, изменения цен. Полные характеристики, провайдеры и сравнения — в карточке модели.
-
KwaiKAT выпустил KAT-Coder-V2.5: 100k сред и победа в PinchBench
Команда KwaiKAT представила агентную модель KAT-Coder-V2.5, обученную на 100 000 верифицируемых средах. Модель показала лидерство в PinchBench и второе место в SWE-Bench Pro, решив проблему нестабильности RL-обучения чер
-
EdgeBench: Новый стандарт оценки AI-агентов с учетом времени и ресурсов
ByteDance Seed представила EdgeBench — первый бенчмарк, оценивающий AI-агентов не только по точности, но и по эффективности использования времени (time budget) и вычислительных ресурсов.
-
Tencent Hy3: 295B MoE с 21B активными параметрами победил GLM-5.1
Tencent представила открытую модель Hy3 (Apache 2.0), которая в слепом тесте экспертов превзошла GLM-5.1, демонстрируя высокую эффективность за счет архитектуры MoE.
-
Эффект узды: как оркестрация снижает стоимость AI-агентов на 41%
Исследование Writer AI доказывает: правильный дизайн оркестрационного слоя (harness) экономит токены и время эффективнее, чем выбор самой мощной модели. Прирост эффективности до 82% за счет архитектуры, а не бюджета.
-
Tencent выпустила Hy3: 295B MoE с 21B активных параметров и контекстом 256K
Tencent открыла веса модели Hy3 (Apache 2.0), оптимизированной для агентов и длинных контекстов. Модель активирует лишь 21B параметров на токен, предлагая баланс между производительностью и стоимостью инференса.
-
GLM-5.2: Z.ai сокращает разрыв с лидерами за 10 недель
Z.ai выпустила GLM-5.2 с открытыми весами, улучшив Intelligence Index на 11 пунктов. Модель обходит GPT-5.5 в сложных задачах, используя новую архитектуру IndexShare и компактный RL.
-
ParallelKernelBench: Почему LLM пока не умеют писать быстрые multi-GPU ядра
Новый бенчмарк ParallelKernelBench показал, что даже топовые модели вроде GPT-5.5 и Gemini 3 Pro не могут эффективно оптимизировать коммуникацию между GPU, решая менее трети задач быстрее базового PyTorch.
- Mythos закрыли от публики, но не от войны: как 3 AI-события меняют рынок в 2026
- GLM-5.1 от Z.ai перехватил SWE-Bench Pro: новый уровень автономного кодинга для команд