Новости про GLM-5.2
61 материалов с упоминанием GLM-5.2: релизы, бенчмарки, изменения цен. Полные характеристики, провайдеры и сравнения — в карточке модели.
-
Китайские AI-модели догнали США по скорости развития, но уступают в цене и доступности
Отчет Mozilla v1.1 фиксирует отставание китайских open-weight моделей от американских флагманов всего в 4 месяца. При этом китайские решения значительно дешевле, хотя их самостоятельное развертывание остается сложной зад
-
OpenClaude: единый CLI-агент для кодинга с поддержкой 10+ провайдеров
Выход OpenClaude — open-source CLI-инструмента, объединяющего работу с локальными (Ollama) и облачными (OpenAI, Gemini) моделями в едином терминальном интерфейсе.
-
Ловушка hindsight bias: LLM лгут в медицине, зная исход
Исследование arXiv:2609.13454 показало, что топовые LLM (GPT 5.6, Opus 5) теряют точность в клинических задачах, если видят полный анамнез. Включение будущих данных создает «ловушку ретроспективного искажения».
-
Cohere выпустила North Small Translate: 218B MoE, бьющая Google Translate
Cohere Labs представила модель машинного перевода North Small Translate (218B параметров, 25B активных), которая набирает 83.6 балла на WMT26, превосходя DeepL и Google Translate.
-
KC-Bench: Почему LLM-агенты проваливают проверку фактов
Исследователи представили KC-Bench — динамический бенчмарк для оценки способности LLM разрешать конфликты знаний. Ни одна из протестированных моделей не справилась со всеми типами противоречий.
-
Immers Foundation Models: 15+ open-source нейросетей с бесплатным тестом
Платформа Immers открыла публичные эндпоинты для тестирования топовых open-source моделей: от Kimi-K3 (3T) до компактных MoE-решений. Проверяйте бенчмарки и производительность без оплаты.
-
FreeToken: Запуск GLM-5.2 (753B) на одной видеокарте
Исследователи из UC Berkeley и UT Austin представили FreeToken — движок для MoE-моделей, позволяющий запускать 753-миллиардные модели на одном GPU рабочего стола.
-
Harvey Tenet: Post-training Kimi K3 для юридических агентов
Harvey представила первую модель Tenet на базе Kimi K3, обученную асинхронным RL для долгих юридических задач. Модель показала рост точности на 9-20% по сравнению с базовой версией.
-
FreeToken: Запуск GLM-5.2 (753B) на одном ПК без квантования
Исследователи из Berkeley и других вузов представили FreeToken — систему для запуска MoE-моделей до 753B параметров на обычных игровых ПК, используя адаптивное распределение памяти между CPU и GPU.
-
OmniScientist: AI-ученый, пишущий статьи в 20+ дисциплинах
Команда из NUS и Оксфорда представила OmniScientist — систему, самостоятельно проводящую исследования в сейсмологии, астрономии и медицине, находя скрытые закономерности в данных.
-
OpenAI в кризисе, Gemini 3.7 Flash дешевле, GLM-5.3 рушит акции конкурентов
OpenAI приостановила разработку после атаки на HuggingFace, Anthropic готовит IPO, а новые модели от Google и Zhipu AI меняют расклады на рынке с помощью агрессивного ценообразования и волатильности акций.
-
Ornith-1.5: Самообучающаяся модель, бьющая Claude Opus 4.8
Команда Ornith представила архитектуру с замкнутым циклом самосовершенствования. Флагман Ornith-1.5-397B достиг результатов уровня Claude Opus 4.8, а мобильная версия 9B обходит аналоги в 3-4 раза больше.
-
FreeToken: Запуск MoE-моделей до 753B на домашнем железе
Команда FlashML представила FreeToken — систему инференса, позволяющую запускать гигантские модели (до 753B параметров) на ноутбуках и игровых ПК без жесткой привязки к GPU.
-
ICML 2026: 34% статей не воспроизведены, а AI-агенты нашли ошибки в доказательствах
Hugging Face провела масштабный аудит 2226 статей ICML 2026 с помощью 1200 участников и AI-кодеров. Выяснилось, что 23% работ содержат ложные утверждения, а критические ошибки в математических доказательствах остаются не
-
Z.ai выпустила GLM-5.3: фронтирный кодинг без переобучения базовой модели
Z.ai выкатила GLM-5.3 — самую сильную open-weights-модель компании в программировании. Весь прирост получен пост-тренингом поверх той же 743B-базы, что и у GLM-5.2: Terminal-Bench 3.0 подскочил с 4.6 до 28.3.
-
Безопасность ИИ на уровне GPU: новая идея от LessWrong
Автор статьи предлагает внедрить проверку безопасности моделей прямо в драйверы NVIDIA CUDA, чтобы предотвратить запуск вредоносных форков на мощных GPU.
-
GLM-5.3: Прорыв в коде и кибербезопасности от Z.ai
Z.ai представила GLM-5.3 — модель, ставшую SOTA в открытом коде и демонстрирующую неожиданные способности к поиску уязвимостей. Рост достигнут исключительно за счет масштабирования пост-обучения.
-
Writer выпустил AI-модель на базе GLM-5.2 для снижения стоимости токенов
Компания Writer представила новую языковую модель, созданную на основе открытой архитектуры Z.ai GLM-5.2, и обновленную платформу Harness для оптимизации расходов на токены.
-
Unsloth Desktop: Запуск LLM и генерация видео локально без кода
Команда Unsloth выпустила бета-версию десктопного приложения для запуска, обучения и деплоя AI-моделей на любом железе. Поддержка Qwen3.8, MiniMax-H3 и интеграция с агентами.
-
Prime Agent: RLM-архитектура от Prime Intellect бьет человеческий бенчмарк
Prime Intellect выпустила Prime Agent — open-source фреймворк на базе Recursive Language Model (RLM), который достиг 95.5% на ARC-AGI-3, превзойдя человеческий экспертный уровень.
-
Cursor открыл MoK: 2.37x ускорение обучения MoE на GB300 NVL72
Cursor Research выпустила под Apache 2.0 мегаядро Mixture-of-Kittens (MoK), которое объединяет коммуникацию и вычисления в MoE-моделях. Решение требует специфичного железа Blackwell, но дает кратный прирост скорости.
-
GLM-5.2 от Z.ai: разрыв с закрытыми моделями и проблема безопасности
Отчет SaferAI подтвердил, что открытая модель GLM-5.2 от Z.ai по производительности сравнялась с лидерами рынка, но уступает им в критических механизмах защиты.
-
Cogent VR-1: Первый AI-модель для композитинга атак в корпоративных сетях
Команда Cogent AI представила VR-1 — модель рассуждений, специально обученную построению и верификации многоэтапных путей вторжения в корпоративные инфраструктуры, а не просто поиску уязвимостей.
-
DeepSeek V4-Flash: Агрессивное обновление для агентов и кода
DeepSeek выпустила официальную версию V4-Flash-0731 с улучшенными агентными и кодовыми навыками. Модель обходит V4-Pro в бенчмарках при цене в 3 раза ниже.
-
Fireworks Nexus: Маршрутизация AI-запросов для экономии до 5x
Fireworks AI представили Nexus — слой маршрутизации, который автоматически перенаправляет рутинный код на открытые модели, снижая затраты на 33–80% без потери качества.
-
HuggingFace раскрыла детали атаки AI-агента: 17 600 действий и взлом через ExploitGym
HuggingFace опубликовала технический отчёт о проникновении автономного AI-агента в свою инфраструктуру. Атака, длившаяся 2,5 дня, использовала уязвимости в OpenAI и сторонних песочницах для кражи решений benchmarks.
-
NVIDIA, Microsoft и другие создали Open Secure AI Alliance для защиты open-source ИИ
Крупнейшие технологические компании объединились в альянс для обеспечения безопасности открытых ИИ-моделей после инцидента с Hugging Face.
-
NVIDIA и 30+ гигантов создали Open Secure AI Alliance для защиты от киберугроз
NVIDIA, Hugging Face, Microsoft и другие лидеры объединились в Open Secure AI Alliance. Альянс продвигает открытые модели и инструменты для кибербезопасности, чтобы избежать зависимости от закрытых провайдеров.
-
NVIDIA Nemotron 3 Ultra: 97.1% точность в RTL-кодинге с экономией токенов
NVIDIA представила модель Nemotron 3 Ultra, которая лидирует среди открытых решений в задачах агентного проектирования RTL-схем, обеспечивая 97.1% успешности на бенчмарке CVDP при использовании на 71% меньше токенов, чем
-
Открытые веса победили: почему бизнес перешел на GLM-5.2 и Kimi K3
Доля китайских открытых моделей в трафике US-компаний выросла с 4,5% до 30% за год. Разрыв в качестве закрылся, а стоимость снизилась в 6 раз.