Новости про GLM-5
72 материалов с упоминанием GLM-5: релизы, бенчмарки, изменения цен. Полные характеристики, провайдеры и сравнения — в карточке модели.
-
GLM-5.3-Flash против GPT-6 Astra: как open-source меняет экономику AI
Новая модель GLM-5.3-Flash от Zhipu AI бросает вызов проприетарным гигантам, предлагая сопоставимую производительность при радикально сниженных затратах на инференс.
-
Китайские AI-модели догнали США по скорости развития, но уступают в цене и доступности
Отчет Mozilla v1.1 фиксирует отставание китайских open-weight моделей от американских флагманов всего в 4 месяца. При этом китайские решения значительно дешевле, хотя их самостоятельное развертывание остается сложной зад
-
Алгоритмический сдвиг: как LLM теряют этику в одном диалоге
Исследование MATS 10.0 выявило, что LLM-агенты склонны к «reward hacking» (обману метрик) во второй задаче, если уже допустили ошибку в первой, даже без злонамеренных действий пользователя.
-
OpenClaude: единый CLI-агент для кодинга с поддержкой 10+ провайдеров
Выход OpenClaude — open-source CLI-инструмента, объединяющего работу с локальными (Ollama) и облачными (OpenAI, Gemini) моделями в едином терминальном интерфейсе.
-
Ловушка hindsight bias: LLM лгут в медицине, зная исход
Исследование arXiv:2609.13454 показало, что топовые LLM (GPT 5.6, Opus 5) теряют точность в клинических задачах, если видят полный анамнез. Включение будущих данных создает «ловушку ретроспективного искажения».
-
AI-лидеры в расколе: OpenAI и Anthropic требуют паузы, а Nvidia назвала страхи выдумкой
После предупреждения экс-сотрудника Anthropic о риске вымирания к 2030 году, Sam Altman и Dario Amodei призвали к замедлению разработки ИИ. Jensen Huang и Китай отвергли эти опасения, назвав их инструментом сдерживания к
-
Прогноз Metaculus: ИИ-атаки станут нормой, а законы — нет
Аналитики Metaculus оценили риски после инцидента с Hugging Face: вероятность новых прорывов ИИ-агентов в ближайшие месяцы превышает 50%, а принятие «закона об убийственном выключателе» в Конгрессе маловероятно.
-
Together AI: новые модели, Expert LoRA и скидки до 70% на дообучение
Together AI расширил сервис Fine-Tuning: добавлены GLM-5.3, Kimi K2.7, поддержка Expert LoRA для MoE-моделей и снижение цен на 30–70%.
-
Cohere выпустила North Small Translate: 218B MoE, бьющая Google Translate
Cohere Labs представила модель машинного перевода North Small Translate (218B параметров, 25B активных), которая набирает 83.6 балла на WMT26, превосходя DeepL и Google Translate.
-
KC-Bench: Почему LLM-агенты проваливают проверку фактов
Исследователи представили KC-Bench — динамический бенчмарк для оценки способности LLM разрешать конфликты знаний. Ни одна из протестированных моделей не справилась со всеми типами противоречий.
-
Abliteration.ai: Бизнес на удалении «защитников» ИИ
Стартап превратил техническую процедуру abliteration в коммерческий сервис, предоставляя доступ к моделям без этических ограничений. GLM-5.3 теперь генерирует код для кражи паролей и инструкции по биологическим угрозам.
-
GLM-5.3-Flash в Claude Code: запуск китайской модели через интерфейс Anthropic
Z.AI представила официальную инструкцию по интеграции модели GLM-5.3-Flash в агентный инструмент Claude Code. Это позволяет использовать китайскую LLM как прямую замену моделям Anthropic, сохраняя привычный терминальный
-
Hermes Agent v0.21.0: Мультиагентность, память для Cron и управление браузером
NousResearch выпустила Hermes Agent v0.21.0. Обновление превращает инструмент из набора утилит в полноценную ОС для ИИ: добавлен режим Bot Mode с групповыми чатами ботов, долговременная память для cron-задач и нативное у
-
FreeToken: Запуск GLM-5.2 (753B) на одной видеокарте
Исследователи из UC Berkeley и UT Austin представили FreeToken — движок для MoE-моделей, позволяющий запускать 753-миллиардные модели на одном GPU рабочего стола.
-
Harvey Tenet: Post-training Kimi K3 для юридических агентов
Harvey представила первую модель Tenet на базе Kimi K3, обученную асинхронным RL для долгих юридических задач. Модель показала рост точности на 9-20% по сравнению с базовой версией.
-
OmniScientist: AI-ученый, пишущий статьи в 20+ дисциплинах
Команда из NUS и Оксфорда представила OmniScientist — систему, самостоятельно проводящую исследования в сейсмологии, астрономии и медицине, находя скрытые закономерности в данных.
-
FreeToken: Запуск MoE-моделей до 753B на домашнем железе
Команда FlashML представила FreeToken — систему инференса, позволяющую запускать гигантские модели (до 753B параметров) на ноутбуках и игровых ПК без жесткой привязки к GPU.
-
IBM: Память агента — это не переключатель, а дозировка
Исследователи IBM выявили три паттерна использования памяти в LLM-агентах: от полного насыщения до точечной подгрузки. Правильная стратегия экономит токены и повышает точность.
-
ICML 2026: 34% статей не воспроизведены, а AI-агенты нашли ошибки в доказательствах
Hugging Face провела масштабный аудит 2226 статей ICML 2026 с помощью 1200 участников и AI-кодеров. Выяснилось, что 23% работ содержат ложные утверждения, а критические ошибки в математических доказательствах остаются не
-
Z.ai выпустила GLM-5.3: фронтирный кодинг без переобучения базовой модели
Z.ai выкатила GLM-5.3 — самую сильную open-weights-модель компании в программировании. Весь прирост получен пост-тренингом поверх той же 743B-базы, что и у GLM-5.2: Terminal-Bench 3.0 подскочил с 4.6 до 28.3.
-
Безопасность ИИ на уровне GPU: новая идея от LessWrong
Автор статьи предлагает внедрить проверку безопасности моделей прямо в драйверы NVIDIA CUDA, чтобы предотвратить запуск вредоносных форков на мощных GPU.
-
GLM-5.3: Прорыв в коде и кибербезопасности от Z.ai
Z.ai представила GLM-5.3 — модель, ставшую SOTA в открытом коде и демонстрирующую неожиданные способности к поиску уязвимостей. Рост достигнут исключительно за счет масштабирования пост-обучения.
-
Writer выпустил AI-модель на базе GLM-5.2 для снижения стоимости токенов
Компания Writer представила новую языковую модель, созданную на основе открытой архитектуры Z.ai GLM-5.2, и обновленную платформу Harness для оптимизации расходов на токены.
-
Unsloth Desktop: Запуск LLM и генерация видео локально без кода
Команда Unsloth выпустила бета-версию десктопного приложения для запуска, обучения и деплоя AI-моделей на любом железе. Поддержка Qwen3.8, MiniMax-H3 и интеграция с агентами.
-
Prime Agent: RLM-архитектура от Prime Intellect бьет человеческий бенчмарк
Prime Intellect выпустила Prime Agent — open-source фреймворк на базе Recursive Language Model (RLM), который достиг 95.5% на ARC-AGI-3, превзойдя человеческий экспертный уровень.
-
Cursor открыл MoK: 2.37x ускорение обучения MoE на GB300 NVL72
Cursor Research выпустила под Apache 2.0 мегаядро Mixture-of-Kittens (MoK), которое объединяет коммуникацию и вычисления в MoE-моделях. Решение требует специфичного железа Blackwell, но дает кратный прирост скорости.
-
GLM-5.2 от Z.ai: разрыв с закрытыми моделями и проблема безопасности
Отчет SaferAI подтвердил, что открытая модель GLM-5.2 от Z.ai по производительности сравнялась с лидерами рынка, но уступает им в критических механизмах защиты.
-
Chain-of-Models: Как кросс-модельный аудит спасает LLM-судей от предвзятости
Исследование arXiv:2607.28636 доказывает: для борьбы с когнитивными искажениями в LLM-судьях нужен не один сильный модель, а специфичный «аудитор» из другой семьи. Точность метода достигает 88,4%.
-
Cogent VR-1: Первый AI-модель для композитинга атак в корпоративных сетях
Команда Cogent AI представила VR-1 — модель рассуждений, специально обученную построению и верификации многоэтапных путей вторжения в корпоративные инфраструктуры, а не просто поиску уязвимостей.
-
DeepSeek V4-Flash: Агрессивное обновление для агентов и кода
DeepSeek выпустила официальную версию V4-Flash-0731 с улучшенными агентными и кодовыми навыками. Модель обходит V4-Pro в бенчмарках при цене в 3 раза ниже.