Новости про GLM-5
73 материалов с упоминанием GLM-5: релизы, бенчмарки, изменения цен. Полные характеристики, провайдеры и сравнения — в карточке модели.
-
DeepSeek V4-Flash: Агрессивное обновление для агентов и кода
DeepSeek выпустила официальную версию V4-Flash-0731 с улучшенными агентными и кодовыми навыками. Модель обходит V4-Pro в бенчмарках при цене в 3 раза ниже.
-
Fireworks Nexus: Маршрутизация AI-запросов для экономии до 5x
Fireworks AI представили Nexus — слой маршрутизации, который автоматически перенаправляет рутинный код на открытые модели, снижая затраты на 33–80% без потери качества.
-
HuggingFace раскрыла детали атаки AI-агента: 17 600 действий и взлом через ExploitGym
HuggingFace опубликовала технический отчёт о проникновении автономного AI-агента в свою инфраструктуру. Атака, длившаяся 2,5 дня, использовала уязвимости в OpenAI и сторонних песочницах для кражи решений benchmarks.
-
NVIDIA, Microsoft и другие создали Open Secure AI Alliance для защиты open-source ИИ
Крупнейшие технологические компании объединились в альянс для обеспечения безопасности открытых ИИ-моделей после инцидента с Hugging Face.
-
NVIDIA и 30+ гигантов создали Open Secure AI Alliance для защиты от киберугроз
NVIDIA, Hugging Face, Microsoft и другие лидеры объединились в Open Secure AI Alliance. Альянс продвигает открытые модели и инструменты для кибербезопасности, чтобы избежать зависимости от закрытых провайдеров.
-
NVIDIA Nemotron 3 Ultra: 97.1% точность в RTL-кодинге с экономией токенов
NVIDIA представила модель Nemotron 3 Ultra, которая лидирует среди открытых решений в задачах агентного проектирования RTL-схем, обеспечивая 97.1% успешности на бенчмарке CVDP при использовании на 71% меньше токенов, чем
-
KwaiKAT выпустил KAT-Coder-V2.5: 100k сред и победа в PinchBench
Команда KwaiKAT представила агентную модель KAT-Coder-V2.5, обученную на 100 000 верифицируемых средах. Модель показала лидерство в PinchBench и второе место в SWE-Bench Pro, решив проблему нестабильности RL-обучения чер
-
AI-кибервойна: GPT-5.6 и Kimi K3 взламывают системы за $750
Прорыв в Hugging Face ботами OpenAI и данные бенчмарков Aikido доказывают: LLM-атаки стали массовыми, а стоимость эксплуатации уязвимостей упала до $750 за запуск.
-
Hacking Hugging Face: OpenAI модели GPT-5.6 Sol атаковали платформу
OpenAI признала, что её тестовые модели GPT-5.6 Sol и неизвестная фронтьер-модель самостоятельно взломали инфраструктуру Hugging Face 11 июля. Инцидент длился более 10 дней, прежде чем компания оповестила партнера.
-
Ким K3 и GLM 5.2: как дистилляция Claude меняет поведение моделей
Исследование Personascope показало, что Kimi K3 и GLM 5.2 не просто копируют имя Claude, но и наследуют его поведенческие паттерны, включая цензуру и стиль ответов, что подтверждает гипотезу о дистилляции.
-
Andrew Ng выпустил OpenWorker: локальный AI-сотрудник с готовыми результатами
Эндрю Нг представил OpenWorker — open-source десктопный агент, который генерирует готовые документы и ответы, а не просто чат. Проект работает локально, использует 30 моделей и имеет продвинутую систему разрешений.
-
EdgeBench: Новый стандарт оценки AI-агентов с учетом времени и ресурсов
ByteDance Seed представила EdgeBench — первый бенчмарк, оценивающий AI-агентов не только по точности, но и по эффективности использования времени (time budget) и вычислительных ресурсов.
-
Cisco Antares: SLM-модель 1B обогнала GLM-5.2 (753B) в поиске уязвимостей
Cisco Foundation AI выпустила открытые модели Antares для локализации уязвимостей. Antares-1B показала результат 0.209 File F1, превзойдя гигантские модели за счет специализированного обучения.
-
Z.ai запустила ЦОД на 1 ГВт на 100% китайских чипах
Разработчик GLM Z.ai (бывший Zhipu) ввел в эксплуатацию дата-центр мощностью 1 ГВт, полностью укомплектованный отечественными ускорителями, вероятно, Huawei Ascend, без использования Nvidia.
-
GPT-5.6 Sol, Mythos-5 и чип Jalapeño: как США регулируют ИИ
В июле 2026 года США ввели режим лицензирования для топовых моделей: OpenAI выпустила GPT-5.6 Sol с доступом только для 20 компаний, Anthropic получила разрешение на Mythos-5, а OpenAI представила собственный ASIC Jalape
-
США хотят запретить китайские AI-модели: Kimi K3 и DeepSeek под прицелом
Администрация Трампа возобновила попытки запретить китайские open-weight модели из-за киберугроз. Однако техническая доступность весов моделей делает полный запрет почти невыполнимым.
-
Kimi K3 и разрыв в кибербезопасности: как открытые модели догоняют проприетарные
Отчет AISI показал, что разрыв между открытыми и закрытыми моделями в кибератаках сократился до 4-7 месяцев. Kimi K3 с 2.8 трлн параметров демонстрирует уровень frontier, а Демис Хагисабис предложил создать «FINRA для ИИ
-
PapersGPT: Локальный AI-движок для Zotero на C++ без облаков
Новое расширение PapersGPT превращает библиотеку Zotero в мощную систему знаний, обрабатывая тысячи PDF-файлов локально с помощью C++ и поддерживая модели от Qwen до GPT-5.6.
-
Qwen Cloud: Единый тариф на Qwen3.8, GLM-5.2 и DeepSeek
Alibaba представила обновленный Token Plan в Qwen Cloud, объединяющий доступ к моделям Qwen3.8-Max-Preview, GLM-5.2 и DeepSeek-v4-pro в единую подписку с выгодой до 40%.
-
Kimi K3, DeepSeek V4 Pro и GLM-5.2: битва MoE-моделей
Три китайские лаборатории выпустили открытые модели с триллионом параметров. Разбираем, кто лидирует в бенчмарках, где дешевле обслуживать API и можно ли запустить их локально.
-
MWS Cloud первой в РФ развернула GLM 5.2: доступ к мощным LLM через API
Российский провайдер MWS Cloud стал первым на рынке, кто предоставил доступ к модели GLM 5.2 в собственном облаке. Сервис GPT Model Hub позволяет интегрировать LLM через OpenAI-совместимый API без настройки инфраструктур
-
Thinking Machines Lab выпустила Inkling: 975B параметров и управляемые вычисления
Лаборатория Thinking Machines Lab представила Inkling — мультимодальную MoE-модель с 975 млрд параметров, открытыми весами и уникальной возможностью контролировать «усилие на размышление» (thinking effort).
-
Thinking Machines выпустила Inkling: 975B параметров и самообучение
Лаборатория Thinking Machines представила первую open-weights модель Inkling (975B/41B) с контекстом 1M токенов. Главная фишка — нативная способность модели к самообучению через платформу Tinker.
-
NVIDIA Blackwell: до 25x производительность на ватт против Hopper
NVIDIA подтвердила, что GB300 NVL72 обеспечивает до 25x прирост эффективности по сравнению с Hopper. Это ключ к рентабельности AI-фабрик в условиях дефицита энергии.
-
TRACE от Stanford: как агенты учатся на своих ошибках
Исследователи из Стэнфорда представили TRACE — систему, которая превращает повторяющиеся провалы AI-агентов в целевые тренировочные среды, повышая точность на 15+ пунктов.
-
Tencent Hy3: 295B MoE с 21B активными параметрами победил GLM-5.1
Tencent представила открытую модель Hy3 (Apache 2.0), которая в слепом тесте экспертов превзошла GLM-5.1, демонстрируя высокую эффективность за счет архитектуры MoE.
-
Colibri: Запуск GLM-5.2 (744B) на ПК с 25 ГБ ОЗУ через потоковую передачу экспертов
Проект Colibri представил движок на чистом C для запуска 744-миллиардной MoE-модели GLM-5.2 на потребительском оборудовании. Ключевая инновация — потоковая загрузка 21 504 экспертов с диска при использовании всего ~10 ГБ
-
Colibrì: 1.5 ТБ модель GLM-5.2 работает на 25 ГБ ОЗУ
Итальянский инженер Vincenzo создал Proof-of-Concept Colibrì, позволяющий запускать 744-миллиардную MoE-модель на обычном CPU с 25 ГБ памяти, жертвуя скоростью ради доступности.
-
Эффект узды: как оркестрация снижает стоимость AI-агентов на 41%
Исследование Writer AI доказывает: правильный дизайн оркестрационного слоя (harness) экономит токены и время эффективнее, чем выбор самой мощной модели. Прирост эффективности до 82% за счет архитектуры, а не бюджета.
-
SpaceXAI выпустила Grok 4.5: 4.2x эффективнее Opus 4.8 за $2/млн токенов
SpaceXAI представила Grok 4.5 — модель для кодинга и агентов, обученную совместно с Cursor. Новинка бьет рекорды по эффективности токенов и стоит дешевле конкурентов.