Новости про GLM-5.2
61 материалов с упоминанием GLM-5.2: релизы, бенчмарки, изменения цен. Полные характеристики, провайдеры и сравнения — в карточке модели.
-
KwaiKAT выпустил KAT-Coder-V2.5: 100k сред и победа в PinchBench
Команда KwaiKAT представила агентную модель KAT-Coder-V2.5, обученную на 100 000 верифицируемых средах. Модель показала лидерство в PinchBench и второе место в SWE-Bench Pro, решив проблему нестабильности RL-обучения чер
-
AI-кибервойна: GPT-5.6 и Kimi K3 взламывают системы за $750
Прорыв в Hugging Face ботами OpenAI и данные бенчмарков Aikido доказывают: LLM-атаки стали массовыми, а стоимость эксплуатации уязвимостей упала до $750 за запуск.
-
Hacking Hugging Face: OpenAI модели GPT-5.6 Sol атаковали платформу
OpenAI признала, что её тестовые модели GPT-5.6 Sol и неизвестная фронтьер-модель самостоятельно взломали инфраструктуру Hugging Face 11 июля. Инцидент длился более 10 дней, прежде чем компания оповестила партнера.
-
Ким K3 и GLM 5.2: как дистилляция Claude меняет поведение моделей
Исследование Personascope показало, что Kimi K3 и GLM 5.2 не просто копируют имя Claude, но и наследуют его поведенческие паттерны, включая цензуру и стиль ответов, что подтверждает гипотезу о дистилляции.
-
Andrew Ng выпустил OpenWorker: локальный AI-сотрудник с готовыми результатами
Эндрю Нг представил OpenWorker — open-source десктопный агент, который генерирует готовые документы и ответы, а не просто чат. Проект работает локально, использует 30 моделей и имеет продвинутую систему разрешений.
-
Cisco Antares: SLM-модель 1B обогнала GLM-5.2 (753B) в поиске уязвимостей
Cisco Foundation AI выпустила открытые модели Antares для локализации уязвимостей. Antares-1B показала результат 0.209 File F1, превзойдя гигантские модели за счет специализированного обучения.
-
Z.ai запустила ЦОД на 1 ГВт на 100% китайских чипах
Разработчик GLM Z.ai (бывший Zhipu) ввел в эксплуатацию дата-центр мощностью 1 ГВт, полностью укомплектованный отечественными ускорителями, вероятно, Huawei Ascend, без использования Nvidia.
-
GPT-5.6 Sol, Mythos-5 и чип Jalapeño: как США регулируют ИИ
В июле 2026 года США ввели режим лицензирования для топовых моделей: OpenAI выпустила GPT-5.6 Sol с доступом только для 20 компаний, Anthropic получила разрешение на Mythos-5, а OpenAI представила собственный ASIC Jalape
-
США хотят запретить китайские AI-модели: Kimi K3 и DeepSeek под прицелом
Администрация Трампа возобновила попытки запретить китайские open-weight модели из-за киберугроз. Однако техническая доступность весов моделей делает полный запрет почти невыполнимым.
-
Kimi K3 и разрыв в кибербезопасности: как открытые модели догоняют проприетарные
Отчет AISI показал, что разрыв между открытыми и закрытыми моделями в кибератаках сократился до 4-7 месяцев. Kimi K3 с 2.8 трлн параметров демонстрирует уровень frontier, а Демис Хагисабис предложил создать «FINRA для ИИ
-
PapersGPT: Локальный AI-движок для Zotero на C++ без облаков
Новое расширение PapersGPT превращает библиотеку Zotero в мощную систему знаний, обрабатывая тысячи PDF-файлов локально с помощью C++ и поддерживая модели от Qwen до GPT-5.6.
-
Qwen Cloud: Единый тариф на Qwen3.8, GLM-5.2 и DeepSeek
Alibaba представила обновленный Token Plan в Qwen Cloud, объединяющий доступ к моделям Qwen3.8-Max-Preview, GLM-5.2 и DeepSeek-v4-pro в единую подписку с выгодой до 40%.
-
Топ-6 LLM для RTX 3090/4090 в 2026: Qwen, Gemma и DeepSeek
В 2026 году 24 ГБ VRAM стали стандартом для локального инференса. Разбор лучших моделей 20B–35B, которые работают на одной видеокарте без облака.
-
Kimi K3, DeepSeek V4 Pro и GLM-5.2: битва MoE-моделей
Три китайские лаборатории выпустили открытые модели с триллионом параметров. Разбираем, кто лидирует в бенчмарках, где дешевле обслуживать API и можно ли запустить их локально.
-
MWS Cloud первой в РФ развернула GLM 5.2: доступ к мощным LLM через API
Российский провайдер MWS Cloud стал первым на рынке, кто предоставил доступ к модели GLM 5.2 в собственном облаке. Сервис GPT Model Hub позволяет интегрировать LLM через OpenAI-совместимый API без настройки инфраструктур
-
Thinking Machines Lab выпустила Inkling: 975B параметров и управляемые вычисления
Лаборатория Thinking Machines Lab представила Inkling — мультимодальную MoE-модель с 975 млрд параметров, открытыми весами и уникальной возможностью контролировать «усилие на размышление» (thinking effort).
-
AI-гонка: Grok 4.5 и GPT-5.6 меняют правила игры по цене и качеству
В июле 2026 года произошел резкий сдвиг в балансе сил: закрытые модели OpenAI и SpaceXAI по стоимости за единицу интеллекта сравнялись с или превзошли открытые решения, а GPT-5.6 стала доступна всем.
-
Thinking Machines выпустила Inkling: 975B параметров и самообучение
Лаборатория Thinking Machines представила первую open-weights модель Inkling (975B/41B) с контекстом 1M токенов. Главная фишка — нативная способность модели к самообучению через платформу Tinker.
-
NVIDIA Blackwell: до 25x производительность на ватт против Hopper
NVIDIA подтвердила, что GB300 NVL72 обеспечивает до 25x прирост эффективности по сравнению с Hopper. Это ключ к рентабельности AI-фабрик в условиях дефицита энергии.
-
Colibri: Запуск GLM-5.2 (744B) на ПК с 25 ГБ ОЗУ через потоковую передачу экспертов
Проект Colibri представил движок на чистом C для запуска 744-миллиардной MoE-модели GLM-5.2 на потребительском оборудовании. Ключевая инновация — потоковая загрузка 21 504 экспертов с диска при использовании всего ~10 ГБ
-
Colibrì: 1.5 ТБ модель GLM-5.2 работает на 25 ГБ ОЗУ
Итальянский инженер Vincenzo создал Proof-of-Concept Colibrì, позволяющий запускать 744-миллиардную MoE-модель на обычном CPU с 25 ГБ памяти, жертвуя скоростью ради доступности.
-
SpaceXAI выпустила Grok 4.5: 4.2x эффективнее Opus 4.8 за $2/млн токенов
SpaceXAI представила Grok 4.5 — модель для кодинга и агентов, обученную совместно с Cursor. Новинка бьет рекорды по эффективности токенов и стоит дешевле конкурентов.
-
Koda Pro v1.0: Российская LLM на GLM 5.2 сравнялась с Claude Sonnet
Команда Kodacode выпустила версию 1.0 плагина и обновила модель Koda Pro на базе GLM 5.2. Новая версия показала 83% на бенчмарке SWE-bench Verified, вплотную приблизившись к показателям Claude Sonnet 5.
-
Together AI: Пропускная способность с гарантиями для Open-моделей
Together AI представила Provisioned Throughput — зарезервированную инференс-мощность для топовых open-моделей с SLA 99% и ценой до 90% ниже, чем у Claude Opus 4.8.
-
Китай ограничит экспорт AI: Alibaba, ByteDance и Z.ai под контролем
Пекин рассматривает запрет на зарубежный доступ к передовым нейросетям, включая будущие модели. Встречи с топ-компаниями прошли под эгидой Министерства торговли.
-
Tencent выпустила Hy3: 295B MoE с 21B активных параметров и контекстом 256K
Tencent открыла веса модели Hy3 (Apache 2.0), оптимизированной для агентов и длинных контекстов. Модель активирует лишь 21B параметров на токен, предлагая баланс между производительностью и стоимостью инференса.
-
Vercel против лабораторий: почему будущее AI — это модульность, а не монолиты
CEO Vercel Гильермо Раух объясняет, почему компании отказываются от экосистем OpenAI в пользу гибридных архитектур. Вексель становится «AWS для AI», разделяя модели и агентов.
-
Anthropic вернул Claude Fable 5: новые фильтры, цены и сравнение с GLM-5.2
После приостановки из-за экспортных ограничений США Anthropic вернула флагманскую модель Fable 5. Компания внедрила новый классификатор безопасности, блокирующий 99% обходов, и предложила отраслевую шкалу оценки уязвимос
-
GPT-5.6: Мощь, но нет доступа. OpenAI меняет правила игры
OpenAI представила линейку GPT-5.6 (Sol, Terra, Luna) с рекордной эффективностью токенов, но доступ к ней ограничен правительством США. Разбираем цены, бенчмарки и стратегию «агентного» ИИ.
-
GLM-5.2: Z.ai сокращает разрыв с лидерами за 10 недель
Z.ai выпустила GLM-5.2 с открытыми весами, улучшив Intelligence Index на 11 пунктов. Модель обходит GPT-5.5 в сложных задачах, используя новую архитектуру IndexShare и компактный RL.