Новости про GPT-5
311 материалов с упоминанием GPT-5: релизы, бенчмарки, изменения цен. Полные характеристики, провайдеры и сравнения — в карточке модели.
-
Память внутри цикла: In-Process Retrieving ускоряет агентов в 83 раза
Исследование показывает, что перенос базы знаний внутрь контура работы LLM-агента снижает задержку с сотен миллисекунд до микросекунд, устраняя избыточные действия модели.
-
Архитектура важнее модели: как топология сетей агентов влияет на безопасность
Исследование ICML 2026 показало: способ соединения ИИ-агентов (топология, роли, память) критически меняет риск взлома. Безопасная конфигурация в одной задаче может стать самой уязвимой в другой.
-
LongCat-2.0: 1.6 трлн параметров, MIT-лицензия и победа над Gemini 3.1 Pro
Meituan выпустила первую полностью открытую LLM с архитектурой MoE на 1.6 трлн параметров. Модель демонстрирует лидерство в задачах программирования и обходит проприетарные аналоги, используя собственные AI-ASIC.
-
Meituan выпустила LongCat-2.0: 1.6 трлн параметров и 1M контекста на отечественных ASIC
Meituan представила открытую MoE-модель LongCat-2.0 с 1.6 трлн параметров и нативным контекстом в 1 млн токенов. Обучение и инференс прошли полностью на китайских AI-ASIC без использования NVIDIA.
-
GPT-5.6 и Claude Fable 5: анализ эффективности токенов и бенчмарков
Анализ Pareto-фронт оптимизации показывает, что производительность LLM растет логарифмически, а лимит кодовых задач составляет ~70% независимо от вычислений.
-
NVIDIA HORIZON: 100% успех в RTL-дизайне через автономные Git-репозитории
Исследователи NVIDIA представили HORIZON — автономный AI-агент, который самостоятельно проектирует аппаратное обеспечение, используя Git как среду выполнения. Система достигла 100% прохождения бенчмарков, эволюционируя к
-
pxpipe: как превращение текста в картинки снизило счет за Claude на 70%
Проект pxpipe предлагает радикальный метод экономии токенов в LLM: прокси-сервер конвертирует объемный контекст (системные промпты, логи, историю) в PNG-изображения. Это снижает затраты на 59–70% за счет более высокой пл
-
NVIDIA представила ASPIRE: роботы, которые учатся на ошибках
NVIDIA, совместно с ведущими университетами, выпустила фреймворк ASPIRE. Это система непрерывного обучения, которая не просто пишет код для роботов, но и сохраняет успешные решения в библиотеку навыков, достигая 31% успе
-
MultAttnAttrib: Атрибуция ответов без дообучения за 1/7 времени
Исследователи представили MultAttnAttrib — метод атрибуции источников в мультимодальных QA-системах, который работает без дообучения, превосходит промптинг и сопоставим с GPT-5.4.
-
Thinking Machines: Как обучить LLM инвестиционному чутью лучше GPT и Claude
Лаборатория Thinking Machines показала, что промпт-инжиниринг не спасает фронтьер-модели от ошибок в финансах. Их кастомная модель на базе Qwen3-235B превзошла GPT-5.4 и Claude по точности фильтрации информации, затратив
-
Fable 5 в Veai: бьет GPT-5.5 и Opus 4.8 по SWE-Bench Pro
Модель Fable 5 доступна в Veai, демонстрируя лидерство в коде и кибербезопасности. Однако высокая стоимость токенов требует осторожности.
-
Fable 5 от Anthropic: новый рекорд в AI-фрилансе, но люди всё ещё нужны
Модель Fable 5 от Anthropic установила рекорд в 16,1% автоматизации реальных freelance-задач по бенчмарку CAIS, обогнав GPT-5.5 и Opus 4.8, однако полная замена человека пока невозможна.
-
Fable 5 автоматизирует 16% фриланса: новый лидер RLI
Лаборатория CAIS представила результаты Remote Labor Index: Fable 5 стал первым ИИ, который качественно выполняет реальные заказы лучше половины конкурентов, обогнав GPT-5.5 и Opus 4.8.
-
GPT-5.4 vs. арабские диалекты: кто лучше оценивает культуру?
Исследование показало, что GPT-5.4 стал самым надежным автоматическим судьей для оценки арабского языка, но модели все еще плохо справляются с культурным контекстом иракского диалекта.
-
Anthropic вернул Claude Fable 5: новые фильтры, цены и сравнение с GLM-5.2
После приостановки из-за экспортных ограничений США Anthropic вернула флагманскую модель Fable 5. Компания внедрила новый классификатор безопасности, блокирующий 99% обходов, и предложила отраслевую шкалу оценки уязвимос
-
4B-модель Microsoft бьет GPT-5.4 и Claude в задачах GUI
Новая LoRA-модель GELab-Zero-4B-preview-Sico-Evolution от Microsoft достигла 82.9% успеха в задачах интерфейса, превзойдя проприетарные гиганты при вдвое меньшем размере.
-
GPT-5.6: Мощь, но нет доступа. OpenAI меняет правила игры
OpenAI представила линейку GPT-5.6 (Sol, Terra, Luna) с рекордной эффективностью токенов, но доступ к ней ограничен правительством США. Разбираем цены, бенчмарки и стратегию «агентного» ИИ.
-
Anthropic вернула Fable 5: детали, цены и новые фильтры безопасности
После двухнедельного запрета на экспорт Anthropic возобновляет доступ к модели Fable 5. Разбираем, как изменились правила использования, цены и почему модель теперь блокирует больше легитимных запросов.
-
GLM-5.2: Z.ai сокращает разрыв с лидерами за 10 недель
Z.ai выпустила GLM-5.2 с открытыми весами, улучшив Intelligence Index на 11 пунктов. Модель обходит GPT-5.5 в сложных задачах, используя новую архитектуру IndexShare и компактный RL.
-
NVIDIA BioNeMo: AI-агенты для биологии достигли 100% успеха
NVIDIA выпустила BioNeMo Agent Toolkit, превращающий биомолекулярные модели в вызываемые навыки для AI-агентов. Бенчмарки показывают рост успешности задач с 57% до 100%.
-
NVIDIA ENPIRE: Роботы учатся сами. И Tencent с 10k GPU
NVIDIA представила ENPIRE — систему автономного улучшения политик управления роботами. Tencent раскрыла детали ARGUS для обучения кластеров в 10 000 GPU. Разбираем, как ИИ-агенты берут управление в реальный мир.
-
Китайские ретрансляторы Claude: как обходят санкции и демпингуют рынок
В Китае сформировался серый рынок API-ретрансляторов, перепродающих западные модели (Claude, GPT) по ценам в 5–10 раз ниже официальных. Это создает экзистенциальную угрозу для локальных разработчиков ИИ.
-
OpenAI и Trail of Bits: ИИ-модель GPT-5.5-Cyber патчит open source
OpenAI запустила инициативу Patch the Planet совместно с Trail of Bits, используя модель GPT-5.5-Cyber для автоматического поиска уязвимостей и написания патчей в критически важных open-source проектах.
-
OpenAI Daybreak: GPT-5.5-Cyber и автоматизация патчей
OpenAI представила GPT-5.5-Cyber с рекордными результатами на CyberGym (85.6%) и обновленный Codex Security для автоматического поиска и исправления уязвимостей.
-
Claude Sonnet 5 и битва за суверенитет: Итоги недели AI
Anthropic выпустила Claude Sonnet 5, но фокус сместился на политические и юридические последствия «Mythos Moment». Разбор рисков open-weight моделей, роли Первой поправки и уроков DeepMind.
-
ParallelKernelBench: Почему LLM пока не умеют писать быстрые multi-GPU ядра
Новый бенчмарк ParallelKernelBench показал, что даже топовые модели вроде GPT-5.5 и Gemini 3 Pro не могут эффективно оптимизировать коммуникацию между GPU, решая менее трети задач быстрее базового PyTorch.
-
NVIDIA BioNeMo: AI-ученые завершают задачи на 100% с удвоенной эффективностью
NVIDIA представила BioNeMo Agent Toolkit, превращающий LLM в автономных исследователей. Бенчмарки показали рост успешности задач с 57% до 100% и двукратное снижение потребления токенов.
-
GPT-5 Pro решил 3-летнюю загадку иммунологии: как ИИ ускорил науку
Иммунолог Дерья Унутмаз использовал GPT-5 Pro для анализа данных, которые его лаборатория не могла интерпретировать три года. Модель выявила механизм влияния дексоза на развитие Т-клеток, доказав способность ИИ к создани
-
OpenAI и Broadcom представили чип Jalapeño для LLM
OpenAI и Broadcom анонсировали первый специализированный процессор Jalapeño, созданный для ускорения вывода больших языковых моделей. Устройство разработано за 9 месяцев и оптимизировано под модели GPT-5.
-
SkillOpt: Microsoft превратила навыки агентов в обучаемые параметры
Исследователи Microsoft представили SkillOpt — метод оптимизации промптов, который достигает +23.5 баллов на бенчмарках без изменения весов модели, используя текстовые параметры как обучаемые переменные.