Новости про GPT-5 mini
8 материалов с упоминанием GPT-5 mini: релизы, бенчмарки, изменения цен. Полные характеристики, провайдеры и сравнения — в карточке модели.
-
UrbanAgent: AI-агент для управления городом с точностью 71%
Исследователи представили UrbanAgent — систему, объединяющую LLM и инструменты для выполнения сложных городских задач. Новый бенчмарк Urban-Eval показал, что метод превосходит аналоги на 10%.
-
ELO-рейтинг для AI Control: как измерить гонку вооружений между Red и Blue Team
Исследователь Ram Potham предложил методологию оценки эффективности AI Control через ELO-рейтинг, позволяющую количественно сравнить скорость развития атакующих и защитных моделей.
-
GPT-5-mini vs GPT-4.1-mini: Почему промпты работают по-разному
Исследование ICLR 2026 показало, что архитектурные различия между моделями OpenAI критически влияют на эффективность методов рассуждения. То, что помогает одной модели, может сломать другую.
-
Microsoft представила Flint: язык визуализации для AI-агентов
Исследователи Microsoft создали промежуточный язык Flint, позволяющий LLM-агентам генерировать сложные графики из простых спецификаций с точностью выше, чем прямая генерация кода.
-
Память внутри цикла: In-Process Retrieving ускоряет агентов в 83 раза
Исследование показывает, что перенос базы знаний внутрь контура работы LLM-агента снижает задержку с сотен миллисекунд до микросекунд, устраняя избыточные действия модели.
-
Архитектура важнее модели: как топология сетей агентов влияет на безопасность
Исследование ICML 2026 показало: способ соединения ИИ-агентов (топология, роли, память) критически меняет риск взлома. Безопасная конфигурация в одной задаче может стать самой уязвимой в другой.
- Claude, Gemini, GPT и Grok заперли в одном виртуальном городе: кто выжил через 15 дней
-
OpenAI представила GPT-5.4 mini и nano: высокая производительность по доступной цене
Новые модели GPT-5.4 mini и nano от OpenAI предлагают почти флагманскую производительность при значительно меньшей стоимости.