Новости про GPT-5.5
3 материалов с упоминанием GPT-5.5: релизы, бенчмарки, изменения цен. Полные характеристики, провайдеры и сравнения — в карточке модели.
GPT-6 Astra (max)GPT-6 Astra (xhigh)GPT-6 Astra (high)GPT-6 Astra (medium)GPT-6 Sol (max)GPT-5.6 Sol (max)GPT-6 Astra (low)GPT-6 Sol (xhigh)GPT-5.6 Sol (xhigh)GPT-6 Sol (high)
-
NVIDIA Physis-Lang: Язык физики победил Veo 3.1 в бенчмарках
Исследователи NVIDIA, MIT и Оксфорда представили Physis-Lang — фреймворк, использующий самообучаемые физические описания для улучшения видео-моделей. Cosmos 3 теперь превосходит Google Veo 3.1 по точности симуляции закон
-
Правильный ответ ≠ Правильное решение: тест AI-мониторов на физике
Исследование показало, что AI-мониторы легко находят ошибки, когда видят верный ответ, но терпят неудачу в поиске логических дыр в рассуждениях, даже если итоговый результат верен.
-
Harbor-Index: Новый стандарт оценки AI-агентов с проходимостью <30%
Исследователи представили Harbor Adapters и Harbor-Index — инфраструктуру и метадатасет для оценки 80+ бенчмарков. Лучшая модель GPT-5.5 набрала лишь 28% на сложных задачах.