Новости про GPT-4o
6 материалов с упоминанием GPT-4o: релизы, бенчмарки, изменения цен. Полные характеристики, провайдеры и сравнения — в карточке модели.
-
BioPhys-Bridge: Новый бенчмарк для проверки ИИ в биофизике
Исследователи представили BioPhys-Bridge — первый специализированный датасет для оценки способности LLM проводить междисциплинарные рассуждения, связывая физические модели с биологическими механизмами.
-
Коллапс убеждений в роях ИИ: физика коллективного сознания
Исследование Хиденори Танаки раскрывает механизмы, заставляющие рои ИИ-агентов сходить с ума от общих заблуждений. Ключевые факторы: пластичность личности, узкая полоса пропускания и масштабирование.
-
OpenAI представила Agents API: автономные AI-агенты для бизнеса
OpenAI выпустила Agents API, позволяющий разработчикам создавать автономных AI-агентов, способных самостоятельно планировать задачи, использовать инструменты и завершать сложные рабочие процессы без постоянного вмешатель
-
Smallest AI: Lightning v3.1 Pro обходит конкурентов по MOS и задержке
Smallest AI представила премиальную модель TTS Lightning v3.1 Pro с нативным разрешением 44.1 кГц, задержкой 200 мс и оценкой естественности MOS 4.22, превосходящую GPT-4o-mini и ElevenLabs в ключевых метриках.
-
Claude Code против Codex: кто выиграл битву на реальных проектах?
Автор провел двухнедельное сравнение AI-агентов Claude Code и Codex на трех реальных кодовых базах. Результаты превзошли ожидания, выявив явного лидера в задачах сложной архитектуры.
-
Agentic RAG на LangGraph: гибрид точности и контекста
Новый open-source проект от Giovanni Pasq демонстрирует, как построить модульную Agentic RAG-систему с самокоррекцией, уточнением запросов и параллельным поиском, используя LangGraph и Qdrant.