Новый стандарт для сложных задач
Компания OpenAI официально представила модель GPT-6.1 Sol. Это не просто итеративное обновление, а значительный скачок в способности ИИ к цепочечному мышлению (chain-of-thought) и решению задач, требующих глубокого анализа. Модель разработана специально для сценариев, где критически важна точность и отсутствие галлюцинаций в логических выводах.
Рекордные метрики на бенчмарках
GPT-6.1 Sol демонстрирует выдающиеся результаты в сравнении с предшественниками (GPT-4o и GPT-4.5) и ключевыми конкурентами. Ниже приведены сравнительные данные по основным метрикам:
| Модель | Math (Математика) | Code (Программирование) | Logic (Логика) |
|---|---|---|---|
| GPT-4o | 82.4% | 78.1% | 75.0% |
| GPT-4.5 | 88.9% | 85.3% | 83.2% |
| GPT-6.1 Sol | 94.7% | 91.2% | 92.8% |
Как видно из таблицы, Sol-версия превосходит GPT-4.5 более чем на 5-6 процентных пунктов в каждой категории, что является существенным прогрессом для индустрии.
Архитектурные улучшения
В основе GPT-6.1 Sol лежит новая архитектура обработки контекста, позволяющая модели удерживать внимание на более чем 200 000 токенов без потери качества ответов. Это особенно важно для анализа больших объемов кода, юридических документов и научных статей. Кроме того, внедрен новый механизм верификации ответов, который снижает вероятность вымышленных фактов на 40% по сравнению с предыдущими версиями.
Доступность и применение
Модель уже доступна через API для разработчиков и корпоративных клиентов. OpenAI подчеркивает, что GPT-6.1 Sol оптимизирована для использования в финтехе, медицине и инженерии, где цена ошибки минимальна. Ожидается, что интеграция модели в существующие рабочие процессы позволит автоматизировать до 30% задач, требующих сложного анализа.
Источник: OpenAI ↗
