Новый стандарт скорости: GPT-5.6 Sol Ultrafast
13 августа 2026 года OpenAI анонсировала новый сервисный уровень Ultrafast, который позволяет запускать модель GPT-5.6 Sol со скоростью до 14 раз быстрее, чем в стандартном режиме обработки. Ключевая метрика производительности — генерация до 750 выходных токенов в секунду. Это решение позиционируется не просто как ускорение, а как способ сделать передовой интеллект доступным для задач, где каждая секунда имеет значение.
Технологическая основа: Партнерство с Cerebras
Высокая скорость достигается за счет инфраструктуры чипов Cerebras. Это позволяет OpenAI использовать свою самую интеллектуальную модель (Sol) без компромиссов в качестве ответа, которые обычно возникают при выборе более быстрых, но менее мощных специализированных моделей. Технология снижает задержку между наблюдением сигнала и принятием решения, что критично для автоматизации сложных процессов.
Ключевые сценарии применения
OpenAI выделяет несколько областей, где Ultrafast меняет парадигму работы:
- Реагирование на инциденты: Анализ логов и кода в реальном времени во время сбоя системы.
- Финансовые исследования: Оценка транзакций и рыночных сигналов до изменения условий.
- Голосовая поддержка: Решение сложных задач без пауз в разговоре с клиентом.
- Коммерция: Персонализация рекомендаций и помощь при оформлении заказа до того, как покупатель уйдет.
- Научные исследования: Превращение ночных пакетных вычислений в интерактивные сессии с быстрыми итерациями.
Результаты пилотного тестирования
Среди первых пользователей — компании Jane Street, Podium, Basis и Rogo. Они отмечают, что скорость позволяет создавать синхронные интерфейсы, ранее невозможные из-за ограничений интеллекта моделей. Например, в голосовой поддержке Podium скорость полностью изменила опыт взаимодействия, а в Jane Street разработчики смогли работать в более сфокусированном режиме.
| Параметр | Значение / Описание |
|---|---|
| Модель | GPT-5.6 Sol |
| Режим | Ultrafast |
| Скорость генерации | До 750 токенов/сек |
| Ускорение | До 14x по сравнению со Standard |
| Инфраструктура | Чипы Cerebras |
| Доступность | API (ограниченный превью-доступ) |
Доступность и планы
На данный момент режим Ultrafast доступен в ограниченном превью через OpenAI API для избранных клиентов. Компания планирует расширять доступ по мере роста вычислительных мощностей. Для бизнеса, требующего передовой интеллектуальной обработки в реальном времени, открыта регистрация в лист ожидания для получения уведомлений об расширении доступа.
Источник: OpenAI ↗
