Релиз модели13 августа 2026 г., 20:00 МСК🤖 Auto

OpenAI представила GPT-5.6 Sol Ultrafast: 750 токенов/сек на базе Cerebras

OpenAI запустила режим Ultrafast для модели GPT-5.6 Sol, обеспечивающий скорость до 750 токенов в секунду. Технология работает на чипах Cerebras и доступна через API для критически важных задач в реальном времени.

Баннер новости 5726

Новый стандарт скорости: GPT-5.6 Sol Ultrafast

13 августа 2026 года OpenAI анонсировала новый сервисный уровень Ultrafast, который позволяет запускать модель GPT-5.6 Sol со скоростью до 14 раз быстрее, чем в стандартном режиме обработки. Ключевая метрика производительности — генерация до 750 выходных токенов в секунду. Это решение позиционируется не просто как ускорение, а как способ сделать передовой интеллект доступным для задач, где каждая секунда имеет значение.

Технологическая основа: Партнерство с Cerebras

Высокая скорость достигается за счет инфраструктуры чипов Cerebras. Это позволяет OpenAI использовать свою самую интеллектуальную модель (Sol) без компромиссов в качестве ответа, которые обычно возникают при выборе более быстрых, но менее мощных специализированных моделей. Технология снижает задержку между наблюдением сигнала и принятием решения, что критично для автоматизации сложных процессов.

Ключевые сценарии применения

OpenAI выделяет несколько областей, где Ultrafast меняет парадигму работы:

  • Реагирование на инциденты: Анализ логов и кода в реальном времени во время сбоя системы.
  • Финансовые исследования: Оценка транзакций и рыночных сигналов до изменения условий.
  • Голосовая поддержка: Решение сложных задач без пауз в разговоре с клиентом.
  • Коммерция: Персонализация рекомендаций и помощь при оформлении заказа до того, как покупатель уйдет.
  • Научные исследования: Превращение ночных пакетных вычислений в интерактивные сессии с быстрыми итерациями.

Результаты пилотного тестирования

Среди первых пользователей — компании Jane Street, Podium, Basis и Rogo. Они отмечают, что скорость позволяет создавать синхронные интерфейсы, ранее невозможные из-за ограничений интеллекта моделей. Например, в голосовой поддержке Podium скорость полностью изменила опыт взаимодействия, а в Jane Street разработчики смогли работать в более сфокусированном режиме.

Параметр Значение / Описание
Модель GPT-5.6 Sol
Режим Ultrafast
Скорость генерации До 750 токенов/сек
Ускорение До 14x по сравнению со Standard
Инфраструктура Чипы Cerebras
Доступность API (ограниченный превью-доступ)

Доступность и планы

На данный момент режим Ultrafast доступен в ограниченном превью через OpenAI API для избранных клиентов. Компания планирует расширять доступ по мере роста вычислительных мощностей. Для бизнеса, требующего передовой интеллектуальной обработки в реальном времени, открыта регистрация в лист ожидания для получения уведомлений об расширении доступа.

Источник: OpenAI ↗