Релиз модели2 октября 2026 г., 03:01 МСК🤖 Auto

OpenAI GPT-6 Astra Ultrafast: в 8 раз быстрее на NVIDIA Blackwell

OpenAI запустила режим GPT-6 Astra Ultrafast в API, обеспечивший генерацию токенов в 8 раз быстрее стандартной версии за счет оптимизации под архитектуру NVIDIA Blackwell.

Баннер новости 8738

Новый режим Ultrafast уже доступен

OpenAI официально представила режим GPT-6 Astra Ultrafast, который теперь доступен через OpenAI API и для пользователей тарифов ChatGPT Work и Codex. Ключевое преимущество новой версии — радикальное снижение задержек при генерации ответов. По сравнению со стандартным режимом Astra, Ultrafast обеспечивает ускорение генерации токенов до 8 раз.

Это решение направлено на устранение узких мест в рабочих процессах, где важна скорость: от написания кода до взаимодействия с внешними инструментами (tool calls). Для разработчиков это означает сокращение циклов «написание-тестирование-отладка» и повышение отзывчивости интерактивных приложений.

Технологическая основа: NVIDIA Blackwell

Высокая производительность достигнута благодаря глубокой интеграции моделей OpenAI с архитектурой NVIDIA Blackwell. OpenAI использует собственные модели для оптимизации программного обеспечения вывода (inference), создавая высокопроизводительные ядра (kernels), которые максимально эффективно используют возможности GPU.

Philippe Tillet, руководитель направления inference в OpenAI, отметил, что глубокая инвестиция NVIDIA в инструменты и документацию позволила OpenAI создать модели, которые отлично работают с GPU Blackwell и будущими чипами Rubin. Это превращает знания в практическую производительность, влияя на задержки, пропускную способность и стоимость.

Сравнение производительности

Ниже приведены ключевые метрики сравнения режимов GPT-6 Astra:

Характеристика Astra Standard Astra Ultrafast
Скорость генерации токенов Базовая До 8x быстрее
Оптимизация Стандартная Специализированная под NVIDIA Blackwell
Основное применение Общие задачи Агенты, код, сложные workflow

Непрерывное улучшение и гибкость инфраструктуры

OpenAI подчеркивает, что оптимизация не останавливается после развертывания. Используя собственные модели для улучшения inference-софта, компания постоянно повышает скорость ответов и продуктивность инфраструктуры. Uday Ruddarraju, CTO compute в OpenAI, отметил, что программируемая платформа NVIDIA позволяет переиспользовать ресурсы для обучения, вывода и обучения с подкреплением, что улучшает утилизацию вычислений и избегает избыточного выделения ресурсов.

Как получить доступ

Разработчики могут начать использовать GPT-6 Astra Ultrafast через API уже сегодня. Подробные инструкции по доступу, ценообразованию и внедрению доступны в официальном руководстве Ultrafast Guide. Для пользователей ChatGPT Work и Codex режим также доступен в соответствующих тарифных планах.

Источник: NVIDIA Blog ↗