Специализированный ускоритель для LLM
Компании OpenAI и Broadcom (NASDAQ: AVGO) представили Jalapeño — первый «Интеллектуальный процессор» (Intelligence Processor) от OpenAI. В отличие от универсальных GPU, этот чип спроектирован с нуля исключительно для задач вывода (inference) больших языковых моделей. Архитектура минимизирует перемещение данных и балансирует ресурсы вычислений, памяти и сети, чтобы приблизить реальную утилизацию к теоретическому пиковому значению.
Чип является частью многосерийной вычислительной платформы, которую компании разрабатывают совместно. Инженерные образцы Jalapeño уже работают в лабораторных условиях на целевых частотах и энергопотреблении, выполняя нагрузки от моделей GPT-5, включая GPT-5.3-Codex-Spark.
Рекордная скорость разработки
Одним из главных достижений проекта стала скорость вывода чипа в производство. Цикл от начального дизайна до tape-out (передачи макета в производство) занял всего 9 месяцев. Это, по заявлениям участников, самый быстрый цикл разработки высокопроизводительных ASIC-чипов в истории индустрии. Ускорение стало возможным благодаря глубокой ко-разработке ПО и железа, а также использованию самих моделей OpenAI для оптимизации процесса проектирования.
Технические характеристики и партнеры
Разработка велась в тесном сотрудничестве с Broadcom (производство кремния, сетевые технологии Tomahawk) и Celestica (интеграция плат, стоек и систем). Цель — создать инфраструктуру для развертывания дата-центров масштаба в гигавайты совместно с Microsoft и другими партнерами.
| Параметр | Значение / Описание |
|---|---|
| Название чипа | Jalapeño |
| Тип архитектуры | Специализированный ускоритель для LLM Inference |
| Срок разработки | 9 месяцев (от дизайна до tape-out) |
| Ключевые партнеры | Broadcom (кремний, сеть Tomahawk), Celestica (интеграция) |
| Тестируемые модели | GPT-5.3-Codex-Spark и другие LLM |
| Планируемый запуск | Конец 2026 года (масштабирование до гигавайтов) |
Стратегия полного стека
Запуск Jalapeño знаменует переход OpenAI к стратегии полного стека (full-stack platform). Компания теперь контролирует не только продукты и модели, но и физическую инфраструктуру. По словам президента OpenAI Грега Брокмана, это необходимо для того, чтобы сделать вычислительные мощности более доступными, а ИИ — быстрее, надежнее и дешевле для пользователей. Улучшение эффективности инфраструктуры напрямую влияет на стоимость обслуживания API и качество работы продуктов, таких как ChatGPT и Codex.
Источник: OpenAI ↗
