AI-новости30 июня 2026 г., 23:36 МСК🤖 Auto

OpenAI и Broadcom представили чип Jalapeño для LLM

OpenAI и Broadcom анонсировали первый специализированный процессор Jalapeño, созданный для ускорения вывода больших языковых моделей. Устройство разработано за 9 месяцев и оптимизировано под модели GPT-5.

Баннер новости 2618

Специализированный ускоритель для LLM

Компании OpenAI и Broadcom (NASDAQ: AVGO) представили Jalapeño — первый «Интеллектуальный процессор» (Intelligence Processor) от OpenAI. В отличие от универсальных GPU, этот чип спроектирован с нуля исключительно для задач вывода (inference) больших языковых моделей. Архитектура минимизирует перемещение данных и балансирует ресурсы вычислений, памяти и сети, чтобы приблизить реальную утилизацию к теоретическому пиковому значению.

Чип является частью многосерийной вычислительной платформы, которую компании разрабатывают совместно. Инженерные образцы Jalapeño уже работают в лабораторных условиях на целевых частотах и энергопотреблении, выполняя нагрузки от моделей GPT-5, включая GPT-5.3-Codex-Spark.

Рекордная скорость разработки

Одним из главных достижений проекта стала скорость вывода чипа в производство. Цикл от начального дизайна до tape-out (передачи макета в производство) занял всего 9 месяцев. Это, по заявлениям участников, самый быстрый цикл разработки высокопроизводительных ASIC-чипов в истории индустрии. Ускорение стало возможным благодаря глубокой ко-разработке ПО и железа, а также использованию самих моделей OpenAI для оптимизации процесса проектирования.

Технические характеристики и партнеры

Разработка велась в тесном сотрудничестве с Broadcom (производство кремния, сетевые технологии Tomahawk) и Celestica (интеграция плат, стоек и систем). Цель — создать инфраструктуру для развертывания дата-центров масштаба в гигавайты совместно с Microsoft и другими партнерами.

Параметр Значение / Описание
Название чипа Jalapeño
Тип архитектуры Специализированный ускоритель для LLM Inference
Срок разработки 9 месяцев (от дизайна до tape-out)
Ключевые партнеры Broadcom (кремний, сеть Tomahawk), Celestica (интеграция)
Тестируемые модели GPT-5.3-Codex-Spark и другие LLM
Планируемый запуск Конец 2026 года (масштабирование до гигавайтов)

Стратегия полного стека

Запуск Jalapeño знаменует переход OpenAI к стратегии полного стека (full-stack platform). Компания теперь контролирует не только продукты и модели, но и физическую инфраструктуру. По словам президента OpenAI Грега Брокмана, это необходимо для того, чтобы сделать вычислительные мощности более доступными, а ИИ — быстрее, надежнее и дешевле для пользователей. Улучшение эффективности инфраструктуры напрямую влияет на стоимость обслуживания API и качество работы продуктов, таких как ChatGPT и Codex.

Источник: OpenAI ↗