OpenAI впервые раскрыла результаты собственного инференс-чипа Jalapeño, созданного в партнёрстве с Broadcom. На публичном бенчмарке InferenceX от SemiAnalysis чип показал в 1,5–1,9 раза больше операций на ватт, чем стойки на базе Nvidia GB200 и GB300, а также отвечал на запросы в 1,7–3,6 раза быстрее. Для интерактивных сценариев с большим количеством циклов запрос-ответ разрыв увеличивался до 2,1–4,1 раза.
Замеры проводились на моделях GPT-OSS 120B, DeepSeek R1 670B и Kimi K2.5 1T. На самой большой Kimi K2.5 заявлено 1,5-кратное превосходство по пиковой производительности на ватт и снижение задержки в 3,4 раза. Руководитель аппаратного направления OpenAI Ричард Хо отметил, что чип одновременно наращивает объём работы и ускоряет отклик, что редко удаётся в одной архитектуре. Глава компании Сэм Альтман написал в X: «мы сделали чип, и он быстрый».
Jalapeño не предназначен для продажи или аренды: OpenAI заявила, что ей не хватает вычислительных мощностей для собственных нужд, а сдерживающим фактором является энергоснабжение дата-центров. Поэтому метрика токенов на мегаватт стала ключевой. Паспортная мощность чипа — 700 Вт, но в тестах он удерживался на уровне не выше 550 Вт.
OpenAI планирует стойки по 128 чипов, полный под на 2048 ASIC с 1,7 экзафлопса 4-битных вычислений и 27,5 ТБ памяти HBM4. Разработка от дизайна до выпуска заняла девять месяцев. Второе поколение уже глубоко в разработке, третье — в работе. Небольшие коммерческие поставки ожидаются в конце 2026 года, масштабирование — в 2027 году. При этом OpenAI не отказывается от GPU Nvidia и Cerebras: Хо назвал Jalapeño лишь частью стратегии, опирающейся на «очень, очень хороших партнёров».
SemiAnalysis лично проверяла прогоны InferenceX в лаборатории OpenAI, но не выполняла полный набор тестов и не видела результаты AgentX, поэтому цифры остаются данными производителя. Аналитики SemiAnalysis считают более корректным сравнение с платформой Nvidia Vera Rubin, поскольку Jalapeño и Rubin используют HBM4. По их оценке, чип OpenAI немного выигрывает у Rubin по выходным токенам на мегаватт, но по общей стоимости токена устройства примерно равны. Часть преимущества связана не с превосходством кремния, а с тем, что OpenAI платит маржу Broadcom вместо более высокой маржи Nvidia. Сделка OpenAI с Broadcom от октября 2025 года предполагает развёртывание 10 ГВт ускорителей, спроектированных OpenAI, до 2029 года; Broadcom ориентирует рынок на 100 млрд долларов ИИ-выручки к 2027 году.
Для квартальной отчётности Nvidia событие не меняет выручку, поскольку Jalapeño находится на уровне инженерных образцов, а Rubin уже поставляется клиентам. Однако новость создаёт долгосрочный ориентир: у крупного покупателя ИИ-ускорителей появился собственный инференс-чип, который может ослабить монополию Nvidia на самом быстрорастущем сегменте. Прямого влияния на криптовалютный рынок и конкретные монеты новость не оказывает.