OpenAI: собственный чип Jalapeño превзошёл Nvidia GB300 по скорости и энергоэффективности инференса

1 час назад 2 источника neutral

Главное по теме:

  • Кастомные ASIC OpenAI угрожают доминированию Nvidia в инференсе, но пока только в нише эффективности.
  • Снижение стоимости AI-вычислений может поддержать спрос на токены ИИ-сектора, например FET и RENDER.
  • Отсутствие независимых тестов и равная цена за токен требуют осторожности, несмотря на впечатляющие бенчмарки.

OpenAI впервые раскрыла результаты собственного инференс-чипа Jalapeño, созданного в партнёрстве с Broadcom. На публичном бенчмарке InferenceX от SemiAnalysis чип показал в 1,5–1,9 раза больше операций на ватт, чем стойки на базе Nvidia GB200 и GB300, а также отвечал на запросы в 1,7–3,6 раза быстрее. Для интерактивных сценариев с большим количеством циклов запрос-ответ разрыв увеличивался до 2,1–4,1 раза.

Замеры проводились на моделях GPT-OSS 120B, DeepSeek R1 670B и Kimi K2.5 1T. На самой большой Kimi K2.5 заявлено 1,5-кратное превосходство по пиковой производительности на ватт и снижение задержки в 3,4 раза. Руководитель аппаратного направления OpenAI Ричард Хо отметил, что чип одновременно наращивает объём работы и ускоряет отклик, что редко удаётся в одной архитектуре. Глава компании Сэм Альтман написал в X: «мы сделали чип, и он быстрый».

Jalapeño не предназначен для продажи или аренды: OpenAI заявила, что ей не хватает вычислительных мощностей для собственных нужд, а сдерживающим фактором является энергоснабжение дата-центров. Поэтому метрика токенов на мегаватт стала ключевой. Паспортная мощность чипа — 700 Вт, но в тестах он удерживался на уровне не выше 550 Вт.

OpenAI планирует стойки по 128 чипов, полный под на 2048 ASIC с 1,7 экзафлопса 4-битных вычислений и 27,5 ТБ памяти HBM4. Разработка от дизайна до выпуска заняла девять месяцев. Второе поколение уже глубоко в разработке, третье — в работе. Небольшие коммерческие поставки ожидаются в конце 2026 года, масштабирование — в 2027 году. При этом OpenAI не отказывается от GPU Nvidia и Cerebras: Хо назвал Jalapeño лишь частью стратегии, опирающейся на «очень, очень хороших партнёров».

SemiAnalysis лично проверяла прогоны InferenceX в лаборатории OpenAI, но не выполняла полный набор тестов и не видела результаты AgentX, поэтому цифры остаются данными производителя. Аналитики SemiAnalysis считают более корректным сравнение с платформой Nvidia Vera Rubin, поскольку Jalapeño и Rubin используют HBM4. По их оценке, чип OpenAI немного выигрывает у Rubin по выходным токенам на мегаватт, но по общей стоимости токена устройства примерно равны. Часть преимущества связана не с превосходством кремния, а с тем, что OpenAI платит маржу Broadcom вместо более высокой маржи Nvidia. Сделка OpenAI с Broadcom от октября 2025 года предполагает развёртывание 10 ГВт ускорителей, спроектированных OpenAI, до 2029 года; Broadcom ориентирует рынок на 100 млрд долларов ИИ-выручки к 2027 году.

Для квартальной отчётности Nvidia событие не меняет выручку, поскольку Jalapeño находится на уровне инженерных образцов, а Rubin уже поставляется клиентам. Однако новость создаёт долгосрочный ориентир: у крупного покупателя ИИ-ускорителей появился собственный инференс-чип, который может ослабить монополию Nvidia на самом быстрорастущем сегменте. Прямого влияния на криптовалютный рынок и конкретные монеты новость не оказывает.

Источники
OpenAI’s First Chip Beat Blackwell on…
Financefeeds 26.08.2026 09:14
Главное сегодня
Отказ от ответственности

Данный материал носит информационный характер и не является инвестиционной рекомендацией. Криптоактивы высокорискованны и волатильны — возможна полная потеря средств. Материалы могут содержать ссылки и пересказы сторонних источников; администрация не отвечает за их содержание и точность. Coinalertnews рекомендует самостоятельно проверять информацию и консультироваться со специалистами, прежде чем принимать любые финансовые решения на основе этого контента.