💻 OpenAI показала первые результаты инференс-чипа Jalapeño

На Hot Chips 25 августа OpenAI озвучила цифры Jalapeño — своего ASIC для инференса, созданного с Broadcom. По InferenceX от SemiAnalysis чип выдаёт в 1,5–1,9 раза больше работы ИИ на ватт и в 1,7–3,6 раза меньшую end-to-end задержку, чем лучшие результаты на NVIDIA GB200/GB300.

🌍 ASIC бьёт по самому дорогому месту экономики ИИ — стоимости инференса. Если цифры подтвердятся, себестоимость запросов у OpenAI снизится, а переговорная позиция против NVIDIA усилится. Массовые объёмы — 2027 год.

👤 В перспективе это железо будет определять задержку ответов в ChatGPT и API: отзывчивее агенты и голосовые режимы. Но цифры пока заявлены производителем, массовых поставок нет до 2027 года.

Источник 1: https://openai.com/index/jalapeno-first-results/ Источник 2: https://techcrunch.com/2026/08/25/openais-jalapeno-chip-is-built-for-fast-inference-at-scale-benchmarks-show/