OpenAI公布Jalapeño芯片首轮实测:自研推理基础设施迈出一步
OpenAI shared the first measured performance results for Jalapeno, its custom inference chip, after announcing the chip with Broadcom in June. The August update focused on throughput per watt and token latency, not a new chip launch.

8月25日的Hot Chips大会上,OpenAI第一次把Jalapeño的实测数字摆上了台面——这颗与博通联合开发的推理芯片,宣称在每瓦AI工作量上压过了英伟达的Blackwell系统[1][2]。
实测了什么
OpenAI此次公布的是首批基准测试结果,配套给出了测试方法的书面说明[1]。测试采用SemiAnalysis的公开基准InferenceX,覆盖GPT-OSS 120B、DeepSeek R1 670B和Kimi K2.5 1T三个开放权重模型[1][3]。
结果方面,OpenAI报告称Jalapeño在三个模型上均实现1.5倍至1.9倍的每瓦AI工作量提升,端到端延迟降低1.7倍至3.6倍[2][3]。针对高交互性负载,OpenAI测得性能提升达2.1倍至4.1倍[3]。
需要说明的是,以上数字均来自OpenAI单方面发布的测试,目前未见第三方独立复现。

*图1:OpenAI Logo(openAI / CC BY-SA 4.0,Wikimedia Commons)*
为什么这样设计
Jalapeño的设计出发点是对LLM推理两阶段的拆解:处理提示词的prefill阶段是计算密集型,逐token输出的decode阶段则受内存带宽制约[1][3]。传统系统若只针对其中一个阶段调优,在另一个阶段就可能因等待数据而丧失优势。
OpenAI的应对方式是把模型状态(包括KV cache)本地化放置,并让网络域大到足以把整个请求容纳在同一个互联系统内,从而避免阶段切换时搬运状态的开销[1]。据资料描述,OpenAI是围绕加速器、内存子系统、网络、服务软件和机架级系统一起做协同设计的[3]。

*图2:Ilya Sutskever and Sam Altman in TAU(Eladkarmel / CC BY-SA 4.0,Wikimedia Commons)*
边界在哪里
这轮更新聚焦吞吐每瓦与token延迟,并非新芯片发布。Jalapeño只做推理,不训练模型[1],计划于2026年底前部署进OpenAI自有基础设施,同时继续采购英伟达等供应商的加速器[3]。
OpenAI并未宣称Jalapeño全面超越英伟达,也未表示要放弃英伟达硬件[2]。有报道将其与谷歌、微软、亚马逊并列,称为第四家拿出自研芯片硬指标的AI玩家,并指出这四家都没有表示要离开英伟达[2]。
另需注意,检索资料中有一条标题称该芯片"比英伟达GPU便宜50%"[5],但该说法未在其他资料中出现,**该信息未经资料证实**,不宜作为事实引用。

*图3:Anti ai data center 4 censored(Catboy69 / CC BY 4.0,Wikimedia Commons)*
点评
从"宣布合作"到"公布实测",Jalapeño补齐了自研叙事里最缺的一环——可验证的数字。但基准由自己跑、方法由自己写,这套结果的成色仍待外部复现与真实部署检验。年底进自家机房,才是真正的压力测试。
参考来源
[1] OpenAI publishes first benchmarks for its Jalapeño inference ...
https://deepnoodle.ai/atlas/timeline/2026-08-25-openai-jalapeno-first-results
[2] OpenAI Jalapeño Chip Beats Nvidia 1.9x on Power [2026]
https://tech-insider.org/openai-jalapeno-chip-beats-nvidia-benchmark-2026/
[3] OpenAI Jalapeño Chip Targets Low-Latency, Power-Efficient ...
https://convergedigest.com/openai-jalapeno-inference-chip-performance/
[4] OpenAI and Broadcom unveil LLM-optimized inference chip
https://openai.com/index/openai-broadcom-jalapeno-inference-chip/
[5] OpenAI Jalapeño Chip: First Custom AI Inference Processor ...
https://aitoolsrecap.com/Blog/openai-jalapeno-chip-broadcom-inference-2026
[6] OpenAI unveils its first custom chip, built by Broadcom
https://techcrunch.com/2026/06/24/openai-unveils-its-first-custom-chip-built-by-broadcom/
本稿由 AI 生成,发布状态:pending_human_review。正式发布前以人工审核为准。