OpenAI Jalapeño芯片

OpenAI于今年6月宣布开发的自有AI芯片“Jalapeño”(哈拉佩尼奥),其性能近日正式揭晓。OpenAI于8月25日发布的数据显示,该芯片在与搭载NVIDIA GB200和GB300的系统对比中,电力效率最高提升1.9倍,交互式工作负载性能最高提升4.1倍,展现出卓越的性能表现。

Jalapeño是一款专为AI推理设计的定制芯片,OpenAI于6月24日公布其开发计划。该芯片的设计特点在于系统整体一体化,包括芯片、内存、网络和软件的协同优化。

特别针对交互式智能代理,Jalapeño采用了极大减少数据传输和通信延迟的设计,解决了语言模型工作负载中的瓶颈问题。通过在本地内存中保持KV缓存,以及利用大规模网络域将整个工作负载纳入系统内部,实现了请求的高速高效处理。

在开发过程中,OpenAI广泛应用自家AI模型,缩短设计、测量和验证周期,并优化计算电路,使得从初始设计到芯片流片仅用时9个月。此外,OpenAI还利用AI优化开源权重模型和加速GPT-OSS功能模块。

OpenAI使用名为“InferenceX”的基准测试工具对芯片性能进行评估。测试中,Jalapeño与搭载NVIDIA GB200和GB300的系统,结合GPT-OSS 120B、DeepSeek R1 670B和Kimi K2.5 1T三种开源模型进行了对比。

测试结果显示,Jalapeño在每千瓦吞吐量上提升了1.5至1.9倍,端到端延迟缩短至原来的1/1.7至1/3.6,在高交互性工作负载中性能提升达2.1至4.1倍。

性能对比图

预计Jalapeño将在2026年内逐步部署到OpenAI的基础设施中。第二代芯片已进入正式开发阶段,第三代设计框架也已基本确定。OpenAI还计划继续引入包括NVIDIA在内的合作伙伴加速器,用于训练和推理任务。

值得一提的是,“Jalapeño”这一名称源自墨西哥的一种辣椒品种。在2026年半导体大会“Hot Chips”上,OpenAI透露其系统中的主机CPU托盘命名为日本的“Katsu”,加速器托盘名为印度辣味咖喱“Vindaloo”,交换机托盘则名为印度菜中使用的鹰嘴豆“Chana”,整个系统以食物名称为主题统一命名。