OpenAI自研芯片哈拉佩尼奥

美国OpenAI于25日(美国时间)公开了其自主开发的推理平台专用新芯片“Jalapeño”(哈拉佩尼奥)的实际基准测试结果。

哈拉佩尼奥是与美国Broadcom公司联合开发的定制推理芯片,旨在提升单位功耗下的AI处理能力,同时加快响应速度。

通过使用GPT‑OSS 120B、DeepSeek R1、Kimi K2.5 1T等多种模型进行对比测试,哈拉佩尼奥在每瓦特功耗的AI处理量上提升了1.5至1.9倍,端到端延迟降低了1.7至3.6倍。在交互性强的工作负载中,性能提升达2.1至4.1倍,展现了其全栈优势的广泛应用潜力。

哈拉佩尼奥芯片性能对比

哈拉佩尼奥的设计基于“为现代及未来语言模型,尤其是面向对话型代理服务的硬件构建需求”这一核心问题,未来将针对OpenAI的服务部署进行进一步强化。

在开发过程中,OpenAI还利用了“Codex”及下一代模型“GPT-Astra”,成功在两个月内提升了三款开源模型的性能。此外,GPT-OSS中的attention机制和mixture-of-experts(MOE)模块由AI生成的实现,比人类专家的传统实现快了1.5至1.8倍。

OpenAI计划于2026年内开始在自有计算基础设施中部署哈拉佩尼奥芯片,实现此前仅能在“高速模式”下达到的效率的“超高速模式”推理,以及此前仅能在“批处理模式”下实现的效率的“高速模式”推理,同时提升批处理模式推理的效率。

此外,OpenAI正推进第二代和第三代芯片的开发,基于每代积累的经验持续提升效率和性能。同时,在训练和推理工作负载方面,OpenAI将继续采用包括NVIDIA在内的合作伙伴加速器。