OpenAI首款自研AI芯片Jalapeño性能首秀:每瓦吞吐量领先GB300达1.7倍
8月26日,OpenAI于当地时间8月25日正式发布博文,首次公开展示其首款自研AI推理芯片Jalapeño的性能数据。官方宣称,无论是在单用户token处理量还是每千瓦吞吐量方面,该芯片均超越了目前市面上顶尖的AI推理处理器,标志着OpenAI在自研硬件领域迈出了关键一步。
OpenAI采用半导体研究公司SemiAnalysis开发的公共基准测试工具InferenceX进行测试,覆盖三款主流大模型:GPT-OSS 120B、DeepSeek R1 670B和Kimi K2.5 1T,并与目前行业领先的AI系统GB200和GB300进行对比。
在能效方面,Jalapeño表现尤为突出:运行GPT-OSS 120B时,每千瓦峰值吞吐量比GB200系统高出约1.9倍;运行DeepSeek R1时,每瓦性能比GB300高出约1.7倍;运行Kimi K2.5时,每瓦性能比GB300高出约1.5倍。
Jalapeño的端到端延迟约为对比系统的28%至59%,说明其在快速响应方面具有明显优势,这对于需要低延迟的实时AI应用至关重要。Jalapeño的额定功率为700瓦,但在测试工作负载期间,其持续功耗保持在550瓦或以下,显示出良好的能效控制能力。
公开信息显示,Jalapeño采用3nm工艺打造,集成6个HBM3E内存模块,据传采用chiplet设计。OpenAI在博文中确认,该芯片是专为推理工作负载优化的专用处理器,而非通用GPU。不过,与博文同时发布的宣传片中,并未透露核心数量、晶体管密度或具体内存带宽等核心指标。