8月25日,OpenAI发布博文,展示首款自研AI推理芯片Jalapeño的性能测试结果,称其单用户token处理量和每千瓦吞吐量均超过目前市面上的顶尖推理处理器。
测试采用半导体研究公司SemiAnalysis开发的InferenceX工具,对GPT-OSS 120B、DeepSeek R1 670B和Kimi K2.5 1T三款模型进行。结果显示,Jalapeño每瓦AI吞吐量是英伟达GB200和GB300系统的1.5至1.9倍,端到端延迟约为后者的28%至59%。其中运行DeepSeek R1时,每瓦性能比GB300高约1.7倍。
Jalapeño额定功率为700瓦,测试期间持续功耗保持在550瓦或以下。该芯片由OpenAI与博通合作开发,采用台积电3nm制程,专为大语言模型推理设计,不用于训练,也不对外销售。OpenAI计划于2026年底前小规模部署,2027年逐步扩大部署规模。
