今日,OpenAI 正式公布了其首款定制推理芯片 Jalapeño 的首批实测性能数据。在基于开源模型 GPT-OSS 120B 的公开基准测试 InferenceX 上,该芯片的每千瓦峰值吞吐量和 Token 延迟均优于现有硬件系统。
测试统一设置为 8K 输入、1K 输出,使用标准单 token 预测,未开启推测解码。对照系统包括英伟达 GB200 和 GB300。在 GPT-OSS 120B、DeepSeek R1 670B 和 Kimi K2.5 1T 三个模型上,Jalapeño 的表现均优于对手。
OpenAI CEO 奥特曼在 X 上评价称:“我们造了一颗芯片,快得离谱。”半导体分析机构 SemiAnalysi 创始人 Dylan Patel 表示,第一代芯片通常毫无竞争力,但 OpenAI 正在打败英伟达 Blackwell,甚至 Rubin。
