OpenAI 公布自研芯片 Jalapeño 测试结果,能效与延迟领先英伟达现行产品

OpenAI 公布其首款自研推理芯片 Jalapeño 的首批测试数据:在 GPT-OSS 120B、DeepSeek R1 670B 和 Kimi K2.5 1T 三款模型上,峰值吞吐下单位功耗产出的 AI 工作量是对比系统的 1.5 至 1.9 倍,端到端延迟低 1.7 至 3.6 倍,高交互场景性能高 2.1 至 4.1 倍。芯片额定功耗 700 瓦,实测持续功耗不高于 550 瓦。

该芯片由 OpenAI 与博通合作开发,对标基准测试中领先的英伟达 GB300,但未与刚开始出货的英伟达新一代 Vera Rubin 比较,也不用于模型训练。OpenAI 计划今年年底前在自有算力设施中部署该芯片,第二代已在深入开发,第三代正在设计。

OpenAI | Bloomberg

本站提供的一切软件、教程和内容信息仅限用于学习和研究目的;不得将上述内容用于商业或者非法用途。本站所有信息均来自网络,版权争议与本站无关。您必须在下载后的24个小时之内,从您的电脑或手机中彻底删除上述内容。如果您喜欢该程序,请支持正版,购买注册,得到更好的正版服务。如有侵权不妥之处请致信 E-mail:[email protected] 我们会积极处理。敬请谅解!