1. 主页 > 社会焦点

OpenAI公布首款自研芯片测试结果,跑赢英伟达GB200和GB300

太平洋科技快讯】据 IT 之家报道,OpenAI 官方今日一早公布了首款自研推理芯片 Jalapeño 的实测性能数据。

据悉,这款芯片面向大语言模型推理场景定制,依靠全新架构同时实现吞吐量提升与延迟降低,兼顾推理效率与响应速度,多项模型测试下能效表现优于英伟达 GB200、GB300 系统。OpenAI CEO Sam Altman 在 X 平台上表示:“我们制造了一款芯片,它的速度很快。”

两个月前,OpenAI 正式发布了这一款与博通联合研发的芯片 ( 详情可查看此前太平洋科技的报道内容:《OpenAI 发布首款自研 AI 芯片 Jalapeño:联合博通打造,9 个月完成设计至流片全流程》)。需要区分的是,Jalapeño 定位推理专用芯片,并不承担下一代 GPT 模型的训练任务。简单来说,训练负责完成模型能力学习,推理则负责处理用户的实时请求,该芯片主要聚焦后者的性能优化。

OpenAI 采用 SemiAnalysis 推出的 InferenceX 公开基准工具完成评测,测试覆盖 GPT-OSS 120B、DeepSeek R1 670B、Kimi K2.5 1T 三款大模型。测试结果显示,对比 GB200、GB300 主流 AI 系统,Jalapeño 每瓦 AI 吞吐量可达后者 1.5~1.9 倍,端到端延迟仅为对比系统的 28%~59%。

分模型具体来看,运行 GPT-OSS 120B 时,芯片每千瓦峰值吞吐量较 GB200 高出约 1.9 倍;运行 DeepSeek R1,每瓦 AI 吞吐量达到 GB300 的 1.7 倍;运行 Kimi K2.5,每瓦吞吐量为 GB300 的 1.5 倍。芯片标称功耗 700 瓦,实际测试负载下持续功耗可控制在 550 瓦及以下。

本文内容由互联网用户自发贡献,该文观点仅代表作者本人。如发现本站有涉嫌抄袭侵权/违法违规的内容,请发送邮件至 203304862@qq.com

本文链接:https://jinnalai.com/jiaodian/851990.html

联系我们

在线咨询:点击这里给我发消息

微信号:

工作日:9:30-18:30,节假日休息