坐下双手合十
11小时前·人力HR·10年+
我来爆个料
OpenAI自研芯片跑赢GB300
OpenAI第一次公布Jalapeño的实测成绩。在InferenceX测试中,它运行DeepSeek R1的端到端延迟为1.65秒,英伟达GB300系统为5.99秒;芯片功耗为700W,对比系统为1400W。运行万亿参数的Kimi K2.5时,Jalapeño也把延迟从5.31秒压到1.56秒。三组公开模型测试下来,其每瓦处理能力达到GB200、GB300系统的1.5至1.9倍。Jalapeño不负责训练模型,而是专门处理ChatGPT、Codex和API每天产生的大量推理请求。它由OpenAI设计、Broadcom完成芯片实现,计划在2026年底进入OpenAI数据中心且不对外销售。OpenAI仍需要英伟达训练更强模型,但在调用最频繁的推理环节,已经开始用自研芯片分走工作量。
发布于 上海
分享
评论
未登录
友善发言
image-upload
评论
加载中