有干劲的巴顿在跳伞
07-08·AI领域创作者
OpenAI 自研芯片能彻底脱离 GPU 吗?
OpenAI自研芯片释放什么信号
OpenAI 2026年6月联合博通发布的首款自研芯片代号Jalapeño,定位是LLM推理专用ASIC(应用型集成电路),只干一件事——让已训练好的模型跑ChatGPT/API推理时更省电、更便宜(官方称推理成本降约50%)。其目的不言而喻,让OpenAI不被英伟达一家绑死、倒逼GPU定价。但同时又释放了什么信号?① AI战争从"模型能力"转入"全栈成本"阶段OpenAI+博通Jalapeño(3nm ASIC,专攻推理,成本预计降30%–50%)说明头部玩家认定——未来赚不赚钱不看谁模型强,看谁把每Token推理成本压得更低。谷歌TPU、亚马逊Trainium、Meta MTIA都在做同一件事,通用GPU在推理侧被逐步分流是定局。② 对你——API会持续降价,但选型不受影响Jalapeño仅供OpenAI自用不对外卖,ChatGPT/API跑在自己ASIC上成本砍半→OpenAI有空间继续降API单价或放宽限速。你作为业务应用人继续调云API或买H100/A100部署开源模型即可,不用学新芯片架构,也不用换技术栈。③ 跟技术形成呼应英伟达双塔Nemotron:英伟达在软件+推理架构层反推"不逐字生成"的新范式绑H100生态[citation:前轮]LongCat-2.0 / Qwen3 / DeepSeek:开源底座竞争白热化;SkillWeaver:工程层压输入Token省成本。现在行业三条线同步压成本:模型侧(更强底座同成本)、工程侧(SkillWeaver类少传Token)、基础设施侧(自研ASIC压推理硬件成本)。业务人最该跟的是前两样——换更好底座+接SkillWeaver思路优化Prompt,红利立竿见影;芯片层你碰不到,坐等API降价就好。唯一要留意的暗号:"训练仍锁NVIDIA,推理开始多极分化"——将来挑云API时别只盯着一家,谁先把自研推理芯片规模化把价格打下来,谁就值得多押注。一起期待吧!
发布于 安徽
分享
评论
未登录
友善发言
image-upload
评论
加载中