Taylor
07-08 · 猎头顾问
Deepseek自研推理芯片
最近市场传出DeepSeek正在布局自研推理芯片,我觉得这背后释放了一个很明确的信号:头部大模型公司的竞争,正在从“谁的模型更强”逐渐转向“谁的推理成本更低”。DeepSeek大概率不会去做另一颗“H100”,而是会对标Google TPU、AWS Inferentia这类推理ASIC,围绕MoE、KV Cache、FP8/INT8等技术进行深度优化,把每个Token的成本和功耗压到极致。如果这条路线跑通,未来的大模型竞争可能会进入一个新阶段:训练依赖通用GPU,推理依赖自研芯片,模型公司最终都会变成“模型+系统+芯片”一体化公司。
发布于 浙江
分享
1
未登录
友善发言
image-upload
评论
加载中