大厂职场观察者
07-16·测试·5年+
DeepSeekV4变强了吗?
6月底DeepSeek又更新了一波,重点不是模型能力迭代,而是推理速度最高提升了85%。怎么做到的?搞了个叫DSpark的推测解码框架。人话解释:让一个轻量级模型先“猜”答案,主模型只负责验证对不对。相当于先让实习生打草稿,专家来审批,效率自然上去了。成本也下来了。缓存命中输入价格降到0.025元/百万token。1M上下文场景下,V4-Pro的单token算力只有V3.2的27%,KV Cache只有10%。翻译一下:跑同样的活,花的钱和算力都少了一大截。还有个事值得关注——V4已经在华为昇腾NPU上完成了适配验证。下半年昇腾950超节点批量上市后,Pro版价格可能大幅下调。到时候用国产算力跑国产最强模型,成本还能再降。
发布于 北京
分享
评论
未登录
友善发言
image-upload
评论
加载中