瓦力walle
06-27·后端开发·10年+
DeepSeek发布DSpark提速60%
6月27号,DeepSeek联合北大开源了DSpark推理加速框架。已经部署在DeepSeek-V4-Flash和V4-Pro的预览版服务里了。核心数据:同等吞吐量下,单用户生成速度提升60%到85%。对比之前的MTP-1基线。技术路径是用"半自回归架构+置信度调度验证"——简单说就是小模型先生成候选token,大模型批量验证,而且根据置信度分数动态决定验证多长,不浪费算力。论文和训练代码都开在GitHub上了。DSpark这个方向选得很对。推理成本是AI公司最大的痛点之一,提速60%以上直接等于成本砍掉一大截。而且这次是和北大联合做的,学术+工程结合,论文质量有保证。值得注意的一个背景是:DeepSeek6月18号刚完成510亿融资,25号发公告说要把所有部门规模扩大一倍,估值3400亿排全球独角兽前列。一边扩招一边发技术成果,节奏卡得很紧。
发布于 山东
分享
评论
未登录
友善发言
image-upload
评论
加载中