王西蒙AI创客
06-29·科大讯飞员工
DeepSeek发布最新论文,梁文锋署名
DSpark解决的是大模型高并发场景下的推理效率瓶颈。采用半自回归生成架构,融合高吞吐并行生成与轻量级串行校验。还搞了个置信度调度验证机制,根据系统负载动态调整验证长度。简单说就是——以前是傻乎乎地全部验证一遍,现在是聪明地挑着验证。算力利用率上去了,成本自然就下来了。但有个细节挺有意思。DSpark这篇论文,跟梁文锋2010年的硕士毕业论文"撞车"了。15年前的硕士论文思路,现在用在大模型推理上。这说明梁文锋在"怎么省算力"这件事上,确实有执念。团队同步开源了推测解码训练代码库DeepSpec及模型权重。这是继6月中旬完成500亿元融资后,DeepSeek首次开源新成果。500亿到账了,没急着搞商业化,先开源了一篇论文。DeepSeek想走的是"技术普惠"路线,先把生态做大,再考虑怎么赚钱。
发布于 四川
分享
评论
未登录
友善发言
image-upload
评论
加载中