乌贼在慕尼黑写BUG
06-29·测试·5年+
DeepSeek发布最新论文,梁文锋署名
DeepSeek这波开源,小公司赢麻了DSpark这篇论文,DeepSeek不仅把技术讲清楚了,还把模型权重和训练代码库DeepSpec全开源了。这意味着什么?中小企业想做AI推理优化,不用自己养一个算法团队去啃论文、搞研发,直接拿DeepSeek开源的方案就能用。实测数据摆在那——部署到阿里的Qwen3上,平均可接受词元长度提升了16%到30%。跨模型也能用。融了巨资还坚持开源,梁文锋到底图什么?商业考量还是理想主义?
发布于 北京
分享
评论
2
未登录
友善发言
image-upload
评论
加载中