柚子知AI遇
08-06·AI领域创作者
DeepSeekV4 Flash实测分享
DeepSeek V4 Flash真香
7月31日DeepSeek-V4-Flash正式版API上线,没开发布会,就一页文档。但Mozilla 7月的报告显示它全球月用量18.4T Tokens,OpenRouter排名第一,用量碾压所有闭源模型。我实测了一周。2840亿总参数,激活130亿,MoE架构。Agent能力是这代最大亮点:Terminal Bench 82.7分,DeepSWE 54.4分,比V4-Pro预览版强一截。深度学习在多步骤任务理解上的进步实打实,从"能回答问题"到"能完成任务"的质变。价格是真狠:输入1元/百万Token,缓存命中0.02元,输出2元。V4-Pro的三分之一到六分之一。还搞了峰谷定价,低谷时段更便宜。推理优化把成本压到这个水平,机器学习的MoE稀疏激活功不可没。但结构没变,只做了后训练。说明算法层面没迭代,纯靠后训练定向强化。长文本连贯性比Pro弱,复杂推理天花板矮一截。定位就是"经济主力版",重活得等V4-Pro正式版。
发布于 上海
分享
评论
未登录
友善发言
image-upload
评论
加载中