夜勤月
08-04·AI领域创作者
GPT-5.6 Luna
DeepSeekV4 Flash实测分享
V4 Flash的杀手锏是缓存不是便宜
DeepSeek V4 Flash正式版上线后,所有人都盯着它比GPT-5.6 Luna便宜60%这个数字。但我观察到,真正的杀手锏不是价格,是约98%的缓存命中折扣。Agent场景下同一个任务会反复调用相似上下文,缓存命中率越高实际花费越低。业内普遍给90%的缓存折扣,DeepSeek给到98%,这个差距在长任务链里是碾压级的。前端代码盲测它拿了1586分,排全球第七、开源类别第三。每百万Token输入0.14美元、输出0.28美元,这个价位拿到这个能力确实离谱。284B总参数只激活130B,MoE在推理时只为激活参数付费,这是结构性优势。我的判断是,跑日常Agent任务,V4 Flash是目前最务实的选择。不是因为它便宜所以好使,是真好使还便宜。
发布于 江西
1
14
9
未登录
友善发言
image-upload
评论
加载中