燕子不南飞
08-07·奇安信员工
GPT-5.6 Luna
DeepSeekV4 Flash实测分享
V4 Flash上线后所有人盯着它比GPT-5.6 Luna便宜60%。但我观察到的真正结构性优势不是价格,是约98%的缓存命中折扣。Agent场景下同一个任务反复调用相似上下文,缓存命中率越高实际花费越低。业内普遍给90%的缓存折扣,DeepSeek给到98%,这个差距在长任务链里是碾压级的。284B总参数只激活130B,MoE推理时只为激活参数付费。便宜是结果,不是原因。护城河不在定价策略,在架构优势。别人想跟进得从底层改起。
发布于 江西
分享
评论
未登录
友善发言
image-upload
评论
加载中