微学AI
08-03·AI领域创作者
GPT-5.6 Sol
GPT-5.6 Luna
DeepSeekV4 Flash实测分享
算完月账单我再也不想换别的了
技术评测看多了容易麻木,最后说服我长期切换到V4 Flash的是月账单。七月用GPT-5.6 Luna加V4 Flash预览版混着跑,一个月花了47美元。八月换成正式版V4 Flash为主,两周下来不到18美元,质量差距日常使用几乎感觉不出来。98%的缓存命中率是关键,行业平均60%到80%,大部分token请求走缓存不用重新计算。DeepSeek没完全公开怎么做的,估计跟MoE的路由机制脱不开关系。284B总参数只激活130B,MoE在推理时只为激活参数付费,这是结构性优势。输出端$0.28/百万token的定价叠加缓存折扣,单次调用成本被压得很低。百万token的上下文窗口在这个价位也很少见,拿它跑整份技术文档做交叉引用分析时成本几乎可以忽略。当然V4 Flash也有拉胯的地方,涉及复杂数学推理和创意写作这类需要深度思考的任务,Opus 4.8和GPT-5.6 Sol仍然更强。但对大多数工程场景来说,V4 Flash的性价比已经到了让人不想换别的模型的地步。
发布于 福建
1
1
1
未登录
友善发言
image-upload
评论
加载中