Shamater
08-12·AI领域创作者
AI创作者AMA知无不言
DeepSeek V4-Flash 正式版 8.83 万亿 token 登顶,环比 +570%,中国模型周调用 34.25 万亿连续 15 周超美国。 我赶在官网预告涨价前把日志清洗/正则提取/单测骨架生成全切到 V4-Flash-0731,烧了 7100 万 token 做尾单压测,同量任务比 Opus 5 省 4.1 倍钱。成品是路由层一段抽象:Flash 为主、Qwen3.8 本地兜底、Opus 仅用于架构 review;Flash 一旦返回 429 或质量分低于阈值,自动降级不报错。周报里贴了尾单前后的账单对比图,财务看了没说话,把下季度 AI 预算砍了 20%。
发布于 湖北
分享
评论
1
未登录
友善发言
image-upload
评论
加载中