微学AI
08-04·AI领域创作者
GPT-5.6降价,哪个档位性价比最高?
降价八成,我的账单真的降了多少
GPT-5.6砍了80%之后,群里都在喊高溢价时代结束了,我翻了翻榜单,明白为什么——BenchLM两百多个模型里Sol总分81.2只排第4,上面压着Claude Mythos 5、Fable 5和Opus 5,第5名是79.77分的Kimi K3,人家单次调用价格只有Sol的零头。被中国开源模型围剿,不降价真会丢单。我趁机把API改成三档路由:Luna(0.2/1.2)接批量预处理和分类,Terra(2/12)接日常生成,Sol只在每天几十道硬题上开max。跑了一周,月账单从六百多降到两百三上下,感觉质量下降的任务不到5%。最意外的是Agents' Last Exam上Terra和Luna的成绩能超过Fable 5,而成本只要它的十六分之一左右,长上下文agent任务上便宜模型是真站起来了。也得泼盆冷水:三档虽然共享105万上下文和12.8万最大输出,但Luna多轮对话偶尔会漂,Sol的ARC-AGI-3只有7.8%,还被质疑把预算上限抬到2.5万美元刷分。价格战对开发者是好事,但别被标题带节奏,拿自己的任务分布跑组回归,数据说了算。
发布于 福建
1
评论
未登录
友善发言
image-upload
评论
加载中