微学AI
08-04·AI领域创作者
GPT-5.6降价,哪个档位性价比最高?
降价八成,我的账单真的降了多少
GPT-5.6砍了80%之后,群里都在喊高溢价时代结束了,我翻了翻榜单,明白为什么——BenchLM两百多个模型里Sol总分81.2只排第4,上面压着Claude Mythos 5、Fable 5和Opus 5,第5名是79.77分的Kimi K3,人家单次调用价格只有Sol的零头。被中国开源模型围剿,不降价真会丢单。我趁机把API改成三档路由:Luna(0.2/1.2)接批量预处理和分类,Terra(2/12)接日常生成,Sol只在每天几十道硬题上开max。跑了一周,月账单从六百多降到两百三上下,感觉质量下降的任务不到5%。最意外的是Agents' Last Exam上Terra和Luna的成绩能超过Fable 5,而成本只要它的十六分之一左右,长上下文agent任务上便宜模型是真站起来了。也得泼盆冷水:三档虽然共享105万上下文和12.8万最大输出,但Luna多轮对话偶尔会漂,Sol的ARC-AGI-3只有7.8%,还被质疑把预算上限抬到2.5万美元刷分。价格战对开发者是好事,但别被标题带节奏,拿自己的任务分布跑组回归,数据说了算。
发布于 福建
1
评论
赞
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn