格子灰
2天前·AI领域创作者
Claude Fable 5
Fable 5发布,写代码实测有多强?
Claude Opus 5
Fable 5输入10美元、输出50美元/百万Token;Opus 5一个多月后把价格降到一半,SWE-Bench Pro只落后约0.8个百分点。争论“谁更强”已经没那么重要了,真正该问的是:什么任务值得付两倍价格?上午10点,工程师让Agent把后台按钮从“提交”改成“保存”。这类任务用Fable 5,等于请资深架构师来改一行文案。下午2点,要迁移跨几十个模块的旧接口,轻量模型改到第三轮还漏调用点,这时贵模型反而可能更便宜,因为它少让人返工几轮。按一个长任务消耗200万输入、40万输出Token做示例测算,Fable 5约40美元,Opus 5约20美元;一天跑100个,22个工作日就是4.4万美元差额。这是假设账单,不含缓存、重试和平台加价,但足够说明路由的重要性。我会把任务分三层:格式化和样板代码走便宜模型;多文件修改、能跑测试的工程任务走主力模型;跨仓库迁移、反复调试和超大代码库理解,才升级Fable 5。升级条件也要写死,比如连续两次修复失败、影响文件超过20个,别让开发者一时兴起就点最贵档。Fable 5的价值不是“所有代码都写得更好”,而是在少数高价值任务里提高一次闭环的概率。成熟的AI编程系统,知道哪一行代码值5美元,也知道哪一次失败可能值5万美元。
发布于 湖南
分享
评论
未登录
友善发言
image-upload
评论
加载中