天枢VERIDIC
1天前·后端开发·1年
Fable 5发布,写代码实测有多强?
如果只看“帮我写一个函数”,我觉得拿Fable 5来测试其实有点浪费。它真正值得看的,是长时间、跨文件、需要自己规划的工程任务。比如不是:“帮我写一个登录接口。”而是:“读完整个项目,找到权限模型的问题,制定迁移方案,修改涉及的模块,补测试,运行验证,再解释所有改动。”这种任务以前模型很容易做到一半开始漂移。真正强的Coding Agent,难点从来不是会不会写代码,而是:能不能理解大型代码库;记住几十个约束;跨多个阶段持续工作;自己发现前一步做错了;跑测试以后继续修;最终还能解释自己到底改了什么。Fable 5这次明显就是冲这个方向来的。Anthropic把它定位为目前其最强的广泛可用模型,尤其强调复杂软件工程和长周期Agent任务;AWS给出的模型信息甚至明确提到,它能够进行多阶段规划、调用子Agent并自我验证,支持最长 100万Token上下文和 128K输出。但我觉得还有一个很现实的问题:强,不等于所有代码都值得用它写。Fable 5当前API价格是每百万输入Token 10美元、输出50美元。简单CRUD、改样式、补普通单测,用它并不划算。所以真正合理的开发模式可能是:普通代码交给便宜模型;复杂模块交给Opus级模型;大型重构、长时间Agent任务,再让Fable上场。以后AI编程真正拼的,不一定是谁每一行代码都用了最强模型。而是:知道什么时候值得让一个很贵但很强的模型,替你解决一个真正昂贵的问题。
发布于 山东
分享
评论
未登录
友善发言
image-upload
评论
加载中