键盘敲碎了雾霾
2天前·AI领域创作者
Fable 5发布,写代码实测有多强?
Fable 5发布,写代码实测有多强?
Anthropic终于放出了Claude Fable 5,首个面向公众的Mythos级模型。编程能力官方说“较Opus 4.8翻倍”,我一开始不信,看了benchmark吓一跳:SWE-bench Pro:80.3%(Opus 4.8是69.2%,GPT-5.5仅58.6%)FrontierCode(测试代码被真实开源项目接受合并):29.3%,第二名才13.4%最夸张的是Stripe 5000万行Ruby代码库迁移,原本团队要干两个多月,Fable 5 一天完成(据说是内部测试,真实性待考证)我实际试了几个复杂算法题和React组件重构,确实感觉它推理更“聪明”,能主动问清楚需求边界,而不是瞎猜。但也有缺点:安全护栏很严,有些涉及敏感数据的场景直接拒绝,甚至会“降智”输出简单模板。一句话:编程和Agent领域,目前它就是最强,没有之一。但价格也不便宜,你们会为这个能力买单吗?#Claude #Fable5 #AI编程 #Anthropic
发布于 湖南
分享
评论
1
未登录
友善发言
image-upload
评论
加载中