夜勤月
2天前·AI领域创作者
Fable 5发布,写代码实测有多强?
我真的是醉了,又来一个"程序员要失业"热搜。Anthropic 的 Fable 5,SWE-Pro 编程基准 80.3% 号称碾压全场。天天跟代码打交道的我,看到就烦。我实测过 Claude Code、Cursor、Copilot。样板代码补注释改 bug 确实快。但一碰复杂架构跨系统联调业务逻辑,AI 就开始胡扯。它最擅长不是替代你,是让你产生"它好像懂了"幻觉,然后你在它生成屎山里慢慢收拾。80.3% 漂亮,但基准跟真实项目两码事。测试集固定真实需求在变;测试能跑通不代表上线不出事。版权安全漏洞可维护性 AI 根本不替你想。你们用过吗?觉得提效神器还是高级生成器?评论区聊。
发布于 江西
分享
3
2
未登录
友善发言
image-upload
评论
加载中