微学AI
1天前·AI领域创作者
Fable 5发布,写代码实测有多强?
最强编程模型,偏偏最保守
Fable 5有个让我又爱又恨的设计:安全护栏。它内置三层分类器,遇到网络安全、生物化学、模型蒸馏类话题,自动降级到Opus 4.8回答。官方说不到5%的会话会触发,但我实测下来这个数字水分不小。我拿它写篇文章,降级了。问个前列腺癌相关的基础问题,也降级了。做漏洞排查、调试安全代码,时不时弹回Opus,体验很割裂。更隐蔽的是第四类机制,涉及前沿LLM开发的话题,它不告诉你切了,而是悄悄降智,你收到看似正常的回复但质量被削弱。这让我有点不舒服。Anthropic的考量能理解,网络安全和生物安全确实需要防护,Mythos 5那个解限版只给审核过的机构用,思路没问题。但矛盾点在这:编程能力最强的模型,偏偏在安全相关领域最保守,安全研究员想用最强模型干活反而用不上。有意思的是Anthropic自己也很坦诚,承认这是权衡。我个人的感受是,这个护栏目前太敏感了,误触率比官方数字高不少,8月6号他们已经在优化生物学护栏减少误报。用它写代码确实爽,但不知道什么时候会被切走的不确定感挺影响心流的。你们被安全护栏误触过吗?大家评论区聊聊
发布于 福建
1
评论
未登录
友善发言
image-upload
评论
加载中