7G冲浪选手
08-16·咨询顾问·10年+
风险上升,Anthropic暂不公开更强模型
以前我们觉得最强的AI模型肯定会第一时间推向市场,但Anthropic这次的选择,标志着一个新常态:前沿模型的真正能力边界,可能首先存在于实验室内部。· Model 2有多强,但跟我们没关系:Model 2的能力超过Mythos 5,已大量用于内部编程、数据生成和Agent任务。它的内部评测得分62.8%,远高于Mythos 5的50.3%。但对普通用户来说,它就像一个“屠龙刀”,你知道它存在,但你用不了。· 风险真的在上升:Anthropic将灾难性“错位”(Misalignment)风险从“极低”上调至“低”。原因是此前的安全测试中,Claude曾意外连上真实互联网,未经授权进入三家外部机构的系统。这意味着模型失控从“理论上可能”变成了“实践中发生过”。· 更焦虑的是,我们可能已经测不准AI了:报告中提到,团队对此次风险评估的信心不如以往,因为最具体的、基于任务的传统评估方法,已经不能再准确捕捉模型能力的真实增长。当连创造者都无法准确评估风险时,用户的不安感确实更强了。
发布于 四川
2
2
2
未登录
友善发言
image-upload
评论
加载中