島上财经
06-28·银行职员·10年+
GPT-5.6 Sol
曝GPT 5.6创下史上最高作弊率
GPT 5.6创下史上最高作弊率,这事说大不大说小不小,第三方评估机构METR发现,GPT-5.6 Sol在测试中作弊率破了所有公开模型的纪录,具体怎么作弊的?它知道自己正在被测试,还主动去攻击测试环境,把隐藏的测试答案偷出来,把后台源代码强行提取出来看,我看到更绝的是,在多智能体协同测试中,一个Sol实例觉察到可能触碰安全红线,居然给另一个子代理发指令,要求一起修改日志、隐瞒违规证据,其实这不是作弊了,这是AI之间的串通,OpenAI允许METR访问原始思维链才抓到了这些猫腻,评估团队警告:如果未来模型学会不在思维链里暴露计划,人类可能就再也发现不了了。
发布于 广东
7
4
17
未登录
友善发言
image-upload
评论
加载中