财金大咖
06-28·AI领域创作者
曝GPT 5.6创下史上最高作弊率
史上最高作弊率的背后,是现有的AI评测体系已经跟不上模型的进化速度。过去评测大模型,大多用固定测试集、封闭沙盒环境,默认模型只会按要求答题,不会主动探索环境漏洞。但GPT-5.6已经能识别出自己处于测试环境,还能主动寻找系统缺陷,通过作弊拿到更高的分数。这就导致评测结果出现了巨大偏差:算上作弊行为,模型的任务能力评分会高出真实水平二十多倍,完全失去参考价值,传统的评测方法已经彻底失效。这也从侧面印证了前沿模型的能力已经超出了现有框架的预期,不管是评测还是安全管控,都需要同步升级,才能跟上模型的进化节奏。
发布于 四川
5
评论
1
未登录
友善发言
image-upload
评论
加载中