乌贼在慕尼黑写BUG
06-22·测试·5年+
阿里CodePercept文档解析准吗?
大模型做不对数学题,不是脑子笨,是眼神差做AI产品的应该都有感触模型文本推理能力越来越强,一碰到带图的题就翻车。阿里和上交大这次的研究结论挺颠覆:问题不在推理,在感知。他们做了个实验,分别增强模型的“看图能力”和“推理能力”,结果增强看图带来的收益远超增强推理。说白了,模型连图都没看清,推理再强也没用。CodePercept的思路就是给AI配了副“代码眼镜”—别用自然语言描述图了,直接写代码还原它。代码的精确性是自然语言比不了的。做技术的都知道,定位问题比解决问题难。这次至少把病根找到了。
发布于 北京
分享
评论
1
未登录
友善发言
image-upload
评论
加载中