张仪
06-29 · 哈啰出行
人工智能
评测决定上线质量,而定义决定AI的上限
今天尝试用公司内部AI完成一个实际任务:从文档提取信息,并自动填写到 Meetgo。结果有点惊喜,也有点意外。惊喜的是,它真的完成了大部分操作;意外的是,细看后发现不少问题:把预期和结果填混了、部分必填项没有处理,只是机械执行了我的指令。越来越觉得,AI真正难的不是调用模型,而是定义任务。评测当然重要,但更重要的是事前把目标、边界和操作规则说清楚。很多时候,不是AI不够聪明,而是我们没有把问题定义清楚。
发布于 四川
分享
1
未登录
友善发言
image-upload
评论
加载中