面试官:RAG明明把正确答案检索出来了,为什么AI还是答错?
回答: 检索到不等于模型用了。
要把链路拆开看:Query改写、向量检索、召回结果、Rerank、Prompt拼接、模型生成。
测试时最好逐层记录输入输出,定位到底是没召回还是召回了但没用。
下一问:
AI测试和普通接口自动化最大的区别是什么?
评论区回复【AI测试开发】发答案
声明:本文内容由脉脉用户自发贡献,部分内容可能整编自互联网,版权归原作者所有,脉脉不拥有其著作权,亦不承担相应法律责任。如果您发现有涉嫌抄袭的内容,请发邮件至maimai@taou.com,一经查实,将立刻删除涉嫌侵权内容。