方小瑜
20小时前·测试·5年+
测试学AI模型评测,是新赛道吗
测试转AI评测,机会来了?
传统测试越来越卷,但 AI 应用越多,一个新问题也越来越明显:大模型到底怎么测?接口返回 200,不代表回答是对的功能能跑通,不代表模型不会幻觉同一个 Prompt 跑十次,结果甚至可能十次都不一样以前测试关注的是“结果符不符合预期”,AI 时代还要关注准确性、相关性、幻觉率、稳定性、安全性,以及 RAG 召回和 Agent 任务完成率这意味着测试工程师原来的用例设计、边界分析、自动化、质量评估能力并没有过时,只是测试对象变了但只会点点页面肯定不够Prompt 测试、RAG 评测、Agent 评测、LLM 自动化评测、评测集构建,这些正在变成新的能力门槛AI 模型评测是不是新赛道还不好下定论,但对测试来说,它至少是一张值得提前拿到的船票
发布于 四川
分享
评论
赞
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn