翻身咸鱼的人
07-15·BD商务·5年+
大模型时代,测试人的新机会在哪里?
大模型时代,测试人的机会不是被挤压了,而是“升维”了。最大的机会在于“AI质量的评估与保障”,也就是所谓的AI Testing。以前我们测功能,结果是确定的(输入A,输出B);现在测大模型,输出是具有随机性的,你怎么测?这就需要测试人员具备设计“评测数据集(Benchmark)”的能力,比如针对一个客服大模型,你要设计各种刁钻的用户提问(边界Case、诱导性提问、对抗性样本),来评估模型的幻觉率、安全性、合规性以及领域知识的准确性。我了解到有些大厂已经设立了专门的“模型评测工程师”岗位,薪资开得很高,要求懂点Python,会写自动化脚本去批量跑Prompt,并对结果进行统计分析。这比点点点高级多了,也更有技术含量。
发布于 未知
分享
评论
未登录
友善发言
image-upload
评论
加载中