翻身咸鱼的人
07-15·BD商务·5年+
大模型时代,测试人的新机会在哪里?
大模型时代,测试人的机会不是被挤压了,而是“升维”了。最大的机会在于“AI质量的评估与保障”,也就是所谓的AI Testing。以前我们测功能,结果是确定的(输入A,输出B);现在测大模型,输出是具有随机性的,你怎么测?这就需要测试人员具备设计“评测数据集(Benchmark)”的能力,比如针对一个客服大模型,你要设计各种刁钻的用户提问(边界Case、诱导性提问、对抗性样本),来评估模型的幻觉率、安全性、合规性以及领域知识的准确性。我了解到有些大厂已经设立了专门的“模型评测工程师”岗位,薪资开得很高,要求懂点Python,会写自动化脚本去批量跑Prompt,并对结果进行统计分析。这比点点点高级多了,也更有技术含量。
发布于 未知
分享
评论
赞
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn