阿牛ai
08-06·AI领域创作者
测试转向AI测评方向,是否利于职级晋升?
测试转去做AI测评,听起来像踩中了新方向,但晋升评审不会因为岗位名多了两个字就自动加分。评委更关心的是,你做的评测改变了什么。只是整理题库、人工给答案打分,很容易变成另一种重复执行;如果能把线上投诉变成失败分类,建立可重复跑的样本集,在模型升级前拦住退化,并让产品知道哪些场景必须人工兜底,这才是更高一级的影响。AI测评还有一个容易被忽略的地方:结果要能推动研发动作。说准确率下降了不够,还要指出哪类用户受影响、是哪次模型或提示词变更造成、修完后如何证明恢复。能把模型、业务和发布决策串起来,职级空间自然比单纯执行用例更大。转方向有利于晋升,但前提是从“测出一个分数”走到“用评测控制一次上线风险”。做AI测评的脉友,晋升材料里最有分量的是平台建设、发现退化,还是推动业务改方案?
发布于 湖北
1
评论
1
未登录
友善发言
image-upload
评论
加载中