子期
08-14·教师·5年+
大厂新题型:“大模型接口怎么测?”
朋友上周面AI测试开发岗,被问了一道新题型里很有代表性的题,传统接口测试那套答不全它。【真题】 大模型应用的接口,你会怎么测?和传统接口测试有什么区别?拆解要分层:① 基础层:契约、鉴权、限流、超时重试照样考,额外加流式响应(SSE)的处理 ② 断言层:输出不确定,精确匹配断言失效,要转评估体系——多维度打分、黄金集对比、LLM-as-judge ③ 上下文层:多轮会话的语境、上下文长度上限、会话隔离与串话污染 ④ 性能与成本:首token延迟、总时延、token消耗、并发限流下的表现 ⑤ 安全层:提示注入、敏感内容过滤、隐私数据泄露,AI岗最大的区分度在这【踩坑】只背参数校验+状态码断言的传统套路,完全不提输出质量评估,这题基本算挂。面试官考的是你懂不懂AI应用的本质区别。你们公司的大模型应用上线了吗?测试是谁在做?评论区聊聊。大厂面试真题拆解,持续更新。完整题库·联系方式在主页
发布于 北京
分享
1
未登录
友善发言
image-upload
评论
加载中