子期
08-14 · 北京测吧
二面复盘续
三、场景问题解决(约15分钟)线上突然爆出一批AI回答的badcase,用户投诉都上来了,你的应急处理流程是什么?怎么定位是模型、检索还是工程链路的问题?多轮对话功能怎么测?上下文依赖的用例怎么设计和维护?AI应用依赖一堆下游(模型服务、向量库、三方接口),测试环境怎么做隔离和mock?模型服务没法mock怎么办?大促/流量高峰前,模型服务这块的压测你会怎么规划?GPU资源紧张时怎么排优先级?四、工程判断(约10分钟)测试框架选型:基于pytest二开还是完全自研?你怎么决策?说一个你做错的选型CI里AI相关的检查跑得太慢,开发同学天天抱怨,你怎么解?评测数据集越来越大,版本管理和数据血缘你怎么设计?五、编码(约15分钟)手撕:实现一个异步并发控制器,限制同时执行的任务数不超过N,要求基于asyncio(比一面的LRU更贴近测开日常,他明说了"这就是我们工作里写的东西")追问:如果还要加每秒请求数限制(令牌桶),你怎么在上面扩展?
发布于 北京
分享
评论
1
未登录
友善发言
image-upload
评论
加载中