Hogwarts测试开发
06-28·北京测吧员工
字节面试题(三)
三、第二步:Skill 不是把流程写长,而是把判断写清楚很多人写 Skill,会犯一个很典型的问题:把 Skill 写成一大段说明书。里面写了很多背景、理念、注意事项,看起来很完整,但 Agent 真正执行时抓不住重点。高质量 Skill 的关键不是写得多,而是写得准。尤其要提取三类内容:专家决策树反模式约束模板和示例1. 提取专家决策树Skill 最重要的价值,是告诉 Agent:什么情况下走方案 A什么情况下切到方案 B什么情况下必须停止什么情况下需要补充信息什么情况下只能给建议,不能直接执行比如一个“测试用例生成 Skill”,不能只写:根据需求生成测试用例。这句话太泛了。更好的写法应该是:当需求描述包含完整业务流程时:- 先生成主流程用例- 再补充异常流程- 最后补充边界、权限、数据一致性和幂等场景当需求描述不完整时:- 不要编造不存在的业务规则- 先标记缺失信息- 再基于已有信息生成可确认的用例草稿当需求涉及支付、权限、资金、删除、审批时:- 必须标记为高风险需求- 必须补充回滚、审计、重复提交、异常中断场景这才是真正有价值的 Skill。因为它不是简单告诉 Agent 做什么,而是告诉 Agent 怎么判断。2. 提取反模式:明确不要做什么在 Agent 系统里,“不要做什么”往往比“要做什么”更重要。因为大模型很容易为了完成任务而过度发挥。比如:为了让答案完整,补充不存在的信息为了快速给结论,跳过验证步骤为了显得专业,写很多无法落地的套话为了执行任务,直接修改高风险文件为了覆盖全面,输出一堆没有优先级的内容所以 Skill 里必须明确反模式。例如:不要把来源不明的信息当成事实写进结果。不要为了让答案完整,擅自补充不存在的业务规则。不要在高风险操作中直接修改文件,必须先生成计划。不要跳过验证步骤直接给最终结论。不要只覆盖正常流程,必须补充异常、边界、权限和数据一致性场景。不要输出无法执行、无法验证的空泛建议。这类约束能明显降低 Agent 的幻觉和误操作。尤其是在测试开发、代码修改、数据库变更、自动化执行这类场景里,反模式非常关键。
发布于 北京
分享
评论
未登录
友善发言
image-upload
评论
加载中