子期
2天前 · 北京测吧
面试被问:大模型接口常见的边界问题有哪些
我讲了前司两个 400。第一个是多轮对话历史全量拼接进上下文,聊到第 30 轮突破 128K 窗口,API 返回 400;前端把它翻译成"服务不可用",而每次重试都带上同样的超长历史,于是永远 400,这个会话永久废掉,用户几十轮记录直接没了。第二个是输出侧:报告生成接口把最大输出设成 512,一份结构化报告输出到一半被截断,JSON 少了半边括号,下游解析服务抛异常,重试三次后任务标失败。面试官问怎么测。我说三类边界:输入侧,用分词器精确计数,按窗口减一、等于、加一造用例,溢出时必须优雅截断或友好提示,绝不允许 400 裸奔给用户;输出侧,盯终止信号,截断要么有标记要么自动续写,半截 JSON 是下游事故的固定来源;计费侧,把接口返回的用量和本地计数对账,偏差超阈值告警——这类边界翻车不报错,只烧钱。再补一条容易漏的:截断策略测试,关键实体埋在早期轮次,截断后还在不在,丢什么留什么是策略质量的尺子。最后补一句:边界值分析是老手艺,大模型只是换了边界的形态。边界,就是用户碰到系统脾气的地方。你们踩过哪类边界坑?欢迎交流。
发布于 北京
分享
评论
赞
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn