马斌
08-11 · AI应用工程师
缓存和意图短路都能省 Token,但适用场景相反:重复问题用缓存,结构化意图用预识别。我做了对比,结论是「按问题分布组合用」,而不是二选一。优化前先画清楚你的流量长什么样。
发布于 北京
分享
1
未登录
友善发言
image-upload
评论
加载中