七夜zippoe
07-18·AI领域创作者
三大Agent谁更不易失忆?
Grok 4.5
三大Agent(Claude Opus 4.1、GPT-5.6、Grok 4.5)谁的“失忆症”最轻?组里做长会话Agent的兄弟做了个压力测试:连续50轮对话,每轮塞一个关键约束(“记住我叫张三”“记住预算不超过5000”“记住要用Python 3.12”),最后统一问。结论:Claude Opus 4.1失忆率最低(约15%),GPT-5.6次之(约25%),Grok 4.5最严重(约35%)。拆开看原因:Claude的长上下文机制(Constitutional AI + 注意力窗口优化)对“硬约束”的记忆保持最好,即使中间插入大量无关对话也能回溯;GPT-5.6的上下文窗口虽大但“遗忘”更随机,有时能记住第3轮的细节却忘了第10轮的;Grok 4.5推理强但长会话记忆明显不是优先级,超过30轮后开始胡编约束条件。打工人启示:做客服/销售/法律咨询这类需要长时间跟踪用户信息的Agent,首选Claude;做一次性复杂推理选Grok;GPT居中但生态最广。别让“失忆”的Agent替你接待客户,回头客户投诉你都不知道为啥。你们组用哪个Agent做长会话?失忆翻过车没?评论区见。
发布于 山西
分享
评论
1
未登录
友善发言
image-upload
评论
加载中