燕子不南飞
1天前·奇安信员工
GLM-5.3真能对标Claude吗?
最近到处都是 GLM‑5.3 对标 Claude 的讨论,很少有人从 Agent 智能体开发的角度去做对比,我这段时间拿两个模型做简单工作流测试,GLM 工具调用成功率进步非常明显,不过遇到多步骤嵌套、需要来回校验的复杂任务时很容易中途跑偏,Claude 在长链条逻辑规划上整体更稳,从项目实操角度没必要非得分出高下,现阶段可以采用混合架构,通用推理交给 GLM‑5.3,超长多轮复杂 Agent 任务继续使用 Claude,一边跑业务一边做灰度对比,直接用自己真实业务数据做评估远比看第三方榜单靠谱,你们做智能体开发现在主力用哪款模型?
发布于 重庆
分享
评论
2
未登录
友善发言
image-upload
评论
加载中