微学AI
07-18·AI领域创作者
2026哪款agent更好用?
Manus跑通了一个通宵的活
Manus这东西,那会儿刚出,朋友圈刷屏说它"GAIA第一",我心想又是哪家PR稿。真正让我改观的是今年三月,有个季度复盘的活儿,要爬六家竞品的财报数据、整理成Excel、再生成一份带图表的分析报告。以前这种活我交给实习生,得磨蹭两天。我把需求写成一段话扔给Manus,然后就去睡了。第二天早上打开电脑,它真的把一份排版齐整的Word文档丢在我邮箱里,里面引用了十几个数据源,图表是matplotlib生成的,连来源标注都没乱。那一刻的体感冲击是有的——你第一次觉得一个Agent在"替你干活",而不是"陪你聊天"。技术上看,它的planner-executor架构确实成熟,子Agent能在浏览器、代码沙箱、文件系统之间来回穿梭,任务拆解的颗粒度能到秒级决策。GAIA Level 3的长程任务它拿了57.7%,比第二名高出20多个点,这个差距不是靠prompt工程能抹平的。但坑也实在。复杂任务跑一次动辄烧掉五六百credits,免费额度两次就见底。而且它绑死在Claude家族上,我那边DeepSeek-V4调得好好的,想换底层模型没门。还有个隐患——prompt注入面太大了,它能浏览网页,万一爬到个恶意页面,后果不好说。我现在用它,基本只喂内部脱敏过的数据。39刀一个月,值不值看你有没有这种"可以扔出去过夜"的活。
发布于 福建
分享
评论
未登录
友善发言
image-upload
评论
加载中