微学AI
08-16·AI领域创作者
千问办公首发上线GLM-5.3等前沿模型
DSV4 Pro,Agent能力站上高度
DeepSeek V4 Pro正式版上线千问办公,我第一时间切过去跑了几轮长链任务。1.6万亿总参数,每次推理激活490亿,100万Token上下文,单次最大输出38.4万——参数看着唬人,但真正让我觉得不一样的是它在Agent任务上的表现。之前用预览版跑多步骤任务,中间经常断掉或者逻辑跑偏,正式版在Terminal-Bench 2.1上拿了87.9分,DeepSWE从预览版的12.8直接跳到62.7,这个提升幅度说实话有点超出预期。而且它的思考模式分了三档,日常用high就够了,硬核任务切max,不像之前一刀切。我有个感受是,大模型这半年从"聊天强不强"转到了"能不能干活",DeepSeek这波算是把国产模型在长程Agent能力上拉到了一个新高度。不过话说回来,1.6万亿参数的推理成本摆在那,企业级场景能不能吃得消还要看定价策略。V4系列Flash走性价比、Pro走高规格,这个产品分层逻辑是对的。你们觉得办公场景的Agent,能力重要还是成本重要?评论区聊聊。
发布于 福建
分享
评论
未登录
友善发言
image-upload
评论
加载中