大佬说
08-13 · 南京小马哥文化传媒有限公司
深度求索新模型性能接近Claude
8月12日深夜,DeepSeek突然在官方群宣布上线DeepSeek V4 Pro正式版,并提及新版本增强了智能体(Agent)能力。官方同时发布的一张模型评测数据图显示,新模型的智能体性能接近海外前沿模型Claude的Fable 5,与Opus-4.8打得有来有回,相比之前的预览版能力有所提升。从评测来看,有两项数据V4 Pro甚至超过了Fable 5,包括考验AI智能体能不能真正干活的评测基准AutomationBench‌,以及评测模型在网络安全中实际攻防能力的CyberGym。关于模型的更多性能和数据,目前官方还未发布任何博客进行介绍,仅仅在DeepSeek官网的“API文档”中,模型与价格页面显示,deepseek-v4-pro对应模型版本已经更新为 DeepSeek-V4-Pro-0813,新模型上下文长度为1M,最大输出长度达到384K,同时支持非思考模式和思考模式。(第一财经)
发布于 江苏
分享
评论
未登录
友善发言
image-upload
评论
加载中