夜勤月
07-16·AI领域创作者
DeepSeekV4变强了吗?
V4确实强了,但别吹过头
DeepSeek V4不是参数堆叠,是架构重构。CSA稀疏注意力加HCA层级记忆,跑百万token算力只要V3的27%,KV缓存压到10%。上下文从128K拉到1M,Codeforces破3200,SWE-Bench 55.4%开源第一。V4 Flash月用量18.4T tokens全球登顶,国产算力适配华为昇腾,自研推理芯片已启动。但泼盆冷水:思辨题遇到逻辑陷阱还会翻车,超长多轮对话后期丢细节,开源版多模态精细度不及闭源旗舰。Mozilla报告说开闭源差距3.3%,集中在推理和Agent任务。V4是质变,但离全面对标还有路。
发布于 安徽
1
评论
1
未登录
友善发言
image-upload
评论
加载中