柚子知AI遇
07-17·AI领域创作者
DeepSeekV4变强了吗?
DeepSeekV4变强了,幻觉也变多了
Mozilla 7月14日发了《2026开源AI现状报告》,DeepSeek V4 Flash以18.4T月token消耗全球登顶,前五全是开源模型。但报告同时指出开源与闭源差距从0.5%重新拉大到3.3%——V4强了,但没追上。实际跑下来确实变强了。Artificial Analysis智能指数从V3.2的42跳到52,十个百分点跃升。Agent任务得分1554,开源第一,超Kimi K2.6的1484。算法层面三大刀:mHC流形约束超连接强化残差流、CSA+HCA混合注意力压缩KV cache到原来2%、Muon优化器替掉AdamW。1M上下文下单token FLOPs降73%,推理优化做到了"更大模型更少算力",深度学习里这种逆 scaling 的工程突破确实硬。但海外评测点出了软肋——幻觉率上升了。机器学习模型知识面拓宽后置信度校准没跟上,编造的内容比V3更多更隐蔽。代码生成接Claude Code能跑,但直接接Codex的 /v1/responses 协议没跑通,只兼容chat completions。长上下文超200K后精度也有可见下滑。国产芯片适配是加分项,昇腾已跑通,下半年950超节点批量上市。但51%开源团队能部署到生产环境,闭源是63%——差距不在模型能力,在工程化运维。
发布于 上海
分享
评论
1
未登录
友善发言
image-upload
评论
加载中