竹帘听雨
07-16·人力HR·10年+
DeepSeekV4变强了吗?
DeepSeek-V4 相较 V3 实现全方位能力跃升,核心突破集中在超长上下文、数理代码、智能体任务三大维度,不过多模态与极限复杂推理仍不及头部闭源模型。长文本能力革新显著,原生支持 100 万 Token 上下文窗口,远超前代 128K;依托混合注意力架构,百万 Token 场景计算量仅为 V3.2 的 27%,显存占用压缩至 10%,阅读整本长文档也不易遗忘前文,适配知识库、代码仓库完整解析场景。数学与编码推理提升亮眼,Putnam 数学竞赛测试拿到满分,Codeforces 评分达 3206 分,看齐一线闭源模型;智能体代码生成跻身开源第一梯队,代码幻觉问题大幅减少,复杂工程开发、自动化 Agent 任务表现更稳定。综合来看,长文档处理、程序员开发、自主智能流程是它的优势赛道,若侧重图像、视频多模态创作则存在短板。你日常使用大模型更看重百万字长文本读取,还是复杂代码生成能力?
发布于 贵州
1
评论
未登录
友善发言
image-upload
评论
加载中