Lethehong
07-16·AI领域创作者
DeepSeek-V4
DeepSeekV4变强了吗?
V3老用户升级V4,一个月真实使用报告
从DeepSeek-V3开始就是重度用户,V4发布后第一时间切过去,用了一个月,说说真实感受。明确变强的地方:推理能力上了一个台阶。 V3在复杂推理上偶尔会"短路"——推理链走到一半突然跳到一个错误结论。V4的推理过程明显更稳,链式思考的每一步都有迹可循,错误率大幅下降。我拿一个需要七步逻辑推导的金融分析case反复测了20次,V3能稳定答对的概率大概65%,V4到了90%以上。长文本一致性改善明显。 以前V3在超长文本(超过64K token)场景下,后半段的回复质量会有可感知的下降。V4基本上把全程质量拉平了,读一篇10万字的报告然后回答细节问题,准确率和从头开始问差不多。代码生成更务实了。 V4生成的代码会更倾向用成熟稳定的库和写法,而不是追求"炫技"。比如做Web开发,V3偶尔会用一些冷门的新框架,V4老老实实给你主流方案。感觉没变甚至退步的地方:中文创意写作。 V4的写作风格比V3更"保守"了,诗歌、小说、营销文案的灵性不如V3。可能是安全对齐做得更严格的原因,但作为用户体感是退步了。对话的"人味"。 V3有时候会有点小幽默,偶尔冒一句金句。V4正经了很多,像被上了紧箍咒。做客服或者闲聊场景的用户应该能感觉到这个变化。总结:DeepSeek-V4在硬能力(推理、长文本、代码)上全面增强,在软体验(写作灵性、对话趣味性)上有小幅退步。 更适合当作生产力工具,不适合当作聊天搭子。
发布于 湖南
分享
评论
1
未登录
友善发言
image-upload
评论
加载中