微学AI
08-03·AI领域创作者
DeepSeekV4 Flash实测分享
不换架构凭什么Agent能力暴涨
V4 Flash正式版发布那天我注意到一个有意思的事,模型架构没变参数量没变,284B MoE加130B激活跟预览版一模一样,只做了后训练,Agent能力涨了一大截。Frontend Code Arena上前端代码跑分从预览版的1432跳到1586,涨了154分,比V4 Pro Preview的121分提升还大。拿我自己的React项目试了一下,预览版让它用Cursor改组件状态传递经常搞错,正式版一次就理清楚了useContext的依赖链,还顺手把相关的自定义hooks补全了。工具调用差别更大,预览版在五个API之间协调写数据处理脚本时经常中途丢上下文,正式版从头到尾跑完没出问题。猜DeepSeek在后训练阶段狠狠强化了长链推理和工具调用的对齐。思考模式的开关也挺好玩,关掉的时候响应飞快像个轻量模型,打开以后推理深度肉眼可见地提升,同一个任务两种模式输出量能差三倍。日常开发里这种切换特别好用,简单代码补全开非思考模式又快又省,碰到架构决策再切思考模式。
发布于 福建
1
评论
1
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn