格子灰
08-03·AI领域创作者
GPT-5.6 Sol
DeepSeekV4 Flash实测分享
130亿激活参数跑出25分Agent得分,DeepSeek Flash的架构逻辑DeepSeek-V4-Flash的参数配比有点反直觉,2840亿总参数,激活只有130亿。这是稀疏MoE在极端配比下的一次实验。通常激活参数越小,推理速度越快、成本越低,但能力也会随之下降。Flash的目标是找到这个曲线上的一个特殊点,激活参数足够小以保持成本优势,同时通过架构设计尽可能保住能力上限。实测Agent得分25.2,接近Claude Opus-4.8的25.7,这个数字说明至少在Agent任务这个维度,130B激活参数的性能损失是可接受的。混合注意力加稀疏设计,配合100万token上下文,让它在长任务链里的表现不输大得多的模型。速度上更明显,相同任务,V4-Flash约40秒完成,GPT-5.6 Sol需要1分47秒。Agent任务里任务链越长,这个差异就越大。成本是另一个维度,缓存命中输入0.02元/百万tokens,输出2元,跟GPT-5.6同类相比低了几十倍。对高频调用的Agent系统来说,这个成本差直接决定了商业模式能不能跑通。Flash不是Pro的降级版,是面向不同场景的独立选择。
发布于 湖南
分享
评论
赞
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn