格子灰
07-20·后端开发·10年+
Kimi-K3
DeepSeekV4能超越KimiK3吗
K3 vs V4,开源两强的数据差距到底有多大?最近两款最受关注的中国开源模型,把数字列清楚,别被标题党带偏。Kimi K3(月之暗面,2026.7.16发布),2.8万亿参数MoE,每token激活896专家中16个,原生多模态,1M上下文,AAII开源榜57分,Frontend Code Arena 1679分目前世界第一,GPQA Diamond 93.5%,HLE 56%。价格,输出$15/MTok。DeepSeek V4 Pro(2026.4.24发布,MIT协议),约1.6万亿参数,激活49B,纯文本,1M上下文,AAII 44分,SWE-bench Verified 80.6%(这项比K3高),价格,输出$0.87/MTok,贵17倍。最能体现差距的是HLE这个测试,也就是“人类最后的考试”,设计来考极限推理能力,K3 56%,V4 Pro 7.7%,差了近50个点。GPQA Diamond同样如此,K3 93.5% vs V4 Pro 72.9%。SWE-bench这类实际代码修复任务,V4 Pro反而领先。核心分歧在于,V4是为生产稳定设计的,K3是在冲性能天花板,两件不同的事,放在一起比较本来就是降维对齐。V4-Flash单日调用270亿token,K3权重7月27日才开放。生态基础完全不是一个量级。
发布于 湖南
分享
评论
赞
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn