赛博摆渡人
07-19·技术支持·4年
Kimi-K3
DeepSeek-V4
DeepSeek满血版,能压住 K3 吗
这周国产大模型圈的密集程度,离谱到让人恍惚 emoji。7月15日DeepSeek V4全量上线,16到17日月之暗面在WAIC前夕甩出Kimi K3,19日圈内又流出V4满血版灰度数据。三天两记王炸,没发布就被拉去比了。把时间往回拨一年半。2025年1月20日,R1开源那一夜才是真正的地震。我那时在一个中厂做售前,领导甩来一份AI大模型报告的任务,我拿GPT和DeepSeek一个下午搞定,报告在内部被疯转。一个刚成立一年多的中国团队,用极低成本把推理顶到o1级别,英伟达单日暴跌17%、市值蒸发近6000亿美元。后来人称斯普特尼克时刻,我倒觉得,它头一回把堆算力神话砸出了裂缝。再看V4 PRO。4月Preview、7月全量,1.6万亿总参、激活49B,全系百万上下文,亮眼的是首创了峰谷分时定价,官方称比GPT-5便宜八成,推理成本仅V3的27%,还原生适配国产昇腾。进步不在参数堆多高,在重构成本结构。做信创交付那几年我太清楚,客户要的是算得过来账。Kimi K3是另一条路。2.8万亿参数,把开源模型的体量顶到新高度,KDA混合线性注意力加注意力残差,原生视觉、百万上下文,综合能力逼近Claude Fable 5和GPT-5.6 Sol。但月之暗面自己也说,整体仍有差距。那么满血版真来会怎样。据新智元援引的灰度数据,V4满血版编码直追GPT-5.6 Sol、整体接近Opus 4.8,Agent和3D、SVG生成明显变好。这条还没官宣,我先标个待验证。可K3用近3万亿参数换来的上限,满血版用更少激活参数可能就追平了。参数越大越强的旧逻辑,怕是要再挨一锤。说到底,这场交错发布真正可喜的不是谁压谁,是国产开源从单点亮相变成群体突破,是大家不再比谁参数虚高,比谁把顶级能力做到普通人用得起。我理想里的下一程,不是继续在榜单内卷,是Agent真正落进工厂、政务、中小金融机构的日常,把成本砍到能规模化用。留一个角:如果满血版真如灰度数据这么猛,K3那2.8T参数的叙事还站得住吗?参数军备竞赛,该降温了。有位同志说得好一花独放不是春,百花齐放春满园
发布于 陕西
分享
评论
1
未登录
友善发言
image-upload
评论
加载中