瓦力walle
07-18·后端开发·10年+
如何评价Kimi 发布的2.8万亿级开源模型 K3?
7月17日凌晨,月之暗面发布了Kimi K3,参数规模2.8万亿,直接超越DeepSeek-V4-Pro的1.6万亿,成了目前全球最大的开源权重模型。支持视觉理解,100万token上下文窗口,WAIC开幕前一天卡着点发布,时机选得挺妙。月之暗面说K3基于KDA混合线性注意力机制,综合智能水平接近全球前沿的闭源模型。面向的是软件工程、知识工作、深度研究这些场景。说几句实在话。2.8万亿参数确实吓人,但参数大不等于体验好,这个事儿行业里反复验证过了。DeepSeek之前用更小的参数做出了惊艳的效果,现在Kimi走了一条相反的路。两种路线都没错,但资源消耗差太多了——K3的训练和推理成本绝对是个大数字。不过Kimi敢开源2.8万亿参数的模型,这件事本身的意义比参数大小更大。它等于告诉所有人:我们中国公司也能跑通超大模型的全链路,从训练到部署到开源。这种底气不是谁都有的。开源这条路走对了,但接下来拼的不是谁参数大,而是谁能把大参数变成好用的产品。
发布于 山东
分享
1
未登录
友善发言
image-upload
评论
加载中