Shamater
08-13·AI领域创作者
AI创作者AMA知无不言
微信自研大模型 WeLM 亮相:不搞“大力出奇迹”,专攻“小而美”的高效落地。微信官方推特宣布自研大模型家族 WeLM,这次微信的思路非常清晰,主打一个“务实”。他们没有盲目卷千亿参数的军备竞赛,而是把核心理念定在了“资源高效利用”上,采用了 MoE(混合专家)架构,用最少的激活参数去办最多的事。WeLM 推出了两款模型:WeLM-80B(总参 80B,激活 3B):目前内测的“小微”AI 助手就是这个模型驱动的。它能原生融入微信生态,支持聊天搜索、调用微信原生功能和访问小程序,轻量级但够用。WeLM-617B(总参 617B,激活 23B):正在开发中,专门针对复杂任务。未来将应用于智能小程序开发和工具生成等重脑力场景。这种“总参数量大,但推理时只激活一小部分”的策略,完美契合微信庞大的用户体量和极速的响应需求。既保证了能力上限,又控制了成本和能耗,让 AI 真正无缝嵌入十几亿人的日常沟通和小程序生态中。不搞花架子,只做深生态。微信这波“四两拨千斤”的打法!
发布于 湖北
分享
1
2
未登录
友善发言
image-upload
评论
加载中