靠谱阿无
08-14·AI领域创作者
AI第一线
7430亿参数,开源前先挖2436个漏洞
智谱刚把GLM-5.3端上桌,参数7430亿,主打编程和智能体。两周内开源。先说最反直觉的事:这模型没换基座,用的还是GLM-5.2的底子。能力涨了一大截,全靠后训练阶段堆量。也就是说,不换发动机,光靠调校,硬生生把车开出换代感。效果怎么样?两个实测最能说明问题。第一个,从零搓一个3D开放世界驾驶游戏。模型拿到真实地图数据,1:1复刻上海陆家嘴到外滩,自己写了约4900行代码,顺手还写了个PNG解码器来校验渲染效果。中间遇到bug,自己查自己修。审美差点意思,但工程闭环是跑通了。第二个更狠。拿DeepSeek的Harness框架"裸考",7400多个文件的陌生仓库,模型派了好几个子智能体并行翻代码,最后搞出一个"人格插件"——能让AI用文言文、东北话或者猫语回答,而且零侵入、插件化,配套的单元测试一次过。编程和智能体能力逼近Claude和GPT,在开源阵营里压过DeepSeek-V4-Pro一头。但真正让人意外的不是写代码。后训练Scaling的过程中,模型自己"长"出了很强的网络安全能力。智谱拉了多家安全团队做红队测试,两周时间从代码里揪出2436个漏洞,其中1097个是中高危,已经报给国家漏洞库。一个写代码的模型,挖漏洞比不少专业工具还猛。效率方面也有意思。模型支持思考档位调节,同样的token预算下,准确率超过Claude Opus 4.8,输出量还不到人家一半。少说废话,多干活。目前GLM-5.3已经上了ZCode、AutoClaw这些工具,TraeWork、Qoder等平台也能抢先体验,API马上来。开源前会先做安全评估和加固。不换基座也能换代,这件事本身可能比模型发布更值得琢磨。
发布于 安徽
分享
评论
未登录
友善发言
image-upload
评论
加载中