Neil知本论
1天前·AI领域创作者
GLM-5.3
国产模型开始从“会写代码”走向“能干工程
以前测试AI编程,常看它能不能生成一个函数、解释一段报错。真实工作不是这样。模型需要打开终端、阅读整个项目、安装依赖、修改多个文件、运行测试,失败以后继续排查。有些任务甚至要持续几小时或几天。GLM-5.3登顶Terminal-Bench,至少说明国产模型正在从“代码生成器”向“工程执行者”靠近。这两者的差别,就像会写菜谱和能独立经营后厨。
发布于 内蒙古
分享
评论
未登录
友善发言
image-upload
评论
加载中