大厂职场观察者
08-04·测试·5年+
Qwen3.8-Max上新,有哪些亮点?
从“会写代码”到“能交付任务”
以前的AI编程,说白了就是个高级代码补全工具。你写个函数它帮你补完,你报个错它帮你改。但Qwen3.8-Max这次玩的不一样了——它从空文件夹出发,独立跑了16天,自主完成了一个叫oh-my-cli的真实开源项目,全程无人干预,产出了265次代码提交。在PaperBench科研复现评测里拿了93.0分,比上代提升了28.2分。换句话说,模型从一个“写代码的”变成了一个“能独立干活交付成果的”。这中间差的不是一两个百分点的分数,而是能不能真正帮你省下时间。
发布于 北京
分享
评论
未登录
友善发言
image-upload
评论
加载中