满眼星河12138
08-04·快手员工
Qwen3.8-Max上新,有哪些亮点?
Qwen3.8-Max上新,有哪些亮点?
Qwen3.8-Max最让我意外的不是2.4万亿参数,是它真的开始“交付任务”了。以前国产模型强在“写代码”,写个函数补个逻辑确实能打,但你要把一个复杂项目扔给它然后走开,它大概率会在第20轮忘记目标、第50轮乱改文件。这次不一样,Qwen3.8能从一个空文件夹出发,自主跑完一个十几天才能交付的真实项目。官方披露了一个极端案例:让它“创建一个自进化的智能体Harness”,它独立编程约16天后,真的做出了一个可用的自进化智能体框架,全程无人干预。价格也是真便宜。国内每百万Tokens输入12元、输出36元,国际价格是Opus5的40%和24%。一个快摸到Claude尾巴的模型,卖这个价。Arena榜单上直接冲进全球第一梯队,文本能力仅次于Anthropic系列。甚至在前端编程榜上超过了Claude Opus 5和Fable 5的High版本。有网友用一条提示词就搭出了一个完整可交互的开发者作品集。不过品玩的实测也说了,Qwen3.8在长程任务上还是低于Opus5和Kimi K3。能交付是能交付了,但交付的质量和稳定性还有差距。一个做了16天项目的AI,你中途完全不管它,它能不能真的跑通,还得打个问号。国产模型确实从“会写代码”走向了“能交付任务”。但“能交付”和“能放心交付”之间,还差着一段路。
发布于 中国香港
分享
1
1
未登录
友善发言
image-upload
评论
加载中