暗物志
08-16·AI领域创作者
Qwen3.8-Max实测体验分享
通义千问3.8-Max我肝了整整一周
先说结论:这玩意不对劲,不是说好,是那种让你后背发凉的不对劲。
我本来是带着挑刺心态去测的,毕竟千问系上一代给我的感觉就是中规中矩,跟豆包比差点意思,跟DeepSeek比又少了点极客味。结果3.8-Max上手第一个回合,我就把准备好的三十个刁钻问题给忘了,直接问了一句「帮我写个辞职信」。换句话说,它给我的东西已经不像AI写的了。语气像我那个混了十年职场的损友,该圆滑的地方圆滑,该阴阳的地方阴阳,还带点情绪。我愣了大概三四秒才反应过来这是机器出的活。再进一步来看,代码能力是真能打。我让一个32岁的后端朋友拿它去重构祖传Java代码,他那套东西写了五六年没人敢动,结果3.-Max三天给出了个能跑的方案,虽然后面还得手动调细节,但基本架构是通的。他跟我说这话的时候,表情跟见了鬼似的。老实说,测到第二天我就有点慌了。不是怕它抢我饭碗,是怕这玩意儿进步速度太快,快到我根本不知道半年后会变成什么样。有个做AI产品经理的朋友跟我聊了一句,说通义现在团队规模虽然还没达到字节那种夸张程度,但迭代密度是真的猛,几乎每隔几天就有一次小升级。说说具体的:在中文写作方面,它目前是我测过最强的。在逻辑推理方面,跟o1差不太多,但反应速度快一截。在多模态理解上,还得再观察,目前只是个能用状态。说回这事,我个人判断这波千问是真想跟豆包掰手腕了,不是以前那种跟在后面捡漏的姿态。有个细节我没实锤,据说3.8-Max的内部代号跟某个游戏角色重名,不知道是不是工程师故意埋的彩蛋。现在AI这行卷成什么样大家也看到了,国产模型你追我赶,今天你第一明天我第一。但通义这波给我的感觉不太一样,它开始有自己的味道了,不再是那个啥都能干但啥都不精的六边形战士。你可以在它身上看到「我就是这样」的脾气,这在国产模型里挺少见的。说真的,国产大模型走到这一步,已经不是能不能用的问题了,是你想不想用它的问题。留个问题:你最近被哪个国产AI的功能给震住过?
发布于 内蒙古
分享
评论
2
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn