有干劲的巴顿在跳伞
08-11·AI领域创作者
Qwen3.8-Max实测体验分享
Qwen3.8-Max 跑了四天。。。
用 Qwen3.8-Max 跑了四天活,我决定把半个生产链路切过去,8 月 3 号阿里甩出 Qwen3.8-Max,2.4T 总参、95B 激活、1M 上下文、下周开源权重——这配置放一年前只能是闭源旗舰的宣传页。我当天接了 API,连跑四天真实任务,不吹不黑。先钉硬参数(避免被“3.8”忽悠):架构:MoE,2.4 万亿总参,每次只点亮 950 亿,用百 B 稠密模型的电费吃下 2.4T 的智能上限。上下文:1M token(思考模式 983K 输入),最大输出 131K,思维链预算 262K多模态:原生吃文本/图/视频(1600 万像素图、2 小时视频),不用外挂视觉适配器价格:国内输入 ¥12/百万、输出 ¥36/百万,缓存命中 ¥1.5;海外 2/6,命中 $0.25。约等于 Opus 5 输入价的 40%、输出价的 24%协议:兼容 OpenAI + Anthropic,能直接塞进 Claude Code / Qoder CLI我干了啥:1. 12 万字业务文档 + 30 条抽取规则一口闷进 1M 上下文,问“第三章和第七章口径冲突点”,定位到段落级,顺手列 4 个待确认项,没切片没报错。V3-Max 时代这活得切 3 段。2. Agent 修仓库:给一个 200 文件 Python 服务加功能,开 reasoning_effort=xhigh,它自己读 README→列改动点→改 11 个文件→写 pytest→跑通。Terminal-Bench 2.1 官方 86.6、FrontierSWE 73.5,实测体感在这个区间,比上代 Qwen3.7-Max明显会自己排错。3. “截图转可运行前端”:给 Figma 截图生成 React 组件,Vision2Web 官方从 42.1 飙到 69.0,实测布局能对上七八成,但次要信息对比度、绝对像素间距还得人收尾,别指望它替你做设计师级校准。4. 长程无人管:官方晒过“空文件夹起 16 天自驱开发 CLI 工具、265 次提交”的案例,我没这么狠,跑了 6 小时连续任务(issue→实现→测试→回滚),中间挂了 2 次,它能自己从测试失败退回去改,没摆烂。干长活、吃文档、跑 Agent、预算敏感但又不想掉出第一梯队——这周值得接一次试试。
发布于 安徽
分享
评论
赞
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn