柚子知AI遇
07-17·AI领域创作者
GPT-5.6 Sol
MuseSpark1.1写代码行吗?
MuseSpark写代码?
7月9日Meta发MuseSpark 1.1,小扎三年来首次亲自发帖力荐。我申请到API当天跑了三个真实项目,聊点体感。先说结论:MuseSpark 1.1不是在跟Claude比"谁代码写得更好",是在比"谁Agent编排更强"。SWE-Bench Pro 61.5%,被Opus 4.8的80%按在地上摩擦。但JobBench 54.7%反超Opus的48.4%,MCP Atlas 88.1断层第一——算法层面Meta选择了多Agent协作赛道而非单模型硬刚。主Agent拆任务、子Agent并行执行,机器学习里这种"项目经理+实习生"的架构在工具调用密集型任务上确实占优。Vibe Code Bench从19.7跳到72.2,深度学习模型一个版本迭代性能翻三倍,说明初代根本没训完。1M上下文+自我压缩,推理优化做到了长程任务不爆窗口。但纯代码能力差距摆在那。复杂Go重构丢依赖、Python类型推断偶尔翻车,单文件级别的编码任务不如GPT-5.6 Sol稳定。价格是真香——1.25/1.25/4.25,比GPT-5.6便宜4倍,比Opus便宜20倍。API只走Meta开发者门户,不接OpenRouter,生态封闭性是硬伤。
发布于 上海
1
评论
赞
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn