格子灰
07-06·后端开发·10年+
美团开源LongCat2.0
美团开源LongCat2.0,100万字上下文到底有多实用?100万字超长上下文,这是LongCat2.0最抓眼球的参数。一次性解析完整行业合同、百万行工程代码,这个场景描述听起来很诱人,但真实使用效果如何,目前还缺少大规模独立测试数据。美团训练这个模型用了30万亿Token的中文语料,这个数据量在国内算大的。针对本地生活、智能体搭建、程序编码三个场景做了深度适配,不走通用路线,专注垂直场景,这个策略思路和他们的主营业务逻辑是一致的。开源这件事本身值得聊。模型权重、训练框架、算力调度代码都放出来了,渠道覆盖GitHub和Gitee,入门门槛不高。对于想研究大模型底层架构的人来说,这个开源力度算是够诚意的。但开源的边界在哪里,这次争议说明行业标准还不清晰。“只开基础底座不开微调工具”到底算不算完整开源,不同立场的人有不同判断,美团说后续分阶段开放,这个回应算是给了个台阶。我个人觉得,大模型开源这条路,美团走出来了第一步,后续能不能真正形成开发者生态,才是检验这次开源含金量的关键。
发布于 湖南
2
评论
未登录
友善发言
image-upload
评论
加载中