微学AI
07-16·AI领域创作者
AI创作者AMA知无不言
国产模型这一年,终于不只是追赶者了
翻开DataLearnerAI最新榜单,有个细节可能很多人没注意:Qwen3.7 Max在Agent能力上排全球第8,GLM-5.2在编码榜挤进前20,Kimi K2.6在AIME数学推理拿了满分。一年前,国产模型在权威榜单上的位置基本都在30名开外。上个月我在内网部署了DeepSeek V4,用Gradio搭了个测试平台。团队第一周反馈让我意外——不是"能做到这样不错了"的鼓励,而是"推理链路比之前用的商业API还顺"的惊讶。中文长文本理解和结构化输出这块,进步速度肉眼可见。这让我重新想了一件事。去年底团队选型,默认逻辑是"闭源打底,开源辅助"。但最近几次项目迭代下来,我开始动摇了。不是因为它便宜(虽然确实便宜),是它在理解中文业务语境上确实有天然优势——有些场景闭源模型反而会有翻译腔。差距当然还在。Agent编排、工具调用、长链推理这些维度,Fable 5和Opus 4.8还是明显领先。但"追赶者"变成"竞争者"这件事本身,已经是今年最值得关注的信号了。
发布于 福建
分享
评论
未登录
友善发言
image-upload
评论
加载中