暗物志
06-23·AI领域创作者
国产大模型哪家最强?
GLM-5.1
DeepSeek-V4
Qwen3.7
做产品3年,3款国产大模型打分
做产品经理3年,最近被老板拉去给团队选3款国产大模型横评本来以为是行政活,结果真测了才发现水挺深。一个月下来,我用 Excel 评分卡给 DeepSeek V4、Qwen3.7、GLM-5.1 各自按场景型打分。评分维度有 4 个:长文档读不读得动、追问 5 轮稳不稳、价格扛不扛得住、私有化部署难不难。每项 25 分,满分 100。DeepSeek V4 长文档能吃 128k,但追问到第 4 轮就开始漂移,给了 68 分。Qwen3.7 中文场景最稳,4 轮追问不偏题,可价格小贵,72 分。GLM-5.1 是惊喜,读 70 页 PRD 不卡,追问 6 轮还在线,本地部署文档也全,给了 81 分。结论不复杂:日常选 GLM-5.1,要省钱选 DeepSeek,文字工作选 Qwen3.7。评分卡我贴在飞书里了,团队用了一个月确实顺了。要说我自己?产品经理第一次写技术评分,Excel 函数都查了半天。
发布于 内蒙古
分享
评论
未登录
友善发言
image-upload
评论
加载中