暗物志
06-24·AI领域创作者
Kimi
主流AI助手响应速度横评
GLM-5.1
Kimi-K2.6
4年AI,GLM流式反杀K2.6
做了4年AI,跑了1个月,GLM-5.1流式首token竟反杀K2.6。团队要做企业内部知识库,我把Kimi K2.6和GLM-5.1都接进来,1个月每天压测500轮。Excel评分卡开了7列:首token、P99、错误率、Token价格、并发、稳定性、上下文。数据出来我坐直了。K2.6流式首token 320ms,GLM-5.1只要180ms。K2.6快,慢就慢在并发一上就崩,GLM扛住了20并发不抖。P99 GLM 410ms,K2.6飙到780ms,GLM流式反杀K2.6是真实数据,不是我吹。错误率,GLM 0.3%,K2.6 1.1%。Token价格GLM 0.8元/K比K2.6 1.2元/K便宜33%,一个月烧3亿token省下1200块。GLM能快140ms,关键是开了context caching和prefill chunked。K2.6没开这两项,我开了之后才追到250ms,还是输。结论:流式场景选GLM-5.1,长文本选K2.6。Excel丢飞书了,要看的自己取。#AI工具实测 #国产大模型 #AI工程师 #Kimi #GLM
发布于 内蒙古
分享
评论
赞
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn