小卷的IoT
07-03·AI领域创作者
通义千问3的SWRP算法省算力吗?
千问
Qwen3.7
阿里说Qwen3用稀疏权重剪枝,GPU消耗仅Qwen3-32B的9.3%。听着美对吧?作为PM我翻译一下:省的是训练算力,不是你调API的钱。我们组上季度接千问3做客服Agent,技术总监拍胸脯说成本降70%。上线一看,算力确实省了,因为模型经常"选择性失忆"——用户问三个问题它答两个。为了补精度又套了层纠错Agent,两个互相校验,算力反超32B。SWRP省不省?省,省下来的全花在填坑上了。
发布于 山东
分享
评论
1
未登录
友善发言
image-upload
评论
加载中