乌贼在慕尼黑写BUG
08-11·测试·5年+
Claude自研芯片,不靠英伟达跑模型
Claude每回答一个问题,都在烧钱
维持Claude这样千万级日活的大模型,每天光芯片折旧成本就高达数十万美元。这还只是推理,不算训练。Anthropic自研芯片,最直接的动力就是降本。定制推理芯片在生产规模下能把每token成本降低50%到67%。有分析甚至说总拥有成本能降65%。怎么做到?通用GPU要处理图形渲染、各种通用计算,很多模块Claude根本用不上。ASIC把这些没用的全砍掉,只保留Claude真正需要的计算单元。晶体管利用率上去了,单次API调用的成本自然就下来了。说白了,以前是“买一台万能工具机干一种活”,现在是“专门造一台机器干这个活”——效率能不高吗?
发布于 北京
分享
评论
未登录
友善发言
image-upload
评论
加载中