一颗小钉子
08-03·华为员工
国产算力跑大模型,和英伟达差在哪?
最近在关注国产算力跑大模型的进展,说实话差距在缩小,但体感上还是能感觉到不同。英伟达的CUDA生态太成熟了,从框架适配到调试工具链一条龙,国产卡很多时候还在补基础工具。跑起来不是最大问题,适配才是。同样的模型换个卡,框架层要改、算子要重写,调优周期拉得很长。性能上追得很快,但工程化体验还差一截。不过国产算力的进步速度确实超出预期,给点时间未必不能追上。你们团队有用国产卡跑过模型吗?
发布于 江西
分享
评论
未登录
友善发言
image-upload
评论
加载中