微学AI
07-10·AI领域创作者
中科曙光国产万卡能救活小团队吗?
小团队也能"算"上国产尖货
2026年7月10日,中科曙光在郑州宣布"曙光8000(登峰)"正式落成——这是国内首个全国产十万卡AI超集群,接入国家超算互联网后,郑州一个节点就能提供超10万张国产AI卡的算力。往前推一个月,ISC 2026上国家超算深圳中心的"灵晟"以2.19 EFlops登顶全球TOP500,时隔九年把中国超算拉回世界第一;同一天IO500榜单上,曙光ParaStor F9000还顺手把生产型全节点和10节点组别双料第一收走,国产存储头一次在生产型榜单上称王。我做技术这几年,第一次看到"芯片+计算+存储+网络+散热"全栈全国产的万卡级实跑,意义不亚于当年神威太湖之光。技术细节值得拆开看。算力底座是海光CPU+DCU的国产组合,深算DCU对CUDA的兼容度做到99%,DeepSeek、通义、百川、智谱基本不用改代码就能跑;网络层是scaleFabric类InfiniBand原生RDMA,端口400Gb/s、交换延时260ns,这是国内首款能在万卡规模上稳定扛住AllReduce的方案;存储层ParaStor在IO500生产型全节点夺冠,意味着它不是实验室跑分机器,而是真的扛得住7×24跑大模型训练;散热更狠,C8000浸没相变液冷让单机柜功率密度做到750kW,PUE压到1.04,机房几乎是"全年自然冷却"。我最大的感受是:以前小团队聊国产卡,第一反应是"算力不够、生态难用",现在曙光这套scaleX万卡超集群已经在国家超算互联网核心节点上完成300+项应用适配,70+项突破万卡规模,连蛋白质折叠和万亿原子级液态水模拟都跑出了世界纪录。技术天花板一旦被顶起来,剩下就是我们这些做应用的人怎么把"普惠算力"用出花来。十万卡看着很远,但下一段的链接,我们够得着了。
发布于 福建
1
评论
未登录
友善发言
image-upload
评论
加载中