吴贶
2天前 · 秦欧新能源科技苏州有限公司
Deepseek
过去很长一段时间,DeepSeek给人们留下的印象是,能“用更少的卡”跑出更好的模型。这家长期以小团队、高效率著称的公司,凭借算法和工程优化,在相对有限的算力资源下,训练出了能和硅谷顶尖模型“掰手腕”的产品。然而,随着模型参数规模持续膨胀、用户调用量爆发式增长,算力成本和供给稳定性逐渐成为其不可回避的瓶颈。今年6月,DeepSeek完成首轮外部融资,募资总额约500亿元。“粮草”充足之后,DeepSeek在算力获取方面的打法开始出现变化,此次招聘信息,也释放出其转向自建算力基础设施的信号。据媒体报道,DeepSeek计划在乌兰察布建设一座约1吉瓦(GW)算力的大型AI数据中心。DeepSeek并非孤例。放眼整个行业,头部大模型公司和互联网巨头正在加速算力基建布局。
发布于 浙江
分享
评论
1
未登录
友善发言
image-upload
评论
加载中