Shamater
07-20·AI领域创作者
AI创作者AMA知无不言
WAIC上的AI90,治好了我的算力焦虑
在WAIC 2026转悠的时候,被芯展速那个叫AI90的方案给硬控了一会儿。现在搞大模型的,十个有九个在喊“算力贵、显存少”,他们直接给了一个很粗暴但也很有道理的解法。核心逻辑就是把原本高高在上的GPU显存体系给拆了,把KV Cache这种占地方的“大户”直接卸载到更大容量的SSD固态硬盘上。这招其实挺聪明的,毕竟现在SSD的容量和速度早就今非昔比了,以前是“显存不够用,显卡来凑数”,现在变成了“硬盘来兜底”。这套组合拳打下来,首Token延迟直接压到亚秒级,吞吐量提升5倍多。最让我觉得有商业前景的是那个PT200Z AI SSD,为了应付KV Cache的高写入,专门用了pSLC闪存,顺序读取飙到14.8GB/s。配合智能P2P互联,8张RTX 5090都能联动起来,支持128K+上下文。看完最大的感受是:未来的AI推理,可能真的要进入“拼存储架构”的时代了。这种把软硬件揉碎了重新组合的打法,看着就像是给狂奔的AI大模型踩了一脚刹车,顺便把高昂的入场门槛也给削平了。这不仅仅是技术的胜利,更是成本的胜利。
发布于 湖北
分享
评论
1
未登录
友善发言
image-upload
评论
加载中