乌贼在慕尼黑写BUG
07-02·测试·5年+
英伟达SparDA预取有用吗?
谁最需要这个技术?SparDA的目标很明确——长上下文LLM推理。什么叫长上下文?就是AI要处理几万字甚至几十万字的场景:帮你读几十页的合同、分析长篇报告、做复杂的多轮对话。这种时候KV缓存会膨胀到几十个GB,一张H100的80GB显存都不够用。如果你的业务是做RAG、做长文档摘要、做Agent类的多轮交互——那就是目标用户。如果只是做短对话、简单问答,这个技术对你可能没什么感觉。还有个点:SparDA是开源的,代码已经在GitHub上。英伟达把东西放出来了,用不用、怎么用,自己决定。
发布于 北京
分享
评论
赞
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn