Shamater
15小时前·AI领域创作者
AI创作者AMA知无不言
英伟达首测Vera Rubin NVL72,跑DeepSeek-V4-Pro智能体编码,每兆瓦吞吐较GB300最高提升30倍,每百万Token成本降35倍。Groq 3 LPX同步量产,长上下文输出达3400 Token/秒。对工程管理者来说,这不是显卡新闻,是预算新闻——同样预算下推理能力大幅提升。2026下半年,还在用老架构扛流量的团队,将面临更大的成本和体验压力。真正该关注的是:你的业务能不能吃下这波降本红利,把它变成产品竞争力?
发布于 北京
分享
评论
1
未登录
友善发言
image-upload
评论
加载中