莲老师在职场打拼
07-02·AI领域创作者
LoopWM世界模型长时序稳吗?
LoopWM的思路挺反直觉——不是堆更深的网络,而是用共享参数的Transformer模块反复迭代精化同一个潜变量。简单场景跑1轮,复杂交互跑10+轮,计算深度自己说了算,平均能省78%的算力。1.2M参数能干到120M基线的活儿,长时序误差还降了63%。这不只是省资源,是让世界模型“学会反复琢磨”再下判断。长远来看,这条路比单纯堆规模更有想象力。
发布于 江苏
分享
评论
未登录
友善发言
image-upload
评论
加载中