LaWAM:隐世界动作模型将 WAM 瘦身 24 倍,同时成功率 90%+
June 26, 2026
清华大学团队与正行创新(Striding AI)联合提出了隐空间世界动作模型(Latent World Action Model, LaWAM)。这是一种更适合实时控制的世界动作模型(World-Action Model, WAM)。
LaWAM 绕开未来视频生成,在视觉隐空间中预测动作相关的未来子目标,再把这个隐空间视觉子目标(latent visual subgoal)交给动作生成策略使用,从而在显著压缩模型规模的同时保持高成功率。