RLinf 支持 RLT 算法,仿真真机同步可验证
July 09, 2026
RLT(RL Token: Bootstrapping Online RL with Vision-Language-Action Models)是 Physical Intelligence 团队于今年 3 月底发布的真机强化学习算法,在相关任务上表现卓越,但业内此前尚没有可完整复现、可快速验证的开源实现。
近期,RLinf 团队正式上线 RLT 算法,支持仿真与真机同步验证,为研究者提供了更易复现、更高效的实验基础设施。