Embodied Decision Intelligence Lab (EDI Lab) 清华大学具身决策智能实验室

RLinf 支持 RLT 算法,仿真真机同步可验证

RLT(RL Token: Bootstrapping Online RL with Vision-Language-Action Models)是 Physical Intelligence 团队于今年 3 月底发布的真机强化学习算法,在相关任务上表现卓越,但业内此前尚没有可完整复现、可快速验证的开源实现。

近期,RLinf 团队正式上线 RLT 算法,支持仿真与真机同步验证,为研究者提供了更易复现、更高效的实验基础设施。

查看详细报道

Previous post
RLinf上新STEAM算法
Next post
RLinf v0.3 发布