首个为具身智能而生的大规模强化学习框架RLinf重磅开源
创始人
2025-09-01 12:16:33

钛媒体App 9月1日消息,清华大学、北京中关村学院、无问芯穹联合北大、伯克利等机构重磅开源RLinf,其为首个面向具身智能的“渲训推一体化”大规模强化学习框架。RLinf的系统可以抽象为用户层(统一编程接口)、任务层(多后端集成方案)、执行层(灵活执行模式)、调度层(自动化调度)、通信层(自适应通信)和硬件层(异构硬件)6大层级。相比其他框架的分离式执行模式,RLinf提出的混合式执行模式,在具身智能训练场景下实现了超120%的系统提速,VLA模型涨幅40%-60%。同时,RLinf高度灵活、可扩展的设计使其可快速应用于其他任务,所训练的1.5B和7B数学推理大模型在AIME24、AIME25和GPQA-diamond数据集上取得SOTA。(广角观察)

相关内容

热门资讯

巨头们竞逐AI办公,AI手机尴... 文|识礁Farsight AI竞赛的焦点瞬息万变。前一天,科技巨头还在争抢超级入口;下一秒,AI办...
豆包酒店订单开始按渠道结算:文... 8月10日起,媒体援引抖音生活服务学习中心的相关政策称:通过豆包 App 入口跳转至抖音来客成交的酒...
秦皇岛看日出海边度假区如是海有... 区位与资源基础 该度假项目位于北戴河新区黄金海岸,整体规划面积5400亩,总投资约100亿元,拥有3...
暑期文旅热度飙升 丰顺以客潮融... 盛夏暑期,文旅市场持续升温。地处客潮文化交融核心地带的丰顺,依托得天独厚的文旅资源、持续升级的配套服...
家门口建起童趣乐园! 酒泉市8... 傍晚时分,位于肃州区东南街街道南苑社区的儿童友好空间人声鼎沸。防滑软垫铺满地面,组合滑梯、攀爬网架、...