互联网频道 频道

百度百舸AI Infra再升级,率先支持RLinf v0.3

7月16日,全球具身智能强化学习开源框架RLinf正式发布v0.3版本。百度智能云于发布当天完成适配,成为国内首家支持RLinf v0.3的云厂商。开发者可基于百度百舸AI计算平台,一键体验RLinf最新能力,加速前沿开源成果向产业应用落地。此次RLinf v0.3首次打通数据管理、监督微调(SFT)、强化学习(RL)、模型评测及真机部署等关键环节,实现从仿真训练到真机在线学习,再到持续迭代优化的完整开发闭环,为机器人持续进化提供更加完善的技术基础。

国内首家完成RLinf v0.3适配,最新开源成果快速进入产业实践

近年来,具身智能快速发展,机器人训练逐渐从单一算法突破转向数据、模型、算力和工程协同优化。RLinf作为全球具身智能领域重要的开源强化学习框架,持续快速迭代,已成为机器人强化学习开发的重要基础设施。此次发布的RLinf v0.3进一步扩展了模型生态与训练能力,不仅新增支持DreamZero、GR00T、StarVLA、LingBot-VLA等主流模型,还完善了真机强化学习、仿真强化学习及Human-in-the-loop等训练范式,首次实现机器人持续学习全流程闭环。

百度智能云第一时间完成适配,让开发者无需等待框架迁移,即可第一时间体验最新开源能力,进一步缩短技术创新向产业应用转化周期。

百度百舸打造具身智能研发全流程底座,加速模型训练与部署

依托百度百舸AI计算平台,开发者可通过"快速开始"能力,一键启动RLinf v0.3开发环境,快速完成LIBERO仿真环境、OpenVLA模型训练等预置镜像部署,无需繁琐配置,即可开展模型开发与训练。

除了快速完成框架适配,百度百舸还依托高性能计算、极致存储及高速互联网络,构建覆盖数据准备、开发训练、仿真验证到推理部署的完整研发链路,并结合AI Infra工程优化能力,进一步提升模型训练效率、缩短迭代周期,提高算力资源利用效率,为具身智能研发提供稳定高效的基础设施支撑。

AI Infra工程优化能力持续验证

此前,百度百舸联合上海交通大学、地瓜机器人共同发布强化学习训练框架dVLA-RL,首次打通经典PPO算法与离散扩散VLA模型的适配路径,为机器人Foundation Model持续自主进化提供新的技术路径,相关实验全部基于百度百舸AI计算平台完成。

目前,百度百舸已服务超过30家具身智能头部企业及创新中心。未来,百度智能云将持续携手开源社区、科研机构及产业伙伴,不断完善AI计算平台与AI Infra工程能力,加速前沿技术创新向产业应用转化,推动具身智能迈向规模化发展。


特别提醒:本网信息来自于互联网,目的在于传递更多信息,并不代表本网赞同其观点。其原创性以及文中陈述文字和内容未经本站证实,对本文以及其中全部或者部分内容、文字的真实性、完整性、及时性本站不作任何保证或承诺,并请自行核实相关内容。本站不承担此类作品侵权行为的直接责任及连带责任。如若本网有任何内容侵犯您的权益,请及时联系我们,本站将会在24小时内处理完毕。
0
相关文章