智源开源 RoboBrain-X0,打破机器人跨本体泛化困境

北京智源人工智能研究院宣布开源 RoboBrain-X0 —— 一个能够在零样本泛化、少量样本微调条件下,驱动多种不同真实机器人完成复杂任务的跨本体基座大模型。

RoboBrain-X0 源自 RoboBrain 的多模态基座能力,在 RoboBrain 2.0 数据基础上,进一步融合了真实机器人动作数据。通过统一建模视觉、语言与动作,它实现了跨本体的泛化与适配,具备从感知到执行的一体化能力。

RoboBrain-X0 的设计理念在于:模型首先将复杂任务(如“整理桌面”)分解为与具体机器人“身体”解耦的通用语义动作序列,并通过统一映射机制,将“意图”高效转译为多种机器人可直接执行的动作。从而使得 RoboBrain-X0 突破对单一机器人体系的依赖,实现异构本体统一建模,并具备实用级零样本泛化与复杂任务拆解能力。

与此同时,智源方面还发布了其核心训练数据集 —— RoboBrain-X0-Dataset。为模型提供了覆盖“感知-思考-行动”全链路的坚实基础,旨在打破“数据孤岛”,为开发者提供开箱即用的研发资源。它主要包含四类关键数据:

  • 多模态VQA数据:融合视觉问答与推理数据,显著提升模型从视觉语言到空间交互的理解与响应能力。
  • 精选开源动作数据:引入并整合多场景高质量开源数据,强化模型的任务理解与跨场景泛化能力。
  • 产业伙伴合作数据:联合星海图、松灵等业界伙伴,在真实机器人上采集并标注的多样化场景数据,有效提升模型在产业一线的适应性。
  • 高质量自采数据:体系化构建采集流程,形成多样化的高质量“指令-动作”样本,大幅提升模型在复杂任务分解与动态决策上的能力。

RoboBrain-X0 现已全面开源,包括预训练模型、数据集以及技术文档,并完整接入智源 RoboBrain 2.0 工具链。

优秀的个人博客,低调大师

微信关注我们

原文链接:https://www.oschina.net/news/375479

转载内容版权归作者及来源网站所有!

低调大师中文资讯倾力打造互联网数据资讯、行业资源、电子商务、移动互联网、网络营销平台。持续更新报道IT业界、互联网、市场资讯、驱动更新,是最及时权威的产业资讯及硬件资讯报道平台。

相关文章

发表评论

资源下载

更多资源
优质分享Android(本站安卓app)

优质分享Android(本站安卓app)

近一个月的开发和优化,本站点的第一个app全新上线。该app采用极致压缩,本体才4.36MB。系统里面做了大量数据访问、缓存优化。方便用户在手机上查看文章。后续会推出HarmonyOS的适配版本。

Mario,低调大师唯一一个Java游戏作品

Mario,低调大师唯一一个Java游戏作品

马里奥是站在游戏界顶峰的超人气多面角色。马里奥靠吃蘑菇成长,特征是大鼻子、头戴帽子、身穿背带裤,还留着胡子。与他的双胞胎兄弟路易基一起,长年担任任天堂的招牌角色。

Oracle Database,又名Oracle RDBMS

Oracle Database,又名Oracle RDBMS

Oracle Database,又名Oracle RDBMS,或简称Oracle。是甲骨文公司的一款关系数据库管理系统。它是在数据库领域一直处于领先地位的产品。可以说Oracle数据库系统是目前世界上流行的关系数据库管理系统,系统可移植性好、使用方便、功能强,适用于各类大、中、小、微机环境。它是一种高效率、可靠性好的、适应高吞吐量的数据库方案。

Sublime Text 一个代码编辑器

Sublime Text 一个代码编辑器

Sublime Text具有漂亮的用户界面和强大的功能,例如代码缩略图,Python的插件,代码段等。还可自定义键绑定,菜单和工具栏。Sublime Text 的主要功能包括:拼写检查,书签,完整的 Python API , Goto 功能,即时项目切换,多选择,多窗口等等。Sublime Text 是一个跨平台的编辑器,同时支持Windows、Linux、Mac OS X等操作系统。