北京人形提出具身智能策略框架 FreqPolicy

北京人形机器人创新中心(国家地方共建具身智能机器人创新中心)发文宣布,其团队研发的具身智能策略框架 FreqPolicy: Efficient Flow-based Visuomotor Policy via Frequency Consistency,成功入选人工智能领域顶级会议 NeurIPS。

根据介绍,FreqPolicy 框架的核心创新在于:首次引入频谱一致性约束,从频域角度重构具身智能机器人动作的时间建模方式。通过在策略生成过程中引入时序信息的频域表达,FreqPolicy实现了“一步生成高效动作流”,显著提升了具身智能机器人操作的效率与连贯性。

在AI全面走向物理世界的背景下,该项工作面向高效具身操作进行研究,通过一步生成机制,大幅提升动作预测频率和控制频率,满足具身智能机器人系统对于高响应性场景的要求,适用于动态环境、自适应操作等高复杂度场景。

FreqPolicy 将动作块(action chunk)通过DCT-II变换映射到频域空间中进行一致性约束,以更好地捕捉动作的时域特性。同时,FreqPolicy额外设计了一个频域分量的自适应关注策略,使得FreqPolicy在一致性约束中灵活关注重要频段。通过上述策略,FreqPolicy学习到了更优的转移轨迹,最终实现了由噪声到目标动作的一步生成。

在仿真基准中,FreqPolicy显著提升了一步流匹配策略的操作性能。相较于之前的一步动作生成方法SOTA性能,FreqPolicy在Robomimic测试基准上的平均性能提升了6%,在MetaWorld测试基准上的平均性能提升了8.9%。此外,当与OpenVLA等VLA模型相结合时,FreqPolicy能够在不损害操作性能的前提下,将推理速度提高至原来的5倍。

在真实场景应用中,FreqPolicy可以广泛适用于桌面操作、家居服务和工业作业等场景,取得了比标准扩散策略和标准流匹配策略更高的任务成功率,同时其推理频率提升了3-5倍。

未来,北京人形计划进一步优化该方法,同时提升其多峰分布建模能力和推理速度,并探索其在更复杂场景下的应用。

优秀的个人博客,低调大师

微信关注我们

原文链接:https://www.oschina.net/news/374996

转载内容版权归作者及来源网站所有!

低调大师中文资讯倾力打造互联网数据资讯、行业资源、电子商务、移动互联网、网络营销平台。持续更新报道IT业界、互联网、市场资讯、驱动更新,是最及时权威的产业资讯及硬件资讯报道平台。

相关文章

发表评论

资源下载

更多资源
Mario,低调大师唯一一个Java游戏作品

Mario,低调大师唯一一个Java游戏作品

马里奥是站在游戏界顶峰的超人气多面角色。马里奥靠吃蘑菇成长,特征是大鼻子、头戴帽子、身穿背带裤,还留着胡子。与他的双胞胎兄弟路易基一起,长年担任任天堂的招牌角色。

Oracle Database,又名Oracle RDBMS

Oracle Database,又名Oracle RDBMS

Oracle Database,又名Oracle RDBMS,或简称Oracle。是甲骨文公司的一款关系数据库管理系统。它是在数据库领域一直处于领先地位的产品。可以说Oracle数据库系统是目前世界上流行的关系数据库管理系统,系统可移植性好、使用方便、功能强,适用于各类大、中、小、微机环境。它是一种高效率、可靠性好的、适应高吞吐量的数据库方案。

Eclipse(集成开发环境)

Eclipse(集成开发环境)

Eclipse 是一个开放源代码的、基于Java的可扩展开发平台。就其本身而言,它只是一个框架和一组服务,用于通过插件组件构建开发环境。幸运的是,Eclipse 附带了一个标准的插件集,包括Java开发工具(Java Development Kit,JDK)。

Sublime Text 一个代码编辑器

Sublime Text 一个代码编辑器

Sublime Text具有漂亮的用户界面和强大的功能,例如代码缩略图,Python的插件,代码段等。还可自定义键绑定,菜单和工具栏。Sublime Text 的主要功能包括:拼写检查,书签,完整的 Python API , Goto 功能,即时项目切换,多选择,多窗口等等。Sublime Text 是一个跨平台的编辑器,同时支持Windows、Linux、Mac OS X等操作系统。