Redian新闻
>
「灌篮高手」模拟人形机器人,一比一照搬人类篮球招式,看一遍就能学会,无需特定任务的奖励

「灌篮高手」模拟人形机器人,一比一照搬人类篮球招式,看一遍就能学会,无需特定任务的奖励

公众号新闻
西风 发自 凹非寺
量子位 | 公众号 QbitAI

投篮、运球、手指转球…这个物理模拟人形机器人会打球

会的招数还不少:

一通秀技下来,原来都是跟人学的,每个动作细节都精确复制:

这就是最近一项名为PhysHOI的新研究,能够让物理模拟的人形机器人通过观看人与物体交互(HOI)的演示,学习并模仿这些动作和技巧。

重点是,PhysHOI无需为每个特定任务设定具体的奖励机制,机器人可以自主学习和适应。

而且机器人的身上总共有51x3个独立控制点,所以模仿起来能做到高度逼真。

一起来看具体是如何实现的。

模拟人形机器人变身「灌篮高手」

这项工作由来自北京大学、IDEA研究院、清华大学、卡内基梅隆大学的研究人员共同提出。

经研究人员介绍,此前大多数类似工作,存在模仿动作孤立、需特定任务的奖励、未涉及灵巧的全身运动等局限。

而他们提出的PhysHOI,应用动作捕捉技术提取HOI数据,然后使用模仿学习来学习人体运动和物体控制,解决了这些问题。

其中,HOI数据重要组成部分之一是涵盖了人体运动、物体运动、相对运动的运动学数据(Kinematic Data),记录了位置、速度、角度等信息。

另外,动态数据(Dynamic Data)反映了运动过程中的实时变动和更新,也很重要。

为了弥补HOI数据中动态信息的不足,研究人员引入了接触图(contact graph,CG)

CG的节点由机器人的肢体部件和物体组成;每条边则是一个二进制接触标签,只表达“接触”或“不接触”两种状态。

此外,还可以将多个肢体部件放到一个节点中,形成一个聚合CG(Aggregated CG)

具体来说,PhysHOI方法是:

首先通过运动捕捉获取参考HOI状态序列,包含人体运动、物体运动、交互图和接触图。

然后用第一帧的信息初始化物理模拟环境,构建包含当前模拟状态和下一个参考状态的系统状态。

接下来输入策略网络生成的动作控制人形机器人,物理模拟器根据动作更新场景中人体和物体的状态,计算包含运动匹配、接触图等多个方面的奖励。

利用奖励、状态和动作样本优化策略网络,采用更新后的策略网络开始新一轮的模拟过程,如此循环直至网络收敛,最终获得能够重现参考HOI技能的控制策略。

值得一提的是,研究人员在这当中设计了一个与任务无关的HOI模仿奖励,无需针对不同任务自定义奖励函数,包括体现运动匹配度的身体和物体奖励、反映接触正确性的接触图奖励,避免了使用错误身体部位接触物体等局部最优解。

接触图奖励是关键

研究人员在两个HOI数据集上测试了PhysHOI。

其中引入了BallPlay数据集,包含多种全身篮球技能。

他们在GRAB数据集的S8子集中选择了5个抓取案例,以及BallPlay数据集的8个篮球技能。

以此前的DeepMimic、AMP等方法作为基线,为公平比较,研究人员将其做了修改,以适应HOI模仿任务。

结果显示,以往只使用运动学奖励的方法无法准确复现交互,球会掉落或抓握失败。

而在接触图的指导下,PhysHOI成功进行了HOI模仿。

PhysHOI在两个数据集上都获得最高的成功率,分别为95.4%和82.4%,同时也取得最低的运动误差,显著优于其它方法。

消融研究表明,接触图奖励能有效避免只使用运动信息的方法陷入局部最优,指导机器人实现正确接触。

如果没有接触图奖励,人形机器人可能无法控制球,或者错误地使用身体其它部位控制球:

论文链接:https://arxiv.org/abs/2312.04393

—  —

点这里👇关注我,记得标星哦~

一键三连「分享」、「点赞」和「在看」

科技前沿进展日日相见 ~ 

微信扫码关注该文公众号作者

戳这里提交新闻线索和高质量文章给我们。
相关阅读
国内首个省级人形机器人创新中心在北京成立清华90后博导创业,人形机器人用上大模型,成立5个月融资超亿元斯坦福机器人炒虾爆火网络,谷歌DeepMind发布机器人最新进展,2024智能机器人元年到来?人形机器人加速商业化!优必选上市首日市值逼近390亿港元成立半年拿到超亿元天使轮融资,星动纪元专注研发具身智能人形机器人|36氪首发人形机器人技术专利哪家强?人形机器人技术专利:中国第一七问+一图,读懂《人形机器人创新发展指导意见》Gemini 演示视频被指夸大性能;亚马逊测试人形机器人 Digit;《黑神话:悟空》官宣明年 8 月发售 | 极客早知道朝鲜战争志愿军为什么没有全军覆没马斯克再次带火人形机器人,资本炒作下成色几何?苏东坡诗文里的酒与酒鬼Walker S敲锣,「人形机器人第一股」优必选在港交所主板挂牌上市人形机器人商用难在哪? 优必选创始人:有四座“大山”工信部印发《人形机器人创新发展指导意见》;首个电力物联OS发布|AIoT情报踹不倒!国产人形机器人整活,售价不到9万美元从“轮子上的机器人”到“人形机器人”,车企跨界胜算几何?被称为下一个马斯克,他的人形机器人最快2024年交货从追赶者到引领者,人形机器人能否走出下一个「比亚迪」?重新拿起笔来深挖技术专利护城河,中国如何成为人形机器人全球创新“主力军”?特斯拉机器人叠衣服,6000万网友围观!难逃人形机器人悖论!“黑寡妇”起诉AI开发商私自生成其声音图像;百度文心一言付费版59.9元/月;特斯拉加大人形机器人相关岗位招聘力度丨AI周报书识——— 读孙过庭《书谱》成立半年拿到超亿元天使轮融资,星动纪元专注研发具身智能人形机器人|早起看早期红色日记 批评高潮 2.16-28智能科技|纯米科技郭文祺:从智慧厨房走到人形机器人,智能科技的终极形态机器人会煮咖啡了,下一个马斯克押注人形机器人!仅靠13页PPT,OpenAI投的这家人形机器人创业公司又融了1亿美元首款基于开源鸿蒙系统的专业级人形机器人正式发布给人形机器人泼一盆冷水人形机器人革命:探索 Embodiment 技术的最新进展与商业化机会|活动报名厉害了!休斯顿NASA太空机器人进入最后测试阶段,或可模拟人类执行外星任务!“人形机器人第一股”诞生!优必选上市首日市值逼近390亿港元,人形机器人加速驶向商业化Vue 3.4 “灌篮高手” 发布
logo
联系我们隐私协议©2024 redian.news
Redian新闻
Redian.news刊载任何文章,不代表同意其说法或描述,仅为提供更多信息,也不构成任何建议。文章信息的合法性及真实性由其作者负责,与Redian.news及其运营公司无关。欢迎投稿,如发现稿件侵权,或作者不愿在本网发表文章,请版权拥有者通知本网处理。