关闭广告

鹅厂机器狗:学完真狗子的运动数据,真有二哈那感觉了

量子位13339人阅读

明敏 发自 凹非寺
量子位 | 公众号 QbitAI

让机器狗学完真狗子的运动数据,真有二哈那感觉了!

它轻松跨个栏,后面“主人”差点没跟上:



钻个“狗洞”倒是轻车熟路:



还能两只狗一起撒欢儿,它追、它逃……



这就是鹅厂机器狗的最新进展。

利用预训练模型喂给机器狗真狗子的运动数据、并通过强化学习,机器狗Max不仅在行为上更灵动,而且还能根据已经掌握的技能“举一反三”,去适应更加复杂的环境。

总结来说,就是里里外外都“更狗”了一些(doge).



有策略地追逐撒欢儿

这次机器狗学习的新技能里,最强的一项还是玩游戏。

机器狗不仅能遵守规则,还能自己想出策略赢比赛,可能比真狗子还要聪明些。

具体来看,这是一个障碍追逐比赛,受到“World Chase Tag”启发,规则如下:



研究人员设置了不同游戏难度,最简单的就是空旷场地:



玩游戏过程里,机器狗很明显是有策略的。

比如,一般等到躲避者离棋旗子较远时,追击者才会发起猛攻,把它逼到死角,游戏结束。



如果追击者发现躲避者离旗子很近,自己根本没机会追上它时,它会先放弃追逐,等待下一个旗子出现:



有障碍物干扰也没关系,俩狗子一样玩得很6:



而能够有如此表现,并不是机器狗从一开始就拿这个游戏训练。

它其实是基于自己已经学到的一些动作、知识和技能,来应对这个游戏场景。

具体怎么实现?往下看。

学了真·狗的数据

研究一共分为三个阶段。

  • 学习动物运动姿态
  • 将运动姿态和外界感知联系起来
  • 附加网络获取和复杂任务有关信息

第一阶段,是通过游戏中常用的动作捕捉系统,通过收集真狗的姿态数据,包括走、跑、跳、站立等动作,在仿真器中构建一个模仿学习任务。

然后将这些数据中的信息抽象并压缩到深度神经网络模型中,使其在涵盖运动姿态信息的同时,还具有一定可解释性。

腾讯RoboticsX机器人实验室和腾讯游戏合作,用游戏技术提高了仿真引擎的准确性和高效性,同时游戏制作和研发过程中积累了多元的动捕素材。



这些技术以及数据对基于物理仿真的智能体训练以及真实世界机器人策略部署也起到了一定的辅助作用。



在模仿学习的过程中,神经网络仅接受机器狗的本体感知信息作为输入,例如机器人身上电机的状态等。

再下一步,模型引入周边环境的感知数据,例如通过其他传感器“看到”的脚下的障碍物。



第二阶段,通过额外的网络参数,将第一阶段掌握的动物姿态和外界感知联系在一起。

这样机器狗就能通过已经学会的动作,来应对外界环境。

当机器人能够适应多种复杂的环境后,这些将动物姿态与外界感知联系在一起的知识也会被固化下来,存在神经网络结构中。

然后机器狗就能自如上楼梯了。



或者在不连续、不平整地面上奔跑:



然后就到了最后一阶段,让机器狗根据上面学会的技能,去解决实际问题

也就是上面提到的做游戏环节。



据介绍,游戏中机器狗的所有控制策略都是神经网络策略。

在仿真中进行学习并通过zero-shot transfer(零调整迁移),让神经网络模拟人类的推理方式,来识别从未见过的新事物,并把这些知识部署到真实机器人上。

比如在预训练模型中学会了躲避障碍物的知识,那么在游戏里设置障碍,机器狗也能轻松应对。

本次研究新进展由腾讯Robotics X机器人实验室带来。

该实验成立于2018年,目前推出的机器人项目包括机器狗Max一代/二代、机器狗Jamoca、轮式机器人Ollie、自平衡自动驾驶摩托车等。

One More Thing

值得一提的是,之前UC伯克利的学者也将一种“真狗子”的训练方法,用在了机器狗上。

吴恩达开山大弟子Pieter Abbeel等,让机器狗自己在地上打滚一个小时,学会了走路。



而去年腾讯发布机器狗Max二代时,一段小花絮里,这狗会“扑脚”、“撒欢跑”,确实有家里毛孩子那味儿。

(当然,如果想让它成为一只听主人话的狗, 通过指令即可对其发号施令。)



咱就是说,现在机器狗的发展方向,不朝着翻跟头卷,反倒是要和真狗子“抢饭碗”了吗?



参考链接:
https://tencent-roboticsx.github.io/lifelike-agility-and-play/

版权与免责声明:本文内容转载自其他媒体,目的在于传递更多信息,不代表本网观点或立场,不承担此类作品侵权行为的自己责任及连带责任。
猜你喜欢
精彩推荐

意媒:1000万欧选择性先租后买,罗马接近本周签下R-克里斯滕森

直播吧 浏览 12649

士气大振!迈阿密国际晋级创历史,梅西加盟,冲击队史首冠

天涯沦落人 浏览 14042

钟嘉欣一家越南度假!父母长相曝光,果然中基因彩票,两女也很美

文艺圈娱乐号 浏览 9946

身上这5条线,决定了女人的气质上限

小陈聊搭配 浏览 12081

女作家的衣橱,才是“知识分子”穿搭的天花板

LinkFashion 浏览 8547

南海用武太敏感,台"海委会"自删"火箭弹开炮条款"

海峡导报社 浏览 23932

第37届电影百花奖来了,看完提名名单,我要说:内娱影坛要完了!

娱乐圈笔娱君 浏览 8069

作秀式调研书记涉案超1亿:支持他人写书宣扬其"功绩"

新京报 浏览 63944

6月新势力交付量出炉!理想首破3万辆,蔚来重回万辆阵营

时代财经 浏览 12790

直击2024CES | TCL展示115吋全球最大QD-Mini LED电视

网易科技报道 浏览 10113

杜特尔特警告菲战争风险:原因是美国在菲拥有基地

环球网资讯 浏览 12894

高位推票左江科技,给予“买入”评级:华安证券研报是否违规?

面包财经 浏览 10346

​迪丽热巴穿渔网薄纱冻到抖 怕冷就多穿点吧

娱舆规划局 浏览 16463

米体:小维阿劝说前队友贾洛加盟尤文,告诉他自己在尤文很开心

直播吧 浏览 10141

国羽3冠收官!石宇奇2-0横扫泰国世界冠军 夺法国赛男单冠军

醉卧浮生 浏览 9247

记者:拜仁不考虑出售赫拉芬贝赫,但球员想要稳定出场时间

直播吧 浏览 12534

记者:浙江男篮全队抗议&王奕博暴怒的原因是裁判辱骂了王奕博

直播吧 浏览 10150

手感不佳!班凯罗半场8中2得到7分2助3断

直播吧 浏览 10811

朝鲜宣布试射巡航导弹

央视新闻客户端 浏览 9633

不用等AI毁灭人类了!谷歌前CEO预言:明年美大选“一团糟”

财联社 浏览 12542

正式封杀郑爽!广电时评称不会给郑爽发声露脸机会德不优法不容

趣看热点 浏览 22972
本站所有信息收集于互联网,如本站收集信息侵权,请联系我们及时删除
沪ICP备20017958号-1