
henry 发自 凹非寺体育赛事直播
量子位 | 公众号 QbitAI
机器东谈主打乒乓球,这(zhei)您受得了吗?
重要玩的还王人是高难度:并步接球!

0.42秒极限反映扞拒扣球!

最高还能对拉106拍!

打不外,归正我是打不外。
这位乒乓球场上的机器东谈主妙手,出自清华姚班本科生苏智(师从吴翼训练)的最新论文——《HITTER: A HumanoId Table TEnnis Robot via Hierarchical Planning and Learning》。
在这篇论文中,连系者们提倡了一套结合模子计算与强化学习的分层框架,罢了了东谈主形机器东谈主在亚秒级(sub-second)反映下的寂静连气儿对打。
这是怎样作念到的?
基于计算与舍弃的分层框架总的来说,为了教机器东谈主打乒乓球,连系团队提倡了一个将高层计算与低层舍弃分开科罚的框架。
其中,在高层计算中,基于模子的计算器(model-based planner)或者导航球的轨迹,并展望击球位置、速率和时机。
在低层框架中,基于强化学习(RL)的全身舍弃器,或者阐发计算器的展望,生成合营的手臂和腿部作为来履行与东谈主类雷同的打击作为。
具体来说,连系团队胜利将宇树G1的手掌形成了乒乓拍子,并让它站在一张模范尺寸的乒乓球台上进行磨练。
在感知方面,连系给与了九个OptiTrack录像头(运行频率为360 Hz)来跟踪球的位置,这达到了毫米级的精度。
在计算方面,基于模子的计算器在每个工夫步收受球的位置数据,并展望拍子的击球位置、速率和时机。
这些展望被寄托给全身舍弃器,以生成宇树G1所需的击球时机和拍子速率。
之后,机器东谈主阐发强化学习束缚诊疗击球计谋,普及畅通发挥。
此外,为了饱读舞机器东谈主作念出访佛东谈主类的挥拍作为,连系东谈主员还在计谋磨练中加入了东谈主类作为参考(正手和反手)。
通过东谈主类作为参考进行磨练,机器东谈主产生了与东谈主类作为尽头雷同的击球步履:举例下图中机器东谈主击球时的腰部旋转。
在真确全国的实验中,团队向机器东谈主投掷了26个球,机器东谈主收效回球24次,击中后未回球1次,十足失球1次,达到了96.2%的击球率和92.3%的回球率。
何况,就像咱们起原提到的,G1在与东谈主类敌手对打时,罢了了多达106次的连气儿击球,这一连拍远远非凡了空闲东谈主类玩家的水平。
此外,G1还发挥出了扞拒扣球的才能。
终末,值得一提的是,除了与东谈主类进行对战,机器东谈主也不错在十足自主的匹配环境中抓续进行对战。
为什么是乒乓球?
在前段工夫的机器东谈主畅通会上,咱们仍是看到了不少机器东谈主参与的畅通方法(如跑步、拳击、足球等)。
不外,这些畅通往往留给机器东谈主较长的诊疗与反映工夫。
而在实际生涯中,机器东谈主往往需要在动态环境下与快速转移的物体交互,这种交互从根底上讲更难:
因为它们不仅需要各个要道的合营舍弃,还需要在极限工夫测量内运行的精密感知-活动闭环,而乒乓球恰是此类交互的绝佳例子。
相干于网球或羽毛球等畅通,乒乓球的距离更短、攻防诊疗更快、反映工夫窗口更小(球速非凡5米/秒)。
这就意味着机器东谈主系统必须在片刻内完成感知、展望、计算和击球以及与转移或静态的不同操作。
更难的是,收效的击球需要敏捷的全身畅通,包括快速摆入手臂、动掸腰部、快速垫步和收复均衡,以确保准确击球并为下一次打作念好准备。
是以,打乒乓球,对东谈主形机器东谈主来说,还真不是一件容易的事。
仍是运转期待下一次的机器东谈主畅通会了!
参考联接:
[1]https://arxiv.org/pdf/2508.21043
[2]https://humanoid-table-tennis.github.io
— 完 —
量子位 QbitAI · 头条号签约
温顺咱们体育赛事直播,第一工夫获知前沿科技动态