过去,如果想让机器人布置餐桌,需要给它明确的指令,比如:往前走 2 米,抬起 45 度,食物需要摆在餐盘中,叉子摆到盘子的右侧……
现在,只要对机器人说“把这些餐具以合理的形式摆好”,它就能通过与大语言模型交流,学到怎么摆的常识性知识,然后按照要求把餐具合理地摆出来。
(来源:https://sites.google.com/view/llm-grop)
这项研究来自美国纽约州立大学宾汉姆顿分校张世琦教授团队与合作者,他们提出了一种名为 LLM-GROP 的方法,使机器人能够在复杂环境中高效地完成多对象重新排列任务,在真实环境中的任务成功率达 84.4%。
张世琦对 DeepTech 表示:“我们首次将大语言模型的常识知识与任务与运动规划(TAMP,Task and motion planning)任务结合。该系统表现出强适应能力,支持在动态障碍的环境中进行实时调整。”
该研究为服务机器人在开放世界中的语义任务执行提供了新思路,适用于移动操作平台,即当机器人既需要在任务层面做离散规划,把复杂任务分解成一步步动作,又需要在连续空间里做轨迹规划的情况。
图丨移动机械臂布置餐桌的场景(来源:IJRR)
研究团队对移动操作(MoMa)领域进行研究,重点关注机器人同时执行导航和移动抓取的任务。他们还特别关注如何在给定未明确指定的目标的情况下,计算每个物体应该放置的位置和方式。
研究人员利用大模型的丰富常识知识,例如餐具的摆放方式,来促进任务级和运动级规划。此外,他们还使用计算机视觉方法来学习选择基础位置的策略促进 MoMa 行为。
张世琦举例说道:“这很像餐厅里服务员上菜的情景。一方面,服务员站得离桌子越近越好,另一方面又要与顾客、桌子、椅子以及其他障碍物保持一定的距离。我们用视觉方案来解决站位问题,以兼顾机械手臂和基座的性能表现。”
(来源:IJRR)
以具体场景为例,来理解机器人在任务规划和运动规划之间进行交互:假如机器人想要将餐具摆放到十人餐桌,有人已就座。
在任务层面,它需要判断具体从桌子左边还是右边走过去更安全。与此同时,机器人在上菜时需要决策先放盘子还是杯子等。而运动规划的问题则是:餐桌旁边已有椅子,应该如何调整站姿,能让放盘子的成功率和效率都比较高。
(来源:IJRR)
为验证该系统的效果,该团队分别在真实机器人和仿真环境中进行实验。真实实验涵盖三个不同复杂度的任务,包括摆放不同数量的餐具物品,并在有无障碍物的情况下执行多次试验。结果显示,LLM-GROP 在可生成合理的对象布局的前提下,还能在复杂环境中高效地导航和操作。
其中,在真实世界对象重新排列试验中,机器人的任务成功率达到 84.4%。通过主观人类评估,LLM-GROP 在用户满意度方面比现有的对象重新排列方法表现更好。在仿真环境中,LLM-GROP 的执行时间比其他基线方法更短。
研究人员还对比了不同大模型在系统中的作用,发现 GPT-4 在多数任务中表现最佳,而 Gemini 和 Claude 则在某些特定任务中展现优势。
图丨相关论文(来源:IJRR)
近日,相关论文以《LLM-GROP:利用大语言模型实现可视化的机器人任务与运动规划》(LLM-GROP: Visually Grounded Robot Task and Motion Planning with Large Language Models)为题发表在 International Journal of Robotics Research(IJRR)[1]。
纽约州立大学宾汉姆顿分校张笑寒博士(目前任职于波士顿动力 AI 机器人实验室)、丁琰博士(目前任职于鹿明机器人)、博士生速水陽平(Yohei Hayamizu)和扎伊纳布·阿尔塔韦尔(Zainab Altaweel)是共同第一作者,张世琦教授担任通讯作者。这项研究的合作者还包括美国人形机器人厂家 Agility Robotics 克里斯・帕克斯顿(Chris Paxton)、美国得克萨斯大学奥斯汀分校彼得・斯通(Peter Stone)教授和朱玉可教授。
(来源:资料图)
研究团队计划在未来的研究中继续改进相关问题。例如,在实际环境中可能涉及控制等复杂的问题;进一步探索机器人在抓取时控制器是如何实现的;机器人犯错后如何恢复;为机器人提供更好的摄像头提供更丰富的视觉信息;考虑机器人边走边操作的情况等等。
“我们在这次研究中第一次把大模型用在任务运动规划以及移动操作的问题上,未来我们还将探索在现实场景中更多有趣的问题。”张世琦表示。
参考资料:
1.https://doi.org/10.1177/02783649251378196
运营/排版:何晨龙
《皇冠手机投注下载》,《首次登录送91元红包》送体验金的棋牌平台
“万博的官方网站”
亿博体育外围
……
{!! riqi() !!}
“AG视讯杀猪”{!! reci() !!}
↓↓↓
{!! riqi() !!},全球最大!我国首个百万千瓦级海上光伏项目全容量并网,世界杯投注网跑路,皇马电子游戏网站,千炮捕鱼技能怎么获得,那里可以赌博
{!! riqi() !!},江山如画|一道“光”,惠及全球300万患者,星力捕鱼平台名字,波克捕鱼礼包兑换码cdk,亚星网址,球探手机比分网足球
{!! riqi() !!},憧憬“十五五” ,读懂现代化!国际嘉宾广州热议中国未来新机遇,爱体育平台登录,宝盈,手机即时捷报比分,银河官方下载
{!! riqi() !!}|泰柬双方互指对方在边境地区开火|六合家中宝A|九州bet8登录入口|利记官网app下载|48个国际音标真人发音
{!! riqi() !!}|健身场馆年龄限制一刀切 老年人健身遭遇“年龄歧视”|宝马线上娱乐官方网站|三公下载|澳门金沙游戏网站|赌博app大全下载
{!! riqi() !!}|甘肃首只人工圈养繁育大熊猫幼崽迎百天|世界杯投注地址在哪看|大发体育官网网站|金牌亚洲|手机版足球比分网……
{!! riqi() !!},江西铅山:统战聚力促发展 特色产业助增收,正规足球买球app,凯时k66,ag官方客户端,世界杯买球app官网
{!! riqi() !!},中国出台危险化学品安全法 对危化品储存使用等作出系统规定,tvt体育平台,世界杯买球是怎么买?,桃花岛游戏大厅,银河捕鱼下载
{!! riqi() !!}|从“猫冬”到“忙冬”:沙漠腹地民勤孕育寒旱农业新景|Man体育|推荐几个买球的微信群|天博网站是多少|澳门太阳成
{!! riqi() !!},长三角海关聚力打造 “智慧+长三角” 品牌矩阵,欧亿平台网址,ayx爱游戏全站,葡京信誉开户,亲友棋牌跑得快怎么抢庄几率高
{!! riqi() !!},核心战犯口供!一批日本731部队罪行档案首次披露,电竞宝注册,皇冠足球官方版,娱乐二人转在线收听,雷速体育app官网下载
{!! riqi() !!},北京将于12月18日0时启动空气重污染黄色预警,德州app,10bet体育手机版,手机版真钱斗牛,鸭脖体育在线登录
{!! riqi() !!}|克重缩水,量贩零食店“算盘”打向何方?|银河手机版app下载|欧宝手机版登陆|皇冠官网地址|亚娱电竞
{!! riqi() !!}|180件(套)澳门美术协会会员艺术作品集中亮相|九游老哥俱乐部|奥博体育中心|完美竞技app下载|即时比分球探网手机版
{!! riqi() !!}|(年终特稿)星河摆渡间,感知中国太空探索“航线”新突破|优发娱乐官网登录|188球探比分|金沙手机地址|澳门皇冠四虎最新地址
{!! reci() !!},{!! reci() !!}|(乡村行·看振兴)安徽五河2025年就业三份“账单”映见民生暖意|永利澳门电玩城|买世界杯的小说网站|澳门萄京网上投入|乐鱼app体育
监制:邓金木
策划:赖晗
主创:唐征宇 林箴贺 陈佛烘 颜亦阳 陈林韵
编辑:王家菁、段圣祺