猫眼电影
猫眼电影记者 杨树壁 报道首次登录送91元红包
过去,如果想让机器人布置餐桌,需要给它明确的指令,比如:往前走 2 米,抬起 45 度,食物需要摆在餐盘中,叉子摆到盘子的右侧……
现在,只要对机器人说“把这些餐具以合理的形式摆好”,它就能通过与大语言模型交流,学到怎么摆的常识性知识,然后按照要求把餐具合理地摆出来。
(来源:https://sites.google.com/view/llm-grop)
这项研究来自美国纽约州立大学宾汉姆顿分校张世琦教授团队与合作者,他们提出了一种名为 LLM-GROP 的方法,使机器人能够在复杂环境中高效地完成多对象重新排列任务,在真实环境中的任务成功率达 84.4%。
张世琦对 DeepTech 表示:“我们首次将大语言模型的常识知识与任务与运动规划(TAMP,Task and motion planning)任务结合。该系统表现出强适应能力,支持在动态障碍的环境中进行实时调整。”
该研究为服务机器人在开放世界中的语义任务执行提供了新思路,适用于移动操作平台,即当机器人既需要在任务层面做离散规划,把复杂任务分解成一步步动作,又需要在连续空间里做轨迹规划的情况。
图丨移动机械臂布置餐桌的场景(来源:IJRR)
研究团队对移动操作(MoMa)领域进行研究,重点关注机器人同时执行导航和移动抓取的任务。他们还特别关注如何在给定未明确指定的目标的情况下,计算每个物体应该放置的位置和方式。
研究人员利用大模型的丰富常识知识,例如餐具的摆放方式,来促进任务级和运动级规划。此外,他们还使用计算机视觉方法来学习选择基础位置的策略促进 MoMa 行为。
张世琦举例说道:“这很像餐厅里服务员上菜的情景。一方面,服务员站得离桌子越近越好,另一方面又要与顾客、桌子、椅子以及其他障碍物保持一定的距离。我们用视觉方案来解决站位问题,以兼顾机械手臂和基座的性能表现。”
(来源:IJRR)
以具体场景为例,来理解机器人在任务规划和运动规划之间进行交互:假如机器人想要将餐具摆放到十人餐桌,有人已就座。
在任务层面,它需要判断具体从桌子左边还是右边走过去更安全。与此同时,机器人在上菜时需要决策先放盘子还是杯子等。而运动规划的问题则是:餐桌旁边已有椅子,应该如何调整站姿,能让放盘子的成功率和效率都比较高。
(来源:IJRR)
为验证该系统的效果,该团队分别在真实机器人和仿真环境中进行实验。真实实验涵盖三个不同复杂度的任务,包括摆放不同数量的餐具物品,并在有无障碍物的情况下执行多次试验。结果显示,LLM-GROP 在可生成合理的对象布局的前提下,还能在复杂环境中高效地导航和操作。
其中,在真实世界对象重新排列试验中,机器人的任务成功率达到 84.4%。通过主观人类评估,LLM-GROP 在用户满意度方面比现有的对象重新排列方法表现更好。在仿真环境中,LLM-GROP 的执行时间比其他基线方法更短。
研究人员还对比了不同大模型在系统中的作用,发现 GPT-4 在多数任务中表现最佳,而 Gemini 和 Claude 则在某些特定任务中展现优势。
图丨相关论文(来源:IJRR)
近日,相关论文以《LLM-GROP:利用大语言模型实现可视化的机器人任务与运动规划》(LLM-GROP: Visually Grounded Robot Task and Motion Planning with Large Language Models)为题发表在 International Journal of Robotics Research(IJRR)[1]。
纽约州立大学宾汉姆顿分校张笑寒博士(目前任职于波士顿动力 AI 机器人实验室)、丁琰博士(目前任职于鹿明机器人)、博士生速水陽平(Yohei Hayamizu)和扎伊纳布·阿尔塔韦尔(Zainab Altaweel)是共同第一作者,张世琦教授担任通讯作者。这项研究的合作者还包括美国人形机器人厂家 Agility Robotics 克里斯・帕克斯顿(Chris Paxton)、美国得克萨斯大学奥斯汀分校彼得・斯通(Peter Stone)教授和朱玉可教授。
(来源:资料图)
研究团队计划在未来的研究中继续改进相关问题。例如,在实际环境中可能涉及控制等复杂的问题;进一步探索机器人在抓取时控制器是如何实现的;机器人犯错后如何恢复;为机器人提供更好的摄像头提供更丰富的视觉信息;考虑机器人边走边操作的情况等等。
“我们在这次研究中第一次把大模型用在任务运动规划以及移动操作的问题上,未来我们还将探索在现实场景中更多有趣的问题。”张世琦表示。
参考资料:
1.https://doi.org/10.1177/02783649251378196
运营/排版:何晨龙
时事1:高校体育官网版入口
12月28日,票友荟萃“曲艺窝子” 同台展非遗曲艺画卷,报道说,针对国际赛事播放国歌时出错事件,李家超表示,国歌代表民族尊严、国家尊严,将竭尽一切所能,确保国歌在不同场合正确播出。他说,特区政府已制定不同指引要求不同组织、代表团遵守,如果他们不遵守,特区政府会有惩处行动。,赌博老虎机视。
12月28日,加拿大侨界公祭南京大屠杀死难者 警醒以史为鉴维护和平,双方认为,人文交流对增进相互理解、弘扬睦邻友好传统、赓续两国人民世代友好、夯实双边关系社会基础具有极其重要而深远的意义。双方愿共同努力,积极拓展两国人文合作,提升合作水平,扩大合作成果。为此,双方商定:,19体育官网登录,BG真人娱乐厅,大众彩票平台注册。
时事2:澳门永利贵宾下载
12月28日,憧憬“十五五” ,读懂现代化!国际嘉宾广州热议中国未来新机遇,值得注意的是,在教育部明确“从严控制高校异地办学”背景下,对地方而言,下大力气办好本地院校的重要性更加凸显。,沙巴体育官方网站官网,斗牛口诀表大全,ag游戏官方网站。
12月28日,【东西问】意大利前总理普罗迪谈欧中青年交往:年轻人是最值得投入的资源,根据公告,本次交易未设置业绩承诺或对赌安排。昊海生科提示称,如瑞济生物业绩下滑或不达预期,则不存在交易对价调整或股份回购等机制,故本次交易存在投资出现损失乃至投资资金无法收回的风险。,篮球买球app,澳门百老汇老虎机手机网站,bet365在线买球。
时事3:云顶官网下载
12月28日,港澳台侨企业组团亮相长春 冀加深与药材原产地合作,总体我们采用大中台框架搭建系统。以低空经济定制案例为例,无论是eVTOL、直升机、低空卫星还是储能电池,都可以用同一套系统支持。我们坚持“一平台多业务”,避免业务人员每接触新业务就要熟悉新系统。我们以强大技术底座快速响应市场多变的融资需求,从而完成系统建设。,云顶国际平台,澳门线上黄金城,澳门平台注册。
12月28日,赖清德推荐陆配面馆? 国台办指装模作样营造假象,我们现在的融资业务系统已经实现智能化。例如在系统中集成DeepSeek AI技术,支持大额业务和经营租赁系统,甚至与其他厂商直接接口对接。比如与创维的系统对接,满足获客需求。这些科技赋能和AI应用大大提升了系统能力,也显著提高了业务员的工作效率。,网站可以买球,188bet金宝搏官网APP,易博体育官方平台网。
时事4:澳门皇家游戏直营正规吗
12月28日,国家能源局:今年原油产量有望达到2.15亿吨,据《华尔街日报》23日援引美国人口普查局的数据报道,数据中心建设支出最早有望在明年超过写字楼建设支出。在AI需求的推动下,数据中心的投资回报率已领跑市场,据美国房地产投资受托人全国委员会数据,该类资产去年的回报率高达11.2%,除活动房屋外,表现优于所有其他房地产板块。,百老汇注册平台,牛宝体育登录官网,官方网永利网址。
12月28日,打通“末梢梗阻”城乡共饮放心水 以水为“媒”促增收撑起农户“钱袋子”,草案二审稿明确,从事跨境电子商务零售进口的电子商务平台经营者、物流企业和报关企业,以及法律、行政法规规定负有代扣代缴、代收代缴关税税款义务的单位和个人,是关税的扣缴义务人。,捷报体育资讯app,体育彩票投注网站,雷速怎么恢复指数设置。
责编:熊要先
审核:梁佳
责编:张东明












