化解机器人的「幻觉」：北大发布OmniManip，VLM结合双闭环系统，3D理解能力大幅提升

机器之心 · 公众号 · AI · 2025-01-22 12:45

文章预览

AIxiv专栏是机器之心发布学术、技术内容的栏目。过去数年，机器之心AIxiv专栏接收报道了2000多篇内容，覆盖全球各大高校与企业的顶级实验室，有效促进了学术交流与传播。如果您有优秀的工作想要分享，欢迎投稿或者联系报道。投稿邮箱：liyazhou@jiqizhixin.com；zhaoyunfeng@jiqizhixin.com 本文的作者均来自北京大学与智元机器人联合实验室，通讯作者为北京大学计算机学院助理教授董豪。目前团队研究方向覆盖智能机器人的泛化操纵、具身导航和感知自主决策。团队持续开放联合实习生岗位，提供充足的机器人本体和计算资源。近年来视觉语⾔基础模型（Vision Language Models, VLMs）在多模态理解和⾼层次常识推理上⼤放异彩，如何将其应⽤于机器⼈以实现通⽤操作是具身智能领域的⼀个核⼼问题。这⼀⽬标的实现受两⼤关键挑战制约： 1. VLM 缺少精确 ………………………………

原文地址：访问原文地址
快照地址：访问文章快照
总结与预览地址：访问总结与预览

分享到微博

推荐文章

黄建同学 · 零跑汽车算是站稳脚跟了，上周宣布2024年第四季度实现净利润转正-20250122210008

16 小时前

爱可可-爱生活 · 【Firecrawl Extract：“指哪打哪”的爬虫，Fir-20250122075044

昨天

爱可可-爱生活 · 【用AI加速学习的秘诀（10个关键提示词模板）】10个实用的AI-20250121085010

2 天前

爱可可-爱生活 · 本文通过引入 EraseBENCH 多维基准测试，揭示了现有概念-20250121053006

2 天前

黄建同学 · 免费的编程、计算机和AI电子书大集合🔥🔥🔥34.5K⭐访问-20250120192043

2 天前

真叫卢俊 · “刚需没了。”

5 月前