LOCOMOTION
空中多模态大语言模型智能体的零样本任务级评估
Suman Navaratnarajah, Taehyoung Kim, Jona Ruthardt, Ishaan Bhimwal, Ryousuke Yamada, Yannik Blei, Wolfram Burgard, Yuki M Asano
- 发表年份
- 2026
- 访问权限
- 开放获取
摘要
本文提出了MissionBench基准,用于评估多模态大语言模型在三维空中环境中执行长期任务的能力。实验表明,最强模型在任务成功率上远低于人类水平,揭示了多步骤具身任务的挑战性。
关键词
Zero-shotAerial robotsMLLMEmbodied agentsBenchmark
相关论文
LOCOMOTION
开放获取📊 3,141 引用
Trust Region Policy Optimization
John Schulman, Sergey Levine, Philipp Moritz 等 5 位作者
2015
LOCOMOTION
📊 2,724 引用
Legged Robots That Balance
Marc H. Raibert, Ernest R. Tello
1986
LOCOMOTION
📊 2,658 引用
Being there: putting brain, body, and world together again
1997
LOCOMOTION
📊 2,305 引用
Small-scale soft-bodied robot with multimodal locomotion
Wenqi Hu, Guo Zhan Lum, Massimo Mastrangeli 等 4 位作者
2018