首页 /研究 /混合专家视觉-语言-动作模型中涌现的组合技能
LEARNING

混合专家视觉-语言-动作模型中涌现的组合技能

Shlok Shah, Rhiaan Jhaveri, Tharun Kumar Tiruppali Kalidoss, Chirayu Nimonkar, Ishaan Javali

发表年份
2026
访问权限
开放获取

摘要

本文探讨了在无需预定义任务分解或层次结构的情况下,通过专家演示端到端学习组合式机器人策略。研究发现,使用简化的混合专家(MoE)动作头训练的视觉-语言-动作模型(VLA)能够自发地将任务分解为可重用、可解释的基本动作,专家模块在不同任务间被大量重用且对应不同的低级行为。

关键词

Mixture-of-Expertsrobot policycompositional skillsinterpretability

相关论文

查看 LEARNING 分类全部论文