学习 分类论文(27,955)
清除筛选 ✕从错误中学习:用于自动驾驶的滚动-检索终身策略学习
Cheng Gong, Haoyang Wang, Chao Lu 等 5 位作者
2026
基于自适应想象的目标数据有限视觉强化学习域适应方法
Hyunwoo Park, Sang-Hyun Lee
2026
自动化具身智能体架构设计
Jian Zhou, Sihao Lin, Jin Li 等 6 位作者
2026
SIR:用于可解释机器人学习的结构化图像表示
Paul Mattes, Jan Schwab, Jens Bosch 等 8 位作者
2026
ACPO:面向多智能体强化学习的智能体链式策略优化
Daiki E. Matsunaga, Junho Na, Tri Wahyu Guntara 等 7 位作者
2026
相信直觉:面向视觉-语言-动作模型的置信度驱动测试时强化学习
Siyao Chen, Jiakang Yuan, Jiaxin Wang 等 4 位作者
2026
AI训练管理器:自适应训练配方的有界闭环控制
Anjali Rao, Nikhil Kamalkumar Advani
2026
RoAd-RL:鲁棒对抗性强化学习的统一库与基准测试
Adithya Mohan, Daniel Kriegl, Torsten Schön
2026
STEAM:面向真实世界机器人学习的自监督时序集成优势建模
Zhihao Liu, Qiuyi Gu, Yitao Wang 等 19 位作者
2026
基于Koopman信息图的数据驱动系绳空间系统建模与控制
Ao Jin, Yifeng Ma, Panfeng Huang 等 4 位作者
2026
进化超参数优化寻找用于自主转向的轻量级CNN模型
Devson Butani, Ryan Kaddis, Chan-Jin Chung
2026
具有概率保证的马尔可夫决策过程中可达性概率原因的高效样本学习
Ryohei Oura, Georgios Fainekos, Hideki Okamoto 等 4 位作者
2026
CORE:从无动作视觉演示中提取机器人操作的通用结果规律
Juyi Sheng, Jincheng Li, Mingxin Tan 等 4 位作者
2026
从动作到世界建模的学习可迁移动力学先验
Ze Huang, Jiahui Zhang, Hairuo Liu 等 6 位作者
2026
立场:视觉-语言-动作模型无法被验证执行物理推理
Taozhao Chen, Ian Manchester, Huaming Chen
2026
CORE规划器:面向未知环境中机器人导航的上下文记忆强化学习
Jintao Kong, Zhihao Zhang, Weihuang Chen 等 7 位作者
2026
一种面向在线多人多机器人编队的线性匹配赌博机方法
Yaohui Guo, X. Jessie Yang, Cong Shi
2026
行为反克隆:将模式重定向蒸馏到策略权重中,无需推理时引导
Hao Wang, Jiuzhou Lei, Dayou Li 等 8 位作者
2026
HJ-SafeDMP:基于Hamilton-Jacobi可达性引导的动态运动基元实现可证明安全的机器人运动
Siddhanth Ramesh, Ravi Prakash
2026
ReGuide:从测试时引导到自我改进的扩散策略
Tzu-Hsiang Lin, Srinivas Shakkottai, Dileep Kalathil 等 4 位作者
2026
随机动态系统中Adam算法的分析
Xin Zheng, Yifei Jin, Lei Guo
2026
Q-DASC:局部模型误设下最先进的暖通空调安全量子控制
Yifan Wang
2026
ViPSim:协同视觉与参数空间实现一致的长时域具身世界模型
Longyu Chen, Heng Li, Wei Yang 等 5 位作者
2026
基于物理的多智能体动力学世界模型基准
Nuo Chen, Lulin Liu, Zihao Li 等 15 位作者
2026