学习 分类论文(27,846)
清除筛选 ✕训练可观测控制策略以通过动作暴露智能体状态
Andres Enriquez Fernandez, John J. Bird
2026
支持约束强化学习实现无需真实世界经验的真实世界策略改进
Raymond Yu, William Huey, Mustafa Mukadam 等 5 位作者
2026
世界动作模型通过循环生成重放实现持续模仿学习
Manish Kumar Govind, Dominick Reilly, Smit Patel 等 5 位作者
2026
PhysiFormer:在世界空间中学习模拟力学
Yiming Chen, Yushi Lan, Andrea Vedaldi
2026
Continual Robot Policy Learning via Variational Neural Dynamics
Jiaxu Xing, Zhiyuan Zhu, Yunfan Ren 等 7 位作者
2026
Bridging Performance and Generalization in Reinforcement Learning for Agile Flight
Jonathan Green, Jiaxu Xing, Nico Messikommer 等 5 位作者
2026
Automating Potential-based Reward Shaping with Vision Language Model Guidance
Henrik Müller, Daniel Kudenko
2026
利用深度学习逆向设计紧凑宽带倒置Doherty功率放大器
Han Zhou, Haojie Chang, David Widen 等 4 位作者
2026
XMSE感知的自适应经验贝叶斯估计
Minghao Chen, Jiale Zheng
2026
RobOralScan: Learning Active Intraoral Scanning for Robotic Dental Reconstruction
Jinhyung Lee, Haeun Yun, Siwon Kim 等 7 位作者
2026
PlanRL: A Trajectory Planning Architecture for Reinforcement Learning-based Driving Experts
Joonhee Lim, Yongjae Lee, Jangho Shin 等 4 位作者
2026
IDEA: Insensitive to Dynamics Mismatch via Effect Alignment for Sim-to-Real Transfer in Multi-Agent Control
Chenlong Liu, Zhuohui Zhang, Xinyan Chen 等 6 位作者
2026
重新审视复杂动作空间的动作分解方法
Timothy Flavin, Sandip Sen
2026
输入凸神经网络作为IBR主导电力系统稳定性约束优化中的替代模型
Wangkun Xu, Hongyang Jia, Yi Wang 等 5 位作者
2026
SOLAR:人工智能驱动的光速性能分析
Qijing Huang, Sana Damani, Zhifan Ye 等 12 位作者
2026
通过量子采样特征的混合软演员-评论家实现可行性感知的安全约束机组组合
George Dimas, Amin Masoumi, Mert Korkali
2026
Scaling Nonlinear Optimization: Many Problems One GPU
John Viljoen, Johanna Haffner, Masayoshi Tomizuka 等 4 位作者
2026
TaskNPoint:如何让您的仿人机器人在几分钟内学会反手击球
Blake Werner, Ilona Demler, Pietro Perona 等 4 位作者
2026
Deep Reinforcement Learning-Enhanced Event-Triggered Data-Driven Predictive Control for a 3D Cable-Driven Soft Robotic Arm
Cheng Ouyang, Moeen Ul Islam, Kaixiang Zhang 等 6 位作者
2026
Learning Robot Visual Navigation in Crowds via Intention-Aware Scene Representations
Han Bao, Bingyi Xia, Hanjing Ye 等 8 位作者
2026
FORCE: Efficient VLA Reinforcement Fine-Tuning via Value-Calibrated Warm-up and Self-Distillation
Shuyi Zhang, Yunfan Lou, Hongyang Cheng 等 11 位作者
2026
Multi-Agent Goal Recognition with Team- and Goal-Conditioned Reinforcement Learning and Factorized Branch-and-Bound
Thiago Thomas, Gabriel de Oliveira Ramos, Felipe Meneguzzi
2026
A 3D-Printable Dataset for Fair Testing and Comparisons of Tactile Sensors
Dexter R. Shepherd, Nicolas Herzig, Phil Husbands 等 6 位作者
2026
Stage-Aware and Roughness-Constrained Diffusion Policy for Multi-Stage Robotic Polishing
Shuai Ke, Jiexin Zhang, Huan Zhao 等 10 位作者
2026