学习 分类论文(27,846)
清除筛选 ✕基于评论引导的样本高效扩散强化学习
Shutong Ding, Zejia Zhong, Zhongyi Wang 等 7 位作者
2026
BuilDyn:激励驱动数据生成用于建筑热动力学建模与控制
Felix Koch, Thomas Krug, Fabian Raisch 等 5 位作者
2026
基于在线增量学习的定制腕带关节角度估计
Shuo Wang, Xiaobin Chen, Xiaoming Tao
2026
基于动量的低排放交通信号控制奖励设计
Chinmay Mundane, Amith Manoharan, Arun Singh
2026
访问集至关重要:为可扩展的权重空间模型合并预算专家读取
Yuanyi Wang, Yanggan Gu, Su Lu 等 8 位作者
2026
MiraBench:评估机器人世界模型中动作条件可靠性
Tianzhuo Yang, Zihan Shen, Zirui Mi 等 10 位作者
2026
主体感对学习结构化规律的影响:一项人工语法学习研究
Haxhi R, Woźniak M, Wykowska A
Psychological research · 2026
CA-AC-MPC:基于CUDA加速的演员-评论家模型预测控制
Antoonio Buo, Vittorio Cammarota, Michele Avagnale 等 6 位作者
2026
线弧增材制造焊道几何控制中的学习与自适应
Chen-Lung Lu, John Wen
2026
基于局部可观性和移动时域估计的前馈神经网络训练
Yi Yang, Victor G. Lopez, Matthias A. Müller
2026
Gamma-World: 超越双玩家的生成式多智能体世界建模
Fangfu Liu, Kai He, Tianchang Shen 等 10 位作者
2026
SARAD:基于大语言模型的安全感知混合强化学习与碰撞预测自动驾驶方法
Kangyu Wu, Peng Cui, Guoxi Chen 等 4 位作者
2026
面向随机丢包非线性系统的自适应无模型最优控制:演员-辨识器-评论家强化学习方法
Kianoush Aqabakee, Kosar Behnia, Amirhossein Heydarian Ardakani 等 5 位作者
2026
基于多目标贝叶斯优化的工业驱动器自主调试方法
David Petrovic, Gian Antonio Susto, Angelo Cenedese
2026
CLANE:基于事件相机在神经形态硬件上的连续动作学习
Elvin Hajizada, Michael Neumeier, Edward Paxon Frady 等 7 位作者
2026
基于强化学习驱动的模仿学习中师生表征对齐
Meraj Mammadov, Pedro Zuidberg Dos Martires, Johannes Andreas Stork
2026
通过保持连通性的区域提议网络加速机器人路径规划
Zhanzheng Ma, Cancan Zhao, Shuai Zhang 等 4 位作者
2026
ClothTransformer:用于可扩展布料模拟的统一潜空间变换器
Yu Zhang, Yidi Shao, Wenqi Ouyang 等 8 位作者
2026
HumanoidMimicGen:基于全身规划的移动操作数据生成
Kevin Lin, Ajay Mandlekar, Caelan Reed Garrett 等 10 位作者
2026
SCALE-COMM:用于多智能体强化学习通信的共享对比对齐潜在嵌入
Mahmoud Abouelyazid, Eman Hammad
2026
基于可表达流教师模型的对抗性双在线策略蒸馏
Zhenglin Wan, Jingxuan Wu, Xingrui Yu 等 8 位作者
2026
信任区域Q伴随匹配
Yonghoon Dong, Kyungmin Lee, Changyeon Kim 等 5 位作者
2026
概率递归意图切换模型
Wenyuan Sheng, Hao Zhu, Joschka Boedecker
2026
信任、几何与规则:面向不确定性下安全USV导航的可信度感知强化学习框架
Yuhang Zhang, Shuqi Chai, Yukang Zhang 等 8 位作者
2026