Physical Sciences › Computer Science › Artificial Intelligence
Reinforcement Learning in Robotics
2797 artículos indexados
Este asunto y su jerarquía proceden de la clasificación OpenAlex, el catálogo abierto de la investigación científica mundial.
Volumen mensual — últimos 12 meses
Últimos artículos
- Efficient Fairness-Performance Pareto Front Computation
Mark Kozdoba, Binyamin Perets, Shie Mannor · 27 de octubre de 2025
- Interpret Policies in Deep Reinforcement Learning using SILVER with RL-Guided Labeling: A Model-level Approach to High-dimensional and Multi-action Environments
Yiyu Qian, Su Nguyen, Chao Chen, Qinyue Zhou, Liyuan Zhao · 27 de octubre de 2025
- Part I: Tricks or Traps? A Deep Dive into RL for LLM Reasoning
Zihe Liu, Jiashun Liu, Yancheng He, Weixun Wang, Jiaheng Liu, Ling Pan, Xinyu Hu, Shaopan Xiong, Ju Huang, Jian Hu, Shengyi Huang, Siran Yang, Jiamang Wang, Wenbo Su, Bo Zheng · 27 de octubre de 2025
- Risk-Averse Total-Reward Reinforcement Learning
Xihong Su, Jia Lin Hau, Gersi Doko, Kishan Panaganti, Marek Petrik · 27 de octubre de 2025
- A Smooth Sea Never Made a Skilled SAILOR: Robust Imitation via Learning to Search
Arnav Kumar Jain, Vibhakar Mohta, Subin Kim, Atiksh Bhardwaj, Juntao Ren, Yunhai Feng, Sanjiban Choudhury, Gokul Swamy · 27 de octubre de 2025
- Prior-Guided Diffusion Planning for Offline Reinforcement Learning
Donghyeon Ki, JunHyeok Oh, Seong-Woong Shim, Byung-Jun Lee · 27 de octubre de 2025
- Planning and Learning in Average Risk-aware MDPs
Weikai Wang, Erick Delage · 27 de octubre de 2025
- Unified token representations for sequential decision models
Zhuojing Tian, Yushu Chen · 27 de octubre de 2025
- Mixture-of-Minds: Multi-Agent Reinforcement Learning for Table Understanding
Yuhang Zhou, Mingrui Zhang, Ke Li, Mingyi Wang, Qiao Liu, Qifei Wang, Jiayi Liu, Fei Liu, Serena Li, Weiwei Li, Mingze Gao, Abhishek Kumar, Xiangjun Fan, Zhuokai Zhao, Lizhu Zhang · 27 de octubre de 2025
- Reinforcement Learning with Action Chunking
Qiyang Li, Zhiyuan Zhou, Sergey Levine · 27 de octubre de 2025
- ReDit: Reward Dithering for Improved LLM Policy Optimization
Chenxing Wei, Jiarui Yu, Ying Tiffany He, Hande Dong, Yao Shu, Fei Yu · 27 de octubre de 2025
- Mind the GAP! The Challenges of Scale in Pixel-based Deep Reinforcement Learning
Ghada Sokar, Pablo Samuel Castro · 27 de octubre de 2025
- Model Selection for Off-policy Evaluation: New Algorithms and Experimental Protocol
Pai Liu, Lingfeng Zhao, Shivangi Agarwal, Jinghan Liu, Audrey Huang, Philip Amortila, Nan Jiang · 27 de octubre de 2025
- HypRL: Reinforcement Learning of Control Policies for Hyperproperties
Tzu-Han Hsu, Arshia Rafieioskouei, Borzoo Bonakdarpour · 27 de octubre de 2025
- DreamerV3-XP: Optimizing exploration through uncertainty estimation
Lukas Bierling, Davide Pasero, Jan-Henrik Bertrand, Kiki Van Gerwen · 27 de octubre de 2025
- Generalizable Hierarchical Skill Learning via Object-Centric Representation
Haibo Zhao, Yu Qi, Boce Hu, Yizhe Zhu, Ziyan Chen, Heng Tian, Xupeng Zhu, Owen Howell, Haojie Huang, Robin Walters, Dian Wang, Robert Platt · 27 de octubre de 2025
- ESCORT: Efficient Stein-variational and Sliced Consistency-Optimized Temporal Belief Representation for POMDPs
Yunuo Zhang, Baiting Luo, Ayan Mukhopadhyay, Gabor Karsai, Abhishek Dubey · 27 de octubre de 2025
- Self-Rewarding PPO: Aligning Large Language Models with Demonstrations Only
Qingru Zhang, Liang Qiu, Ilgee Hong, Zhenghao Xu, Tianyi Liu, Shiyang Li, Rongzhi Zhang, Zheng Li, Lihong Li, Bing Yin, Chao Zhang, Jianshu Chen, Haoming Jiang, Tuo Zhao · 27 de octubre de 2025
- On the Sample Complexity of Differentially Private Policy Optimization
Yi He, Xingyu Zhou · 27 de octubre de 2025
- Confounding Robust Deep Reinforcement Learning: A Causal Approach
Mingxuan Li, Junzhe Zhang, Elias Bareinboim · 27 de octubre de 2025
