2208.05129
arxiv.org · 8,110 words · saved by 1 readers
N/A
Robust Reinforcement Learning using Offline Data Kishan Panaganti1 , Zaiyan Xu1 , Dileep Kalathil1 , Mohammad Ghavamzadeh2 1 Texas A&M University, 2 Google Research. Emails: {kpb, zxu43 ,dileep.kalathil}@tamu.edu, ghavamza@google.com arXiv:2208.05129v2 [cs.LG] 18 Oct 2022…
related reading
- 2307.08875arxiv.org
- 2109.10813.pdfarxiv.org
- A (Long) Peek into Reinforcement Learning | Lil'Loglilianweng.github.io
- Exploration for the Efficient Deployment of Reinforcement Learning Agentsopenreview.net
- [2005.01643] Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problemsar5iv.labs.arxiv.org
- Value estimation with finite datamcgill.scholaris.ca
- [2103.06326] S4RL: Surprisingly Simple Self-Supervision for Offline Reinforcement Learningarxiv.org
- Part 2: Kinds of RL Algorithms - Spinning Up documentationspinningup.openai.com
- State of Robot Learning, December 2025vedder.io
- Should I Use Offline RL or Imitation Learning? – The Berkeley Artificial Intelligence Research Blogbair.berkeley.edu
- [2307.04354] Policy Finetuning in Reinforcement Learning via Design of Experiments using Offline Dataar5iv.labs.arxiv.org
- [2007.08202] Provably Good Batch Reinforcement Learning Without Great Explorationar5iv.labs.arxiv.org