2109.10813.pdf
arxiv.org · 7,071 words · saved by 1 readers
N/A
A Workflow for Offline Model-Free Robotic Reinforcement Learning Aviral Kumar?,1 , Anikait Singh?,1 , Stephen Tian1 , Chelsea Finn2 , Sergey Levine1 1 UC Berkeley, 2 Stanford University (∗ Equal Contribution) aviralk@berkeley.edu, asap7772@berkeley.edu arXiv:2109.10813v2 [cs.LG] 23 Sep 2021…
saved by
related reading
- Algorithms — Ray 2.55.1docs.ray.io
- [2103.06326] S4RL: Surprisingly Simple Self-Supervision for Offline Reinforcement Learningarxiv.org
- Should I Use Offline RL or Imitation Learning? – The Berkeley Artificial Intelligence Research Blogbair.berkeley.edu
- State of Robot Learning, December 2025vedder.io
- Precise Manipulation with Efficient Online RLpi.website
- pistar06.pdfpi.website
- Q-learning is not yet scalableseohong.me
- [2005.01643] Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problemsar5iv.labs.arxiv.org
- 2208.05129arxiv.org
- [2204.05618] When Should We Prefer Offline Reinforcement Learning Over Behavioral Cloning?ar5iv.labs.arxiv.org
- Exploration for the Efficient Deployment of Reinforcement Learning Agentsopenreview.net
- [2406.09329] Is Value Learning Really the Main Bottleneck in Offline RL?ar5iv.labs.arxiv.org