2307.08875
arxiv.org · 7,392 words · saved by 1 readers
N/A
Natural Actor-Critic for Robust Reinforcement Learning with Function Approximation Ruida Zhou∗ Tao Liu∗ Min Cheng Texas A&M University Texas A&M University Texas A&M University ruida@tamu.edu tliu@tamu.edu minrara0404@tamu.edu arXiv:2307.08875v2 [cs.LG] 10 Dec 2023…
related reading
- 2208.05129arxiv.org
- A (Long) Peek into Reinforcement Learning | Lil'Loglilianweng.github.io
- State of Robot Learning, December 2025vedder.io
- [1805.12114] Deep Reinforcement Learning in a Handful of Trials using Probabilistic Dynamics Modelsar5iv.labs.arxiv.org
- Reinforcement Learning in Newcomblike Problemsproceedings.neurips.cc
- Exploration for the Efficient Deployment of Reinforcement Learning Agentsopenreview.net
- [2506.22401] Exploration from a Primal-Dual Lens: Value-Incentivized Actor-Critic Methods for Sample-Efficient Online RLarxiv.org
- 2109.10813.pdfarxiv.org
- [1707.06347] Proximal Policy Optimization Algorithmsarxiv.org
- Part 2: Kinds of RL Algorithms - Spinning Up documentationspinningup.openai.com
- pistar06.pdfpi.website
- [2007.08202] Provably Good Batch Reinforcement Learning Without Great Explorationar5iv.labs.arxiv.org