flâneur

2307.08875

arxiv.org · 7,392 words · saved by 1 readers

N/A

Natural Actor-Critic for Robust Reinforcement Learning with Function Approximation Ruida Zhou∗ Tao Liu∗ Min Cheng Texas A&M University Texas A&M University Texas A&M University ruida@tamu.edu tliu@tamu.edu minrara0404@tamu.edu arXiv:2307.08875v2 [cs.LG] 10 Dec 2023…

related reading