flâneur

2208.05129

arxiv.org · 8,110 words · saved by 1 readers

N/A

Robust Reinforcement Learning using Offline Data Kishan Panaganti1 , Zaiyan Xu1 , Dileep Kalathil1 , Mohammad Ghavamzadeh2 1 Texas A&M University, 2 Google Research. Emails: {kpb, zxu43 ,dileep.kalathil}@tamu.edu, ghavamza@google.com arXiv:2208.05129v2 [cs.LG] 18 Oct 2022…

related reading