flâneur

c21f4ce780c5c9d774f79841b81fdc6d-Paper.pdf

proceedings.neurips.cc · 8,033 words · saved by 1 readers

N/A

Sample-Efficient Reinforcement Learning for Linearly-Parameterized MDPs with a Generative Model Bingyan Wang∗ Yuling Yan∗ Princeton University Princeton University bingyanw@princeton.edu yulingy@princeton.edu Jianqing Fan Princeton University jqfan@princeton.edu…

saved by

related reading