2301.00993v1.pdf
arxiv.org · 6,000 words · saved by 1 readers
N/A
PAPER Offline Evaluation for Reinforcement Learning-based Recommendation: A Critical Issue and Some Alternatives Romain Deffayet Thibaut Thonet arXiv:2301.00993v1 [cs.IR] 3 Jan 2023 Naver Labs Europe & University of Amsterdam Naver Labs Europe…
saved by
related reading
- 2109.10813.pdfarxiv.org
- Patterns for Building LLM-based Systems & Productseugeneyan.com
- Should I Use Offline RL or Imitation Learning? – The Berkeley Artificial Intelligence Research Blogbair.berkeley.edu
- f514cec81cb148559cf475e7426eed5e-Paper.pdfproceedings.neurips.cc
- [1904.06813] Personalized Re-ranking for Recommendationarxiv.org
- Rubrics as Rewards: Reinforcement Learning Beyond Verifiable Domainsarxiv.org
- [2201.11861] The Challenges of Exploration for Offline Reinforcement Learningar5iv.labs.arxiv.org
- Real-time machine learning: challenges and solutionshuyenchip.com
- [2406.09329] Is Value Learning Really the Main Bottleneck in Offline RL?ar5iv.labs.arxiv.org
- Enhancing Offline Reinforcement Learning with Curriculum Learning-Based Trajectory Valuationarxiv.org
- The bitter lesson of LLM evalsparsed.com
- [2204.05618] When Should We Prefer Offline Reinforcement Learning Over Behavioral Cloning?ar5iv.labs.arxiv.org