flâneur

2106.01345

arxiv.org · 7,715 words · saved by 1 readers

N/A

Decision Transformer: Reinforcement Learning via Sequence Modeling Lili Chen∗,1 , Kevin Lu∗,1 , Aravind Rajeswaran2 , Kimin Lee1 , Aditya Grover2 , Michael Laskin1 , Pieter Abbeel1 , Aravind Srinivas†,1 , Igor Mordatch†,3 ∗ equal contribution † equal advising arXiv:2106.01345v2 [cs.LG] 24 Jun…

saved by

related reading