flâneur

RL-VLM-F: Reinforcement Learning from Vision Language Foundation Model Feedback

arxiv.org · 6,853 words · saved by 1 readers

N/A

RL-VLM-F: Reinforcement Learning from Vision Language Foundation Model Feedback Yufei Wang * 1 Zhanyi Sun * 1 Jesse Zhang 2 Zhou Xian 1 Erdem Bıyık 2 David Held † 1 Zackory Erickson † 1 Abstract as reward engineering, demands considerable human effort and trial-and-error…

saved by

related reading