view article Article Introducing Decision Transformers on Hugging Face 🤗 edbeeching, ThomasSimonini • Mar 28, 2022 • 11
eclatt/rl_course_vizdoom_health_gathering_supreme Reinforcement Learning • Updated about 5 hours ago
view article Article Illustrating Reinforcement Learning from Human Feedback (RLHF) +2 natolambert, LouisCastricato, lvwerra, Dahoas • Dec 9, 2022 • 426
eclatt/rl_course_vizdoom_health_gathering_supreme Reinforcement Learning • Updated about 5 hours ago