Learning to Walk With Less: A Dyna-Style Approach to Quadrupedal Locomotion
arXiv:2509.06296v2 Announce Type: replace-cross Abstract: Traditional on-policy reinforcement learning (RL) controllers for quadrupedal locomotion often suffer from low data efficiency, requiring millions of interactions with simulated…