Skip to content
arXiv Robotics — research abstracts· John L. Zhou, Yuxuan Dong, Jonathan C. Kao·· 2 days agoEditorial score42

Goal-Conditioned Policy Learning Faces Horizon-Dependent Performance Degradation

An Informational Curse of Horizon in Goal-Conditioned Policy Learning

Summary

Goal relabeling horizon affects policy generalization. Longer horizons reduce performance in goal-conditioned BC policies, which RL mitigates. Jacobian distillation improves long-horizon performance.

Source: arXiv Robotics — research abstracts · Read original article ↗

Loading article text…

Source:arXiv Robotics — research abstracts · arxiv.org

Timezone · UTC

Article dates follow your selected timezone. Briefing editions use Hong Kong time (UTC+8).