arxivcs.LGcs.AI2026-07-22
Adaptive Multi-Horizon Reinforcement Learning
Manoosh Samiei, Doina Precup, Paul Masset
Effective decision-making in complex and changing environments requires balancing short-term and long-term consequences. In reinforcement learning (RL), this trade-off is typically controlled through a fixed discount factor, which imposes a single exponentially discounted tempora…