arxivcs.AIcs.HCcs.LG2026-07-08
Feedback Manipulation Regularization: Enabling Offline Agent Alignment for Imitation Learning
Reinforcement learning (RL) research has increasingly shifted focus towards alignment, ensuring agents learn behaviors adhering to human values. While human demonstrations and feedback have proven crucial for alignment, existing approaches predominantly combine these signals usin…