arxivcs.ROcs.AI2026-06-29
Trust Your Instincts: Confidence-Driven Test-Time RL for Vision-Language-Action Models
Siyao Chen, Jiakang Yuan, Jiaxin Wang, Tao Chen
Reinforcement learning (RL) has become indispensable for pushing Vision-Language-Action Models (VLAs) beyond static imitation learning. However, existing RL methods typically require external environmental feedback, relying on predefined success signals to guide policy updates. I…