arxiveess.SP2026-07-10
Fused Constrained Policy Reuse Optimization for Wireless Resource Allocation
An Liu, Zheyuan Zhou, Kexuan Wang
Deep reinforcement learning (DRL) has been widely adopted for wireless resource allocation due to its model-free adaptability. However, online exploration is costly, as randomly initialized policies may violate long-term constraints before sufficient data are collected. Future wi…