arxivcs.CRcs.AI2026-07-03
TIER: Trajectory-Invariant Explanation Regularization for Membership Privacy
Varun Sharma, Kar Wai Fok, Vrizlynn L. L. Thing
Explainability is central to building trustworthy AI, yet explanation interfaces can inadvertently provide adversaries with an expanded privacy-related attack surfaces. Recent studies show that advanced membership-inference attacks succeed by exploiting confidence-drop trajectori…