TIER: Trajectory-Invariant Explanation Regularization for Membership Privacy
A Trajectory-Invariant Explanation Regularization (TIER) defense that penalizes erratic fluctuations in confidence drops simulated through gradient-guided perturbations and simultaneously minimizes the distributional shifts via KL-divergence, and targets explanation robustness by enforcing self-consistency through KL-divergence.