Preprint
Aug 2026
Mitigating Visual Degradation in MLLMs via Spatial-Spectral Visual Anchor Learning
The core of SSVAL is Visual Anchor Prompt Injection (VAPI), which introduces prompts that absorb rich knowledge from external VFMs during training, enabling them to serve as stable visual anchors that mitigate representation deviation during inference.
Qian-Long Yang, Bowen Ye, Xianda Guo et al.
· 0 citations