Preprint
Aug 2026
G2D: Generative-to-Discriminative Collaborative Inference for Zero-Shot Image Classification
G2D is proposed, a training-free framework that uses a generative VLM to verify CLIP-retrieved candidates against the image and transfers to DCLIP, WaffleCLIP, and CuPL, supporting a practical interface between discriminative proposal and generative visual reasoning.
Zehua Hao, Fang Liu, Qinliang Wang et al.
· 0 citations