Preprint
Jul 2026
What Predicts Correctness in Text-to-SQL? A Selective-Prediction Study
This work studies which signals predict correctness on hard multi-table text-to-SQL, using AUROC to measure how well each ranks correct queries above incorrect ones, and asks whether a verifier can be trained.
Robert J. Richardson
· 0 citations