Preprint
Aug 2026
Q-based Variational Inverse Reinforcement Learning
Q-based Variational IRL (QVIRL), a novel Bayesian IRL method that recovers a posterior distribution over rewards from expert demonstrations via primarily learning a variational distribution over optimal Q-values, is introduced.
Ondrej Bajgar, Peter Tisnikar, Alessandro Abate et al.
· 0 citations