#reinforcement learning
Oct 2026
From Euclid and Manhattan to angular metrics: a cosine heuristic Q-learning framework for maze navigation
İhsan Ömür Bucak
· The Journal of Supercomputin... · 0 citations