#reinforcement learning
Sep 2026
A two-stage framework integrating group relative policy optimization with Tabu search for dynamic rescheduling in UAV testing
Zhibin Mao, Yan Gao, Qian Pu et al.
· Applied Intelligence · 0 citations