Zhilin, W., Lizhi, S., Weiping, D., Mingjing, W., Huiling, C. (2026). Dynamic programming with Q-learning based reinforcement learning optimization for multi unmanned aerial vehicles swarm path planning. Journal of King Saud University - Computer and Information Sciences. https://doi.org/10.1007/s44443-026-00676-9