[1]
Y. Zhang and S. Widyarto, “Deep Q-network path planning with stratified sampling and prioritized replay ”, futech, vol. 5, no. 4, pp. 74–85, Jul. 2026.