DOI:10.16652/j.issn.1004-373X.2026.11.028
摘 要: 针对动态环境下移动机器人难以实现高效、安全的避障导航问题, 文中提出一种融合策略正则化的双延迟确定性深度策略梯度避障算法(PRTD3)。该算法通过向TD3的策(试读)...