研究论文 面向行为进化的持续强化学习研究 围绕面向行为进化的持续强化学习方法展开研究:以 UUV 路径跟随为对象构建环境并改进 TD3,提出动态组合调制的持续强化学习方法,并在连续操作与路径跟随任务流上验证。 2026-08-07#持续强化学习 #特征调制 #TD3 #行为进化 #路径跟随