国内刊号:51-1307/TP
国际刊号:1001-9081
发布日期:
作者:王昱, 赵明月, 周小琳
单位:沈阳航空航天大学 自动化学院,沈阳110136
关键词:养老机器人,多任务路径规划,引导学习,鲸鱼优化算法,强化学习
基金:国家自然科学基金资助项目(61906125);国家自然科学基金资助项目(62373261);辽宁省高校基本科研业务费专项资金资助项目(LJ232410143020);辽宁省高校基本科研业务费专项资金资助项目(LJ212410143047)
全球老龄化问题日益严峻,养老服务领域面临严重人力短缺挑战,亟需引入具有智能决策能力的机器人技术。针对养老院场景下辅助机器人在多任务机制中的自主路径规划问题,提出一种改进的非确定性策略SAC(Soft Actor-Critic)强化学习决策算法。首先,提出基于虚拟圆的障碍物轮廓重构法,在降低环境建模难度的同时提升雷达探测效率;其次,针对强化学习算法在求解连续状态空间内复杂任务时从零进行策略寻优的困难,将鲸鱼优化算法(WOA)与SAC算法结合得到WOA-SAC算法,通过构建辅助监督机制为学习过程提供方向引导,提升决策能力的同时显著提升收敛速度;最后,基于老人的日常需求规划任务,在包含静态障碍、动态障碍的固定任务和突发性随机任务环境中完成模型训练。仿真实验结果表明,与传统SAC算法相比,WOA-SAC算法的平均路径长度缩短了10.42%,成功率提升了6.66%,平均步长减小了29.63%。可见,WOA-SAC算法能够显著提升SAC算法的学习效率和决策能力,并解决多任务机制中的自主路径规划问题。
来源:2025年第10期
《计算机应用》期刊编辑部