期刊文献+
共找到5篇文章
< 1 >
每页显示 20 50 100
面向参数化动作空间的多智能体中心化策略梯度分解及其应用 被引量:2
1
作者 田树聪 谢愈 +2 位作者 张远龙 周正春 高阳 《软件学报》 北大核心 2025年第2期590-607,共18页
近年来,多智能体强化学习方法凭借AlphaStar、AlphaDogFight、AlphaMosaic等成功案例展示出卓越的决策能力以及广泛的应用前景.在真实环境的多智能体决策系统中,其任务的决策空间往往是同时具有离散型动作变量和连续型动作变量的参数化... 近年来,多智能体强化学习方法凭借AlphaStar、AlphaDogFight、AlphaMosaic等成功案例展示出卓越的决策能力以及广泛的应用前景.在真实环境的多智能体决策系统中,其任务的决策空间往往是同时具有离散型动作变量和连续型动作变量的参数化动作空间.这类动作空间的复杂性结构使得传统单一针对离散型或连续型的多智能体强化学习算法不在适用,因此研究能用于参数化动作空间的多智能体强化学习算法具有重要的现实意义.提出一种面向参数化动作空间的多智能体中心化策略梯度分解算法,利用中心化策略梯度分解算法保证多智能体的有效协同,结合参数化深度确定性策略梯度算法中双头策略输出实现对参数化动作空间的有效耦合.通过在Hybrid Predator-Prey场景中不同参数设置下的实验结果表明该算法在经典的多智能体参数化动作空间协作任务上具有良好的性能.此外,在多巡航导弹协同突防场景中进行算法效能验证,实验结果表明该算法在多巡航导弹突防这类具有高动态、行为复杂化的协同任务中有效性和可行性. 展开更多
关键词 参数化动作空间 多智能体强化学习 中心化策略梯度分解 多巡航导弹突防
在线阅读 下载PDF
考虑尺寸链约束的枪械典型机构动作可靠性优化 被引量:4
2
作者 黄玲 张丽平 方峻 《兵工自动化》 2015年第9期35-39,共5页
针对机构在运动情况下会出现运动功能失效的问题,提出一种以尺寸链为约束的机构动作可靠性优化方法。以某型号冲锋枪的发射机构为例,通过对机构动作的分析,建立动力学仿真的参数化模型,同时采用蒙特卡罗随机抽样法得到运动仿真样本值,... 针对机构在运动情况下会出现运动功能失效的问题,提出一种以尺寸链为约束的机构动作可靠性优化方法。以某型号冲锋枪的发射机构为例,通过对机构动作的分析,建立动力学仿真的参数化模型,同时采用蒙特卡罗随机抽样法得到运动仿真样本值,在动力学仿真软件ADAMS中模拟仿真。根据模拟仿真试验,计算出正交试验表中每组参数所对应的动作可靠度,并通过对正交试验结果的优化,并综合考虑尺寸链约束的要求,优化设计出更加有效的参数。仿真结果表明:优化后的动作可靠度为0.998,该方法既满足动作可靠性要求,又满足尺寸链要求的参数值,使机构动作可靠度得到了提高。 展开更多
关键词 动作可靠性 参数化 尺寸链 优化设计
在线阅读 下载PDF
基于参数化动作描述的虚拟维修过程仿真 被引量:6
3
作者 王丰产 孙有朝 《图学学报》 CSCD 北大核心 2013年第2期119-124,共6页
在虚拟人执行维修动作的过程中,参数化动作描述起到了虚拟人动作和自然语言维修指令之间的桥梁作用,是为了规范虚拟人执行维修任务动作。论文在参数化动作描述和智能虚拟维修训练环境的基础上,构建了维修任务分解模型和动作库;以参数化... 在虚拟人执行维修动作的过程中,参数化动作描述起到了虚拟人动作和自然语言维修指令之间的桥梁作用,是为了规范虚拟人执行维修任务动作。论文在参数化动作描述和智能虚拟维修训练环境的基础上,构建了维修任务分解模型和动作库;以参数化动作描述为基础,提出了用于3D虚拟人维修动作仿真的虚拟维修实时执行层次结构。最后,通过某型起落架维修任务对参数化动作和仿真架构可行性进行验证,结果表明,基于参数化动作描述描述的动作库可以很方便的进行维修过程仿真。 展开更多
关键词 虚拟维修 虚拟现实 动作库 维修过程仿真 参数化动作描述
在线阅读 下载PDF
维修技术指令的验证仿真
4
作者 朱兴动 黄葵 王正 《计算机仿真》 CSCD 2004年第6期88-89,95,共3页
该文研究了用人体结构模型验证飞机维修程序的可行性 ,介绍了使用参数化行为描述和多重模型的仿真方法。参数化行为描述是以动画人体结构模型 (HFMs) ,通过CAD技术模拟人体各个部位的维修动作 ,它支持自然语言的理解。多重模型是指仿真... 该文研究了用人体结构模型验证飞机维修程序的可行性 ,介绍了使用参数化行为描述和多重模型的仿真方法。参数化行为描述是以动画人体结构模型 (HFMs) ,通过CAD技术模拟人体各个部位的维修动作 ,它支持自然语言的理解。多重模型是指仿真对象具有几何外观和非几何领域的行为属性。将编写的维修技术指令分解为简单的行为 ,进行程序的仿真。在统一的界面下 ,封装多重模型的同步机制。通过维修程序与相应行为的比较 ,可以方便地判断程序是否安全、符合逻辑 。 展开更多
关键词 维修技术指令 验证仿真 人体结构模型 飞机维修 CAD技术 计算机仿真 多重模型 参数化行为描述
在线阅读 下载PDF
基于改进Dueling DQN的无人机网络多域资源分配策略
5
作者 黄嘉伟 黎海涛 吕鑫 《中国电子科学研究院学报》 北大核心 2023年第7期646-651,共6页
针对无人机(Unmanned Aerial Vehicle,UAV)网络节点间干扰导致通信质量降低问题,文中从空域与功率域出发,构建以最大化UAV系统频谱效率和能量效率为目标的波束成形与发射功率联合优化模型。针对该多域资源分配模型,提出参数化动作空间... 针对无人机(Unmanned Aerial Vehicle,UAV)网络节点间干扰导致通信质量降低问题,文中从空域与功率域出发,构建以最大化UAV系统频谱效率和能量效率为目标的波束成形与发射功率联合优化模型。针对该多域资源分配模型,提出参数化动作空间的加权Dueling DQN(P-wDDQN)学习算法,该算法适用于包含连续功率分配和离散波束成形的混合动作空间,且解决了Dueling DQN的目标Q值过低估计问题。利用所提P-wDDQN算法设计了联合波束与功率资源分配策略。仿真结果表明,所提多域资源分配策略提升了无人机网络的频谱效率和能量效率,且具有快速收敛的优势。 展开更多
关键词 UAV网络 深度强化学习 多域资源分配 参数化动作空间
在线阅读 下载PDF
上一页 1 下一页 到第
使用帮助 返回顶部