摘要: 多智能体强化学习作为博弈论、控制论和多智能体学习的交叉研究领域, 是多智能体系统研究中的前沿方向, 赋予了智能体在动态多维的复杂环境中通过交互和决策完成多样化任务的能力. 多智能体强化学习正在向应用对象开放化、应用问题具身化、应用场景复杂化的方向发展, 并逐渐成为解决现实世界中博弈决策问题的最有效工具. 本文对基于多智能体强化学习的博弈进行了系统性综述. 首先, 介绍了多智能体强化学习的基本理论, 梳理了多智能体强化学习算法与基线测试环境的发展进程. 其次, 针对合作、对抗以及混合三种多智能体强化学习任务, 从提高智能体合作效率、提升智能体对抗能力的维度来介绍多智能体强化学习的最新进展, 并结合实际应用探讨了混合博弈的前沿研究方向. 最后, 对多智能体强化学习的应用前景和发展趋势进行了总结与展望. http://www.aas.net.cn/cn/article/doi/10.16383/j.aas.c240478

成为VIP会员查看完整内容
36

相关内容

面向多源自主导航的智能学习方法研究
专知会员服务
18+阅读 · 12月15日
面向研究问题的深度学习事件抽取综述
专知会员服务
20+阅读 · 12月9日
面向算法选择的元学习研究综述
专知会员服务
42+阅读 · 2023年2月11日
基于强化学习的知识图谱综述
专知会员服务
196+阅读 · 2022年8月20日
深度学习模型鲁棒性研究综述
专知会员服务
91+阅读 · 2022年1月23日
基于强化学习的推荐研究综述
专知会员服务
83+阅读 · 2021年10月21日
专知会员服务
34+阅读 · 2021年8月13日
专知会员服务
53+阅读 · 2021年7月30日
专知会员服务
121+阅读 · 2021年7月22日
多智能体深度强化学习的若干关键科学问题
专知会员服务
188+阅读 · 2020年5月24日
「基于通信的多智能体强化学习」 进展综述
基于模型的强化学习综述
专知
33+阅读 · 2022年7月13日
智能合约的形式化验证方法研究综述
专知
15+阅读 · 2021年5月8日
基于深度学习的数据融合方法研究综述
专知
31+阅读 · 2020年12月10日
时空序列预测方法综述
专知
21+阅读 · 2020年10月19日
事件知识图谱构建技术与应用综述
专知
23+阅读 · 2020年8月6日
深度学习可解释性研究进展
专知
19+阅读 · 2020年6月26日
基于逆强化学习的示教学习方法综述
计算机研究与发展
15+阅读 · 2019年2月25日
深度强化学习简介
专知
30+阅读 · 2018年12月3日
国家自然科学基金
23+阅读 · 2015年12月31日
国家自然科学基金
4+阅读 · 2015年12月31日
国家自然科学基金
10+阅读 · 2015年12月31日
国家自然科学基金
2+阅读 · 2015年12月31日
国家自然科学基金
1+阅读 · 2015年12月31日
国家自然科学基金
4+阅读 · 2015年12月31日
国家自然科学基金
12+阅读 · 2015年12月31日
国家自然科学基金
1+阅读 · 2015年12月31日
国家自然科学基金
22+阅读 · 2014年12月31日
国家自然科学基金
4+阅读 · 2014年12月31日
Arxiv
158+阅读 · 2023年4月20日
A Survey of Large Language Models
Arxiv
408+阅读 · 2023年3月31日
Arxiv
68+阅读 · 2023年3月26日
Arxiv
148+阅读 · 2023年3月24日
Arxiv
21+阅读 · 2023年3月17日
VIP会员
相关VIP内容
面向多源自主导航的智能学习方法研究
专知会员服务
18+阅读 · 12月15日
面向研究问题的深度学习事件抽取综述
专知会员服务
20+阅读 · 12月9日
面向算法选择的元学习研究综述
专知会员服务
42+阅读 · 2023年2月11日
基于强化学习的知识图谱综述
专知会员服务
196+阅读 · 2022年8月20日
深度学习模型鲁棒性研究综述
专知会员服务
91+阅读 · 2022年1月23日
基于强化学习的推荐研究综述
专知会员服务
83+阅读 · 2021年10月21日
专知会员服务
34+阅读 · 2021年8月13日
专知会员服务
53+阅读 · 2021年7月30日
专知会员服务
121+阅读 · 2021年7月22日
多智能体深度强化学习的若干关键科学问题
专知会员服务
188+阅读 · 2020年5月24日
相关资讯
「基于通信的多智能体强化学习」 进展综述
基于模型的强化学习综述
专知
33+阅读 · 2022年7月13日
智能合约的形式化验证方法研究综述
专知
15+阅读 · 2021年5月8日
基于深度学习的数据融合方法研究综述
专知
31+阅读 · 2020年12月10日
时空序列预测方法综述
专知
21+阅读 · 2020年10月19日
事件知识图谱构建技术与应用综述
专知
23+阅读 · 2020年8月6日
深度学习可解释性研究进展
专知
19+阅读 · 2020年6月26日
基于逆强化学习的示教学习方法综述
计算机研究与发展
15+阅读 · 2019年2月25日
深度强化学习简介
专知
30+阅读 · 2018年12月3日
相关基金
国家自然科学基金
23+阅读 · 2015年12月31日
国家自然科学基金
4+阅读 · 2015年12月31日
国家自然科学基金
10+阅读 · 2015年12月31日
国家自然科学基金
2+阅读 · 2015年12月31日
国家自然科学基金
1+阅读 · 2015年12月31日
国家自然科学基金
4+阅读 · 2015年12月31日
国家自然科学基金
12+阅读 · 2015年12月31日
国家自然科学基金
1+阅读 · 2015年12月31日
国家自然科学基金
22+阅读 · 2014年12月31日
国家自然科学基金
4+阅读 · 2014年12月31日
微信扫码咨询专知VIP会员