强化学习作为机器学习的一种范式,因其强大的策略试错学习能力,受到关注 .随着深度学习的融入,强 化学习方法在许多复杂的控制任务中取得了巨大成功.然而,深度强化学习网络作为黑盒模型,其缺乏可解释性所 带来的不安全、不可控及难理解等问题限制了强化学习在诸如自动驾驶、智慧医疗等关键领域中的发展.为了解决 这一问题,科研人员开展了对强化学习可解释性的研究 .然而,这些研究开展相对较晚,且缺少针对多智能体强化 学习可解释性方法的系统性总结,同时,可解释性的定义存在人为主观性,导致系统性面向强化学习过程的可解释 性研究较为困难.本文对当前强化学习的可解释性研究工作进行了全面的整理与总结.首先,对强化学习的可解释 性进行定义并总结了相关评估方法.随后,基于马尔可夫决策过程,划分了行为级解释、特征级解释、奖励级解释及 策略级解释四个类别 .此外,在每个类别中,分析了单智能体及多智能体的策略解释方法,并特别关注可解释性研 究中的人为因素,描述了人机交互式的解释方法.最后,对当前强化学习可解释性研究面临的挑战以及未来的研究 方向进行总结与展望.

成为VIP会员查看完整内容
42

相关内容

强化学习(RL)是机器学习的一个领域,与软件代理应如何在环境中采取行动以最大化累积奖励的概念有关。除了监督学习和非监督学习外,强化学习是三种基本的机器学习范式之一。 强化学习与监督学习的不同之处在于,不需要呈现带标签的输入/输出对,也不需要显式纠正次优动作。相反,重点是在探索(未知领域)和利用(当前知识)之间找到平衡。 该环境通常以马尔可夫决策过程(MDP)的形式陈述,因为针对这种情况的许多强化学习算法都使用动态编程技术。经典动态规划方法和强化学习算法之间的主要区别在于,后者不假设MDP的确切数学模型,并且针对无法采用精确方法的大型MDP。

知识荟萃

精品入门和进阶教程、论文和代码整理等

更多

查看相关VIP内容、论文、资讯等
基于表征学习的离线强化学习方法研究综述
专知会员服务
28+阅读 · 2024年7月2日
脉冲强化学习算法研究综述
专知会员服务
44+阅读 · 2023年10月6日
计算机视觉中的终身学习综述
专知会员服务
64+阅读 · 2023年7月13日
持续学习:研究综述
专知会员服务
80+阅读 · 2023年1月30日
基于通信的多智能体强化学习进展综述
专知会员服务
110+阅读 · 2022年11月12日
结合进化算法的深度强化学习方法研究综述
专知会员服务
79+阅读 · 2022年7月16日
基于无标签视频数据的深度预测学习方法综述
专知会员服务
35+阅读 · 2022年5月16日
强化学习可解释性基础问题探索和方法综述
专知会员服务
91+阅读 · 2022年1月16日
专知会员服务
92+阅读 · 2021年8月29日
机器学习模型安全与隐私研究综述
专知会员服务
112+阅读 · 2020年11月12日
「基于通信的多智能体强化学习」 进展综述
基于模型的强化学习综述
专知
33+阅读 · 2022年7月13日
综述| 当图神经网络遇上强化学习
图与推荐
29+阅读 · 2022年7月1日
联邦学习安全与隐私保护研究综述
专知
12+阅读 · 2020年8月7日
多模态深度学习综述,18页pdf
专知
48+阅读 · 2020年3月29日
基于逆强化学习的示教学习方法综述
计算机研究与发展
15+阅读 · 2019年2月25日
国家自然科学基金
41+阅读 · 2015年12月31日
国家自然科学基金
17+阅读 · 2015年12月31日
国家自然科学基金
4+阅读 · 2015年12月31日
国家自然科学基金
8+阅读 · 2015年12月31日
国家自然科学基金
5+阅读 · 2015年12月31日
国家自然科学基金
27+阅读 · 2015年12月31日
国家自然科学基金
12+阅读 · 2015年12月31日
国家自然科学基金
0+阅读 · 2014年12月31日
国家自然科学基金
1+阅读 · 2014年12月31日
国家自然科学基金
15+阅读 · 2013年12月31日
Arxiv
163+阅读 · 2023年4月20日
A Survey of Large Language Models
Arxiv
424+阅读 · 2023年3月31日
Arxiv
153+阅读 · 2023年3月24日
Arxiv
22+阅读 · 2023年3月17日
Arxiv
10+阅读 · 2020年11月26日
VIP会员
相关VIP内容
基于表征学习的离线强化学习方法研究综述
专知会员服务
28+阅读 · 2024年7月2日
脉冲强化学习算法研究综述
专知会员服务
44+阅读 · 2023年10月6日
计算机视觉中的终身学习综述
专知会员服务
64+阅读 · 2023年7月13日
持续学习:研究综述
专知会员服务
80+阅读 · 2023年1月30日
基于通信的多智能体强化学习进展综述
专知会员服务
110+阅读 · 2022年11月12日
结合进化算法的深度强化学习方法研究综述
专知会员服务
79+阅读 · 2022年7月16日
基于无标签视频数据的深度预测学习方法综述
专知会员服务
35+阅读 · 2022年5月16日
强化学习可解释性基础问题探索和方法综述
专知会员服务
91+阅读 · 2022年1月16日
专知会员服务
92+阅读 · 2021年8月29日
机器学习模型安全与隐私研究综述
专知会员服务
112+阅读 · 2020年11月12日
相关资讯
「基于通信的多智能体强化学习」 进展综述
基于模型的强化学习综述
专知
33+阅读 · 2022年7月13日
综述| 当图神经网络遇上强化学习
图与推荐
29+阅读 · 2022年7月1日
联邦学习安全与隐私保护研究综述
专知
12+阅读 · 2020年8月7日
多模态深度学习综述,18页pdf
专知
48+阅读 · 2020年3月29日
基于逆强化学习的示教学习方法综述
计算机研究与发展
15+阅读 · 2019年2月25日
相关基金
国家自然科学基金
41+阅读 · 2015年12月31日
国家自然科学基金
17+阅读 · 2015年12月31日
国家自然科学基金
4+阅读 · 2015年12月31日
国家自然科学基金
8+阅读 · 2015年12月31日
国家自然科学基金
5+阅读 · 2015年12月31日
国家自然科学基金
27+阅读 · 2015年12月31日
国家自然科学基金
12+阅读 · 2015年12月31日
国家自然科学基金
0+阅读 · 2014年12月31日
国家自然科学基金
1+阅读 · 2014年12月31日
国家自然科学基金
15+阅读 · 2013年12月31日
微信扫码咨询专知VIP会员