【NeurIPS2023】强化学习中的安全探索：一种通用化的公式和算法 - 专知VIP

会员服务 ·

19

NeurIPS 2023 · 强化学习 · 安全探索 ·

2023 年 10 月 6 日

【NeurIPS2023】强化学习中的安全探索：一种通用化的公式和算法

专知会员服务

专知，提供专业可信的知识分发服务，让认知协作更快更好！

在许多实际情境中，安全探索对于增强学习（RL）的实用性至关重要。在本文中，我们提出了一个通用安全探索（GSE）问题，作为常见安全探索问题的统一公式。接着，我们提出了一个安全探索的元算法MASE作为GSE问题的解决方案，该算法结合了一个无约束的RL算法和一个不确定性量化器，以保证在当前情节中的安全，同时在实际安全违规之前适当地惩罚不安全的探索，以防止它们在未来的情节中出现。MASE的优势在于，我们可以在保证有很高概率不会违反任何安全约束的情况下，优化策略。具体来说，我们提出了两种不同构造的不确定性量化器的MASE变体：一种基于带有安全和接近最优性理论保证的广义线性模型，另一种结合了高斯过程以确保安全性和深度RL算法以最大化奖励。最后，我们证明了我们提出的算法在格子世界和Safety Gym基准测试中比现有技术更优秀，即使在训练期间也不违反任何安全约束。

https://www.zhuanzhi.ai/paper/bfda323a5d9d59281497f4e599b516b8

成为VIP会员查看完整内容

34

相关内容

NeurIPS 2023

【CVPR2022】整合少样本学习的分类和分割

【CVPR2022】整合少样本学习的分类和分割

专知会员服务

28+阅读 · 2022年3月31日

【ICCV2021】残差注意力：一种简单但是有效的多标签图像识别方法

专知会员服务

17+阅读 · 2021年8月26日

【IJCAI2021】复杂知识库问答研究: 方法、挑战与对策

【IJCAI2021】复杂知识库问答研究: 方法、挑战与对策

专知会员服务

57+阅读 · 2021年5月27日

【CVPR2021】多实例主动学习目标检测

【CVPR2021】多实例主动学习目标检测

专知会员服务

43+阅读 · 2021年4月18日

【ICLR2021】通过多种自监督方式提升GAT中注意力

【ICLR2021】通过多种自监督方式提升GAT中注意力

专知会员服务

44+阅读 · 2021年2月27日

【AAAI2021】自监督对应学习的对比转换

【AAAI2021】自监督对应学习的对比转换

专知

12+阅读 · 2020年12月11日

【CVPR2020-北京大学】自适应间隔损失的提升小样本学习

【CVPR2020-北京大学】自适应间隔损失的提升小样本学习

专知

12+阅读 · 2020年6月9日

【Amazon】使用预训练Transformer模型进行数据增强

【Amazon】使用预训练Transformer模型进行数据增强

专知

12+阅读 · 2020年3月6日

【Google AI新论文】REALM:检索增强语言模型预训练，QA的SOTA提升4-16%准确性

【Google AI新论文】REALM:检索增强语言模型预训练，QA的SOTA提升4-16%准确性

专知

12+阅读 · 2020年2月12日

【深度学习基础】4. Recurrent Neural Networks

【深度学习基础】4. Recurrent Neural Networks

微信AI

16+阅读 · 2017年7月19日

基于自主学习的Ad hoc Agent序贯决策研究

国家自然科学基金

46+阅读 · 2015年12月31日

模糊认知集群优化的聚类算法

国家自然科学基金

8+阅读 · 2015年12月31日

面向大数据的安全迁移学习方法

国家自然科学基金

30+阅读 · 2015年12月31日

复杂多元数据的半参数统计推断

国家自然科学基金

5+阅读 · 2014年12月31日

相依重尾随机变量和的渐近性及其在更新风险模型中的应用

国家自然科学基金

0+阅读 · 2014年12月31日

Is ChatGPT a Good Recommender? A Preliminary Study

Arxiv

174+阅读 · 2023年4月20日

NeuralField-LDM: Scene Generation with Hierarchical Latent Diffusion Models

Arxiv

42+阅读 · 2023年4月19日

A Comprehensive Survey on Deep Graph Representation Learning

Arxiv

107+阅读 · 2023年4月11日

A Survey of Large Language Models

A Survey of Large Language Models

Arxiv

496+阅读 · 2023年3月31日

Nature Language Reasoning, A Survey

Arxiv

82+阅读 · 2023年3月26日

VIP会员

相关主题

相关VIP内容

【CVPR2022】整合少样本学习的分类和分割

【CVPR2022】整合少样本学习的分类和分割

专知会员服务

28+阅读 · 2022年3月31日

【ICCV2021】残差注意力：一种简单但是有效的多标签图像识别方法

专知会员服务

17+阅读 · 2021年8月26日

【IJCAI2021】复杂知识库问答研究: 方法、挑战与对策

【IJCAI2021】复杂知识库问答研究: 方法、挑战与对策

专知会员服务

57+阅读 · 2021年5月27日

【CVPR2021】多实例主动学习目标检测

【CVPR2021】多实例主动学习目标检测

专知会员服务

43+阅读 · 2021年4月18日

【ICLR2021】通过多种自监督方式提升GAT中注意力

【ICLR2021】通过多种自监督方式提升GAT中注意力

专知会员服务

44+阅读 · 2021年2月27日

热门VIP内容

开通专知VIP会员享更多权益服务

【斯坦福博士论文】数据、决策与过度依赖：构建可信人工智能的核心挑战

《多域时代中维持弹性军事训练：挑战与机遇》

【AAAI2026】专家数量何为最优？面向混合专家模型的语义专业化优化研究

自进化人工智能体的全面综述：连接基础模型与终身自主智能系统的新范式

相关资讯

【AAAI2021】自监督对应学习的对比转换

【AAAI2021】自监督对应学习的对比转换

专知

12+阅读 · 2020年12月11日

【CVPR2020-北京大学】自适应间隔损失的提升小样本学习

【CVPR2020-北京大学】自适应间隔损失的提升小样本学习

专知

12+阅读 · 2020年6月9日

【Amazon】使用预训练Transformer模型进行数据增强

【Amazon】使用预训练Transformer模型进行数据增强

专知

12+阅读 · 2020年3月6日

【Google AI新论文】REALM:检索增强语言模型预训练，QA的SOTA提升4-16%准确性

【Google AI新论文】REALM:检索增强语言模型预训练，QA的SOTA提升4-16%准确性

专知

12+阅读 · 2020年2月12日

【深度学习基础】4. Recurrent Neural Networks

【深度学习基础】4. Recurrent Neural Networks

微信AI

16+阅读 · 2017年7月19日

相关基金

基于自主学习的Ad hoc Agent序贯决策研究

国家自然科学基金

46+阅读 · 2015年12月31日

模糊认知集群优化的聚类算法

国家自然科学基金

8+阅读 · 2015年12月31日

面向大数据的安全迁移学习方法

国家自然科学基金

30+阅读 · 2015年12月31日

复杂多元数据的半参数统计推断

国家自然科学基金

5+阅读 · 2014年12月31日

相依重尾随机变量和的渐近性及其在更新风险模型中的应用

国家自然科学基金

0+阅读 · 2014年12月31日

相关论文

Is ChatGPT a Good Recommender? A Preliminary Study

Arxiv

174+阅读 · 2023年4月20日

NeuralField-LDM: Scene Generation with Hierarchical Latent Diffusion Models

Arxiv

42+阅读 · 2023年4月19日

A Comprehensive Survey on Deep Graph Representation Learning

Arxiv

107+阅读 · 2023年4月11日

A Survey of Large Language Models

A Survey of Large Language Models

Arxiv

496+阅读 · 2023年3月31日

Nature Language Reasoning, A Survey

Arxiv

82+阅读 · 2023年3月26日

微信扫码咨询专知VIP会员