We examine the problem of regret minimization when the learner is involved in a continuous game with other optimizing agents: in this case, if all players follow a no-regret algorithm, it is possible to achieve significantly lower regret relative to fully adversarial environments. We study this problem in the context of variationally stable games (a class of continuous games which includes all convex-concave and monotone games), and when the players only have access to noisy estimates of their individual payoff gradients. If the noise is additive, the game-theoretic and purely adversarial settings enjoy similar regret guarantees; however, if the noise is multiplicative, we show that the learners can, in fact, achieve constant regret. We achieve this faster rate via an optimistic gradient scheme with learning rate separation -- that is, the method's extrapolation and update steps are tuned to different schedules, depending on the noise profile. Subsequently, to eliminate the need for delicate hyperparameter tuning, we propose a fully adaptive method that attains nearly the same guarantees as its non-adapted counterpart, while operating without knowledge of either the game or of the noise profile.


翻译:我们研究了当学习者涉及到与其他优化代理人进行连续游戏时的遗憾最小化问题:在这种情况下,如果所有玩家都遵循无悔算法,则可以相对于完全对抗性环境实现显著降低的遗憾。我们在变分稳定游戏的上下文中研究了这个问题(一类包括所有凸凹和单调博弈的连续博弈),当玩家只能访问其个人收益梯度的嘈杂估计时。如果噪声是加性的,则博弈理论和完全对抗性环境具有类似的遗憾保证;然而,如果噪声是乘性的,则我们表明,学习者实际上可以实现恒定的遗憾。我们通过一个乐观的梯度方案以学习速率分离的方式实现更快的速率,即该方法的外推和更新步骤根据噪声配置文件的不同安排不同的时间表。随后,为了消除对微妙的超参数调整的需求,我们提出了一个完全自适应的方法,它实现了几乎与非自适应对应物相同的保证,同时在没有关于游戏或噪声配置文件的知识的情况下运行。

0
下载
关闭预览

相关内容

《分布式多智能体深度强化学习:竞争性博弈》最新论文
专知会员服务
124+阅读 · 2023年3月16日
【ICML2022】可达性约束强化学习
专知会员服务
22+阅读 · 2022年5月18日
【NeurIPS 2021】设置多智能体策略梯度的方差
专知会员服务
20+阅读 · 2021年10月24日
ECCV 2022 | AirDet: 无需微调的小样本目标检测方法
极市平台
0+阅读 · 2022年7月30日
对抗训练理论分析:自适应步长快速对抗训练
PaperWeekly
2+阅读 · 2022年6月23日
RL解决'LunarLander-v2' (SOTA)
CreateAMind
62+阅读 · 2019年9月27日
TensorFlow 2.0深度强化学习指南
云栖社区
18+阅读 · 2019年2月1日
机器学习常见模式LogSumExp解密
论智
21+阅读 · 2018年10月30日
如何找到最优学习率?
AI研习社
11+阅读 · 2017年11月29日
国家自然科学基金
0+阅读 · 2015年12月31日
国家自然科学基金
0+阅读 · 2015年12月31日
国家自然科学基金
0+阅读 · 2013年12月31日
国家自然科学基金
0+阅读 · 2012年12月31日
国家自然科学基金
0+阅读 · 2012年12月31日
国家自然科学基金
0+阅读 · 2012年12月31日
国家自然科学基金
0+阅读 · 2012年12月31日
国家自然科学基金
1+阅读 · 2012年12月31日
国家自然科学基金
0+阅读 · 2011年12月31日
国家自然科学基金
0+阅读 · 2009年12月31日
VIP会员
相关资讯
相关基金
国家自然科学基金
0+阅读 · 2015年12月31日
国家自然科学基金
0+阅读 · 2015年12月31日
国家自然科学基金
0+阅读 · 2013年12月31日
国家自然科学基金
0+阅读 · 2012年12月31日
国家自然科学基金
0+阅读 · 2012年12月31日
国家自然科学基金
0+阅读 · 2012年12月31日
国家自然科学基金
0+阅读 · 2012年12月31日
国家自然科学基金
1+阅读 · 2012年12月31日
国家自然科学基金
0+阅读 · 2011年12月31日
国家自然科学基金
0+阅读 · 2009年12月31日
Top
微信扫码咨询专知VIP会员