具有约束的在线凸优化的通用动态遗憾与约束违反界 (Universal Dynamic Regret and Constraint Violation Bounds for Constrained Online Convex Optimization) - 专知论文

会员服务 ·

0

约束 · 在线 · 在线凸优化 · 算法 · 最优 ·

Universal Dynamic Regret and Constraint Violation Bounds for Constrained Online Convex Optimization

翻译：具有约束的在线凸优化的通用动态遗憾与约束违反界

Subhamon Supantha,Abhishek Sinha

from arxiv, To appear in the 37th International Conference on Algorithmic Learning Theory (ALT 2026)

We consider a generalization of the celebrated Online Convex Optimization (OCO) framework with adversarial online constraints. In this problem, an online learner interacts with an adversary sequentially over multiple rounds. At the beginning of each round, the learner chooses an action from a convex decision set. After that, the adversary reveals a convex cost function and a convex constraint function. The goal of the learner is to minimize the cumulative cost while satisfying the constraints as tightly as possible. We present two efficient algorithms with simple modular structures that give universal dynamic regret and cumulative constraint violation bounds, improving upon state-of-the-art results. While the first algorithm, which achieves the optimal regret bound, involves projection onto the constraint sets, the second algorithm is projection-free and achieves better violation bounds in rapidly varying environments. Our results hold in the most general case when both the cost and constraint functions are chosen arbitrarily, and the constraint functions need not contain any fixed common feasible point. We establish these results by introducing a general framework that reduces the constrained learning problem to an instance of the standard OCO problem with specially constructed surrogate cost functions.

翻译：我们考虑对经典的在线凸优化框架进行推广，引入对抗性在线约束。在此问题中，在线学习者在多轮中顺序地与对手进行交互。在每一轮开始时，学习者从一个凸决策集中选择一个动作。随后，对手揭示一个凸成本函数和一个凸约束函数。学习者的目标是在尽可能严格满足约束的同时最小化累积成本。我们提出了两种具有简单模块化结构的高效算法，它们给出了通用的动态遗憾和累积约束违反界，改进了现有最优结果。第一种算法实现了最优遗憾界，但涉及对约束集的投影；第二种算法是无投影的，在快速变化的环境中能获得更好的违反界。我们的结果在最一般情况下成立：成本函数和约束函数均可任意选择，且约束函数无需包含任何固定的公共可行点。我们通过引入一个通用框架来建立这些结果，该框架将约束学习问题约化为一个具有特殊构造的代理成本函数的标准在线凸优化问题实例。

0

相关内容

【新书】机器学习凸优化，379页pdf，Convex Optimization for Machine Learning

【新书】机器学习凸优化，379页pdf，Convex Optimization for Machine Learning

专知会员服务

149+阅读 · 2022年12月18日

非凸优化问题综述“从对称性到几何性”，罗切斯特大学等

非凸优化问题综述“从对称性到几何性”，罗切斯特大学等

专知会员服务

29+阅读 · 2022年7月17日

【经典书】凸优化全面介绍，Lectureson Convex Optimization，603页pdf

【经典书】凸优化全面介绍，Lectureson Convex Optimization，603页pdf

专知会员服务

74+阅读 · 2022年6月3日

【罗切斯特Yuqian Zhang等书】从对称到几何:可处理的非凸问题，34页pdf，From Symmetry to Geometry: Tractable Nonconvex Problems

【罗切斯特Yuqian Zhang等书】从对称到几何:可处理的非凸问题，34页pdf，From Symmetry to Geometry: Tractable Nonconvex Problems

专知会员服务

20+阅读 · 2022年3月4日

【CMU-Yuejie Chi等干货书】满足低秩矩阵分解的非凸优化综述，69页pdf，Nonconvex Optimization Meets Low-Rank Matrix Factorization: An Overview

【CMU-Yuejie Chi等干货书】满足低秩矩阵分解的非凸优化综述，69页pdf，Nonconvex Optimization Meets Low-Rank Matrix Factorization: An Overview

专知会员服务

33+阅读 · 2022年3月4日

【经典书】凸优化理论，MIT-Dimitri P. Bertsekas教授，257页pdf

【经典书】凸优化理论，MIT-Dimitri P. Bertsekas教授，257页pdf

专知会员服务

80+阅读 · 2021年8月28日

【斯坦福】凸优化圣经- Convex Optimization （附730pdf下载）

【斯坦福】凸优化圣经- Convex Optimization （附730pdf下载）

专知会员服务

231+阅读 · 2020年6月5日

波士顿大学Francesco《在线学习导论》2020书册，126页pdf详述在线学习最新进展

波士顿大学Francesco《在线学习导论》2020书册，126页pdf详述在线学习最新进展

专知会员服务

61+阅读 · 2020年5月13日

普林斯顿大学经典书《在线凸优化导论》，178页pdf

普林斯顿大学经典书《在线凸优化导论》，178页pdf

专知会员服务

187+阅读 · 2020年2月3日

【NeurIPS 2019|经典论文奖】正则随机学习和在线优化的双重平均法（Dual Averaging Method for Regularized Stochastic Learning and Online Optimization），微软研究院Lin Xiao

【NeurIPS 2019|经典论文奖】正则随机学习和在线优化的双重平均法（Dual Averaging Method for Regularized Stochastic Learning and Online Optimization），微软研究院Lin Xiao

专知会员服务

17+阅读 · 2019年12月9日

【佐治亚理工博士论文】基于策略智能体和有限反馈的序列决策，211页pdf

【佐治亚理工博士论文】基于策略智能体和有限反馈的序列决策，211页pdf

专知

38+阅读 · 2023年4月13日

【干货书】凸随机优化，320页pdf

【干货书】凸随机优化，320页pdf

专知

12+阅读 · 2022年9月16日

【干货书】机器学习线性代数与优化，507页pdf

【干货书】机器学习线性代数与优化，507页pdf

专知

23+阅读 · 2022年7月28日

机器学习必读新书-《凸优化算法原理详解》，334页pdf

机器学习必读新书-《凸优化算法原理详解》，334页pdf

专知

10+阅读 · 2022年1月4日

【干货书-斯坦福】最优化算法，521页pdf，《Algorithms for Optimization》MIT出版社

【干货书-斯坦福】最优化算法，521页pdf，《Algorithms for Optimization》MIT出版社

专知

58+阅读 · 2020年7月2日

中山大学发布最新《图对抗机器学习》2020综述论文，带你全面了解40+种攻防对抗学习方法

中山大学发布最新《图对抗机器学习》2020综述论文，带你全面了解40+种攻防对抗学习方法

专知

15+阅读 · 2020年3月13日

博客 | 机器学习中的数学基础（凸优化）

博客 | 机器学习中的数学基础（凸优化）

AI研习社

14+阅读 · 2018年12月16日

【论文推荐】最新七篇强化学习相关论文—逻辑约束、综述、多任务深度强化学习、参数服务器、事件抽取、分层强化学习、过拟合研究

【论文推荐】最新七篇强化学习相关论文—逻辑约束、综述、多任务深度强化学习、参数服务器、事件抽取、分层强化学习、过拟合研究

专知

25+阅读 · 2018年4月29日

【论文推荐】最新六篇强化学习相关论文—Sublinear、机器阅读理解、加速强化学习、对抗性奖励学习、人机交互

【论文推荐】最新六篇强化学习相关论文—Sublinear、机器阅读理解、加速强化学习、对抗性奖励学习、人机交互

专知

17+阅读 · 2018年4月28日

【学界】极端图像压缩的生成对抗网络，可生成低码率的高质量图像

【学界】极端图像压缩的生成对抗网络，可生成低码率的高质量图像

GAN生成式对抗网络

10+阅读 · 2018年4月25日

面向动态演化的网构软件失效机理与测评方法

国家自然科学基金

1+阅读 · 2015年12月31日

基于多目标优化的约束模式挖掘方法研究

国家自然科学基金

1+阅读 · 2015年12月31日

线性互补约束二次规划问题的一个全局算法研究

国家自然科学基金

0+阅读 · 2015年12月31日

非凸稀疏优化的恢复条件与低复杂度算法的研究

国家自然科学基金

1+阅读 · 2015年12月31日

非光滑非凸优化问题的交替线性化算法及其应用

国家自然科学基金

6+阅读 · 2015年12月31日

演化优化的自适应约束处理机理及在生化过程中的应用

国家自然科学基金

0+阅读 · 2015年12月31日

无限闭凸集族凸可行性问题中投影算法的线性收敛

国家自然科学基金

0+阅读 · 2015年12月31日

非凸二次约束优化问题的全局算法研究及其在信号处理中的应用

国家自然科学基金

1+阅读 · 2014年12月31日

关于二阶锥互补约束数学规划问题的约束规范和算法研究

国家自然科学基金

0+阅读 · 2014年12月31日

非线性约束全局优化的新方法研究

国家自然科学基金

1+阅读 · 2014年12月31日

Constrained Group Relative Policy Optimization

Arxiv

0+阅读 · 2月5日

Improved Dimension Dependence for Bandit Convex Optimization with Gradient Variations

Arxiv

0+阅读 · 2月4日

Finite and Corruption-Robust Regret Bounds in Online Inverse Linear Optimization under M-Convex Action Sets

Arxiv

0+阅读 · 2月2日

CLASP: An online learning algorithm for Convex Losses And Squared Penalties

Arxiv

0+阅读 · 1月22日

Small Gradient Norm Regret for Online Convex Optimization

Arxiv

0+阅读 · 1月20日

Optimization Insights into Deep Diagonal Linear Networks

Arxiv

0+阅读 · 1月19日

Decentralized Online Convex Optimization with Unknown Feedback Delays

Arxiv

0+阅读 · 1月12日

Distributed Online Convex Optimization with Efficient Communication: Improved Algorithm and Lower bounds

Arxiv

0+阅读 · 1月8日

NC2C: Automated Convexification of Generic Non-Convex Optimization Problems

Arxiv

0+阅读 · 1月8日

Online Action-Stacking Improves Reinforcement Learning Performance for Air Traffic Control

Arxiv

0+阅读 · 1月7日

VIP会员

文章信息

相关主题

在线凸优化

相关VIP内容

【新书】机器学习凸优化，379页pdf，Convex Optimization for Machine Learning

【新书】机器学习凸优化，379页pdf，Convex Optimization for Machine Learning

专知会员服务

149+阅读 · 2022年12月18日

非凸优化问题综述“从对称性到几何性”，罗切斯特大学等

非凸优化问题综述“从对称性到几何性”，罗切斯特大学等

专知会员服务

29+阅读 · 2022年7月17日

【经典书】凸优化全面介绍，Lectureson Convex Optimization，603页pdf

【经典书】凸优化全面介绍，Lectureson Convex Optimization，603页pdf

专知会员服务

74+阅读 · 2022年6月3日

【罗切斯特Yuqian Zhang等书】从对称到几何:可处理的非凸问题，34页pdf，From Symmetry to Geometry: Tractable Nonconvex Problems

【罗切斯特Yuqian Zhang等书】从对称到几何:可处理的非凸问题，34页pdf，From Symmetry to Geometry: Tractable Nonconvex Problems

专知会员服务

20+阅读 · 2022年3月4日

【CMU-Yuejie Chi等干货书】满足低秩矩阵分解的非凸优化综述，69页pdf，Nonconvex Optimization Meets Low-Rank Matrix Factorization: An Overview

【CMU-Yuejie Chi等干货书】满足低秩矩阵分解的非凸优化综述，69页pdf，Nonconvex Optimization Meets Low-Rank Matrix Factorization: An Overview

专知会员服务

33+阅读 · 2022年3月4日

【经典书】凸优化理论，MIT-Dimitri P. Bertsekas教授，257页pdf

【经典书】凸优化理论，MIT-Dimitri P. Bertsekas教授，257页pdf

专知会员服务

80+阅读 · 2021年8月28日

【斯坦福】凸优化圣经- Convex Optimization （附730pdf下载）

【斯坦福】凸优化圣经- Convex Optimization （附730pdf下载）

专知会员服务

231+阅读 · 2020年6月5日

波士顿大学Francesco《在线学习导论》2020书册，126页pdf详述在线学习最新进展

波士顿大学Francesco《在线学习导论》2020书册，126页pdf详述在线学习最新进展

专知会员服务

61+阅读 · 2020年5月13日

普林斯顿大学经典书《在线凸优化导论》，178页pdf

普林斯顿大学经典书《在线凸优化导论》，178页pdf

专知会员服务

187+阅读 · 2020年2月3日

【NeurIPS 2019|经典论文奖】正则随机学习和在线优化的双重平均法（Dual Averaging Method for Regularized Stochastic Learning and Online Optimization），微软研究院Lin Xiao

【NeurIPS 2019|经典论文奖】正则随机学习和在线优化的双重平均法（Dual Averaging Method for Regularized Stochastic Learning and Online Optimization），微软研究院Lin Xiao

专知会员服务

17+阅读 · 2019年12月9日

热门VIP内容

开通专知VIP会员享更多权益服务

《无人机与战争：被忽视的环境影响及无人机保护潜力》

俄罗斯规划未来无人机驱动军队

《整合杀伤链：一个用于边缘目标验证与战术推理的零样本框架》最新资料

《人工智能、武器与影响力：前沿模型在模拟核危机中展现复杂推理》2026最新46页报告

相关资讯

【佐治亚理工博士论文】基于策略智能体和有限反馈的序列决策，211页pdf

【佐治亚理工博士论文】基于策略智能体和有限反馈的序列决策，211页pdf

专知

38+阅读 · 2023年4月13日

【干货书】凸随机优化，320页pdf

【干货书】凸随机优化，320页pdf

专知

12+阅读 · 2022年9月16日

【干货书】机器学习线性代数与优化，507页pdf

【干货书】机器学习线性代数与优化，507页pdf

专知

23+阅读 · 2022年7月28日

机器学习必读新书-《凸优化算法原理详解》，334页pdf

机器学习必读新书-《凸优化算法原理详解》，334页pdf

专知

10+阅读 · 2022年1月4日

【干货书-斯坦福】最优化算法，521页pdf，《Algorithms for Optimization》MIT出版社

【干货书-斯坦福】最优化算法，521页pdf，《Algorithms for Optimization》MIT出版社

专知

58+阅读 · 2020年7月2日

中山大学发布最新《图对抗机器学习》2020综述论文，带你全面了解40+种攻防对抗学习方法

中山大学发布最新《图对抗机器学习》2020综述论文，带你全面了解40+种攻防对抗学习方法

专知

15+阅读 · 2020年3月13日

博客 | 机器学习中的数学基础（凸优化）

博客 | 机器学习中的数学基础（凸优化）

AI研习社

14+阅读 · 2018年12月16日

【论文推荐】最新七篇强化学习相关论文—逻辑约束、综述、多任务深度强化学习、参数服务器、事件抽取、分层强化学习、过拟合研究

【论文推荐】最新七篇强化学习相关论文—逻辑约束、综述、多任务深度强化学习、参数服务器、事件抽取、分层强化学习、过拟合研究

专知

25+阅读 · 2018年4月29日

【论文推荐】最新六篇强化学习相关论文—Sublinear、机器阅读理解、加速强化学习、对抗性奖励学习、人机交互

【论文推荐】最新六篇强化学习相关论文—Sublinear、机器阅读理解、加速强化学习、对抗性奖励学习、人机交互

专知

17+阅读 · 2018年4月28日

【学界】极端图像压缩的生成对抗网络，可生成低码率的高质量图像

【学界】极端图像压缩的生成对抗网络，可生成低码率的高质量图像

GAN生成式对抗网络

10+阅读 · 2018年4月25日

相关论文

Constrained Group Relative Policy Optimization

Arxiv

0+阅读 · 2月5日

Improved Dimension Dependence for Bandit Convex Optimization with Gradient Variations

Arxiv

0+阅读 · 2月4日

Finite and Corruption-Robust Regret Bounds in Online Inverse Linear Optimization under M-Convex Action Sets

Arxiv

0+阅读 · 2月2日

CLASP: An online learning algorithm for Convex Losses And Squared Penalties

Arxiv

0+阅读 · 1月22日

Small Gradient Norm Regret for Online Convex Optimization

Arxiv

0+阅读 · 1月20日

Optimization Insights into Deep Diagonal Linear Networks

Arxiv

0+阅读 · 1月19日

Decentralized Online Convex Optimization with Unknown Feedback Delays

Arxiv

0+阅读 · 1月12日

Distributed Online Convex Optimization with Efficient Communication: Improved Algorithm and Lower bounds

Arxiv

0+阅读 · 1月8日

NC2C: Automated Convexification of Generic Non-Convex Optimization Problems

Arxiv

0+阅读 · 1月8日

Online Action-Stacking Improves Reinforcement Learning Performance for Air Traffic Control

Arxiv

0+阅读 · 1月7日

相关基金

面向动态演化的网构软件失效机理与测评方法

国家自然科学基金

1+阅读 · 2015年12月31日

基于多目标优化的约束模式挖掘方法研究

国家自然科学基金

1+阅读 · 2015年12月31日

线性互补约束二次规划问题的一个全局算法研究

国家自然科学基金

0+阅读 · 2015年12月31日

非凸稀疏优化的恢复条件与低复杂度算法的研究

国家自然科学基金

1+阅读 · 2015年12月31日

非光滑非凸优化问题的交替线性化算法及其应用

国家自然科学基金

6+阅读 · 2015年12月31日

演化优化的自适应约束处理机理及在生化过程中的应用

国家自然科学基金

0+阅读 · 2015年12月31日

无限闭凸集族凸可行性问题中投影算法的线性收敛

国家自然科学基金

0+阅读 · 2015年12月31日

非凸二次约束优化问题的全局算法研究及其在信号处理中的应用

国家自然科学基金

1+阅读 · 2014年12月31日

关于二阶锥互补约束数学规划问题的约束规范和算法研究

国家自然科学基金

0+阅读 · 2014年12月31日

非线性约束全局优化的新方法研究

国家自然科学基金

1+阅读 · 2014年12月31日

微信扫码咨询专知VIP会员