Multi-Objective $\textit{min-max}$ Online Convex Optimization - 专知论文

会员服务 ·

0

算法 · 在线 · 损失 · 在线凸优化 · 损失函数 ·

Multi-Objective $\textit{min-max}$ Online Convex Optimization

翻译：多目标最小-最大在线凸优化

Rahul Vaze,Sumiran Mishra

In this paper, we broaden the horizon of online convex optimization (OCO), and consider multi-objective OCO, where there are $K$ distinct loss function sequences, and an algorithm has to choose its action at time $t$, before the $K$ loss functions at time $t$ are revealed. To capture the tradeoff between tracking the $K$ different sequences, we consider the {\it min-max} regret, where the benchmark (optimal offline algorithm) takes a static action across all time slots that minimizes the maximum of the total loss (summed across time slots) incurred by each of the $K$ sequences. An online algorithm is allowed to change its action across time slots, and its {\it min-max} regret is defined as the difference between its {\it min-max} cost and that of the benchmark. The {\it min-max} regret is a stringent performance measure and an algorithm with small regret needs to `track' all loss functions simultaneously. We first show that with adversarial input, {\it min-max} regret scales linearly with the time horizon $T$ for any online algorithm. Consequently, we consider a stochastic i.i.d. input model where all loss functions are i.i.d. generated from an unknown joint distribution and propose a simple algorithm that combines the well-known {\it Hedge} and online gradient descent (OGD) and show via a remarkably simple proof that its expected {\it min-max} regret is $O(\sqrt{T \log (T K)})$. Analogous results are also derived for Martingale difference and Markov input models.

翻译：本文拓展了在线凸优化（OCO）的研究范畴，提出多目标在线凸优化问题。在该问题中，存在K个不同的损失函数序列，算法必须在第t时刻的K个损失函数被揭示之前，选择其在该时刻的动作。为刻画跟踪这K个不同序列之间的权衡关系，我们引入最小-最大遗憾作为性能度量，其中基准算法（最优离线算法）采用跨所有时隙的静态动作，该动作最小化每个K序列所承受的总损失（跨时隙求和）的最大值。在线算法允许随时间改变其动作，其最小-最大遗憾定义为算法的最小-最大成本与基准算法成本之差。最小-最大遗憾是一种严格的性能度量标准，具有较小遗憾的算法需要同时“跟踪”所有损失函数。我们首先证明在对抗性输入下，任何在线算法的最小-最大遗憾均随时间范围T线性增长。因此，我们考虑随机独立同分布输入模型，其中所有损失函数均从未知联合分布中独立同分布生成，并提出一种结合经典Hedge算法与在线梯度下降（OGD）的简单算法。通过一个异常简洁的证明，我们表明该算法的期望最小-最大遗憾为O(√(T log(TK)))。类似结果也在鞅差序列与马尔可夫输入模型中得以推导。

0

相关内容

在数学和计算机科学之中，算法（Algorithm）为一个计算的具体步骤，常用于计算、数据处理和自动推理。精确而言，算法是一个表示为有限长列表的有效方法。算法应包含清晰定义的指令用于计算函数。来自维基百科：算法

【ICML2024】多目标强化学习的最大-最小公式：从理论到无模型算法

【ICML2024】多目标强化学习的最大-最小公式：从理论到无模型算法

专知会员服务

43+阅读 · 2024年6月16日

ICML2023教程《学习、控制与动力系统中的最优传输》, 附406页Slides

ICML2023教程《学习、控制与动力系统中的最优传输》, 附406页Slides

专知会员服务

33+阅读 · 2023年9月24日

【新书】机器学习凸优化，379页pdf，Convex Optimization for Machine Learning

【新书】机器学习凸优化，379页pdf，Convex Optimization for Machine Learning

专知会员服务

149+阅读 · 2022年12月18日

【经典书】凸优化全面介绍，Lectureson Convex Optimization，603页pdf

【经典书】凸优化全面介绍，Lectureson Convex Optimization，603页pdf

专知会员服务

74+阅读 · 2022年6月3日

机器学习必读新书-《凸优化算法原理详解》，334页pdf

机器学习必读新书-《凸优化算法原理详解》，334页pdf

专知会员服务

97+阅读 · 2022年1月4日

【2021新书稿】在线凸优化导论(第二版)，260页pdf

【2021新书稿】在线凸优化导论(第二版)，260页pdf

专知会员服务

74+阅读 · 2021年12月23日

【MIT】约束最小-最大优化的复杂性，84页pdf

专知会员服务

44+阅读 · 2020年9月25日

【耶鲁2020新书】凸优化算法, 328页pdf

专知会员服务

203+阅读 · 2020年9月1日

斯坦福EE364a《凸优化》课件，301页ppt

斯坦福EE364a《凸优化》课件，301页ppt

专知会员服务

100+阅读 · 2020年7月14日

【斯坦福】凸优化圣经- Convex Optimization （附730pdf下载）

【斯坦福】凸优化圣经- Convex Optimization （附730pdf下载）

专知会员服务

231+阅读 · 2020年6月5日

【CMU博士论文】黑盒和多目标优化策略，151页pdf

【CMU博士论文】黑盒和多目标优化策略，151页pdf

专知

13+阅读 · 2022年11月24日

【干货书】凸随机优化，320页pdf

【干货书】凸随机优化，320页pdf

专知

12+阅读 · 2022年9月16日

机器学习必读新书-《凸优化算法原理详解》，334页pdf

机器学习必读新书-《凸优化算法原理详解》，334页pdf

专知

10+阅读 · 2022年1月4日

Google at KDD 2020，提出MoSE框架显式建模用户行为序列提升多任务学习效果

Google at KDD 2020，提出MoSE框架显式建模用户行为序列提升多任务学习效果

AINLP

11+阅读 · 2020年7月7日

【干货书-斯坦福】最优化算法，521页pdf，《Algorithms for Optimization》MIT出版社

【干货书-斯坦福】最优化算法，521页pdf，《Algorithms for Optimization》MIT出版社

专知

58+阅读 · 2020年7月2日

淘宝 at KDD 2020，提出M2GRL优化大规模推荐中的多任务多视角图表示学习

淘宝 at KDD 2020，提出M2GRL优化大规模推荐中的多任务多视角图表示学习

AINLP

23+阅读 · 2020年6月16日

【综述】深度学习在视频多目标跟踪上的应用

【综述】深度学习在视频多目标跟踪上的应用

专知

14+阅读 · 2019年8月8日

最新最权威《深度学习显著目标检测综述》论文代码数据发布，带你全面了解显著目标检测方法

最新最权威《深度学习显著目标检测综述》论文代码数据发布，带你全面了解显著目标检测方法

专知

79+阅读 · 2019年4月24日

【泡泡图灵智库】Complex-YOLO：一个用于实时点云3D目标检测的欧拉区域提议网络（arXiv）

【泡泡图灵智库】Complex-YOLO：一个用于实时点云3D目标检测的欧拉区域提议网络（arXiv）

泡泡机器人SLAM

20+阅读 · 2018年12月27日

博客 | 机器学习中的数学基础（凸优化）

博客 | 机器学习中的数学基础（凸优化）

AI研习社

14+阅读 · 2018年12月16日

最小化加权完工时间和的在线排序研究

国家自然科学基金

0+阅读 · 2015年12月31日

最大化接收工件总利益的在线排序研究

国家自然科学基金

0+阅读 · 2015年12月31日

基于排序法和分解的高维多目标演化算法研究

国家自然科学基金

0+阅读 · 2015年12月31日

基于秩一张量近似的多目标跟踪

国家自然科学基金

0+阅读 · 2015年12月31日

基于广义输出调节的非线性多个体系统的协调控制与优化

国家自然科学基金

1+阅读 · 2015年12月31日

非光滑非凸优化问题的交替线性化算法及其应用

国家自然科学基金

6+阅读 · 2015年12月31日

基于凸松弛-滤子算法的切换系统全局最优控制及应用

国家自然科学基金

0+阅读 · 2015年12月31日

针对多目标优化的人工蜂群算法改进及在水文模型参数优化中的应用

国家自然科学基金

0+阅读 · 2014年12月31日

基于桁架-机构映射的多体系统拓扑优化方法

国家自然科学基金

0+阅读 · 2014年12月31日

多项式优化的最优性条件与最优化算法及其应用

国家自然科学基金

1+阅读 · 2014年12月31日

SINR Estimation under Limited Feedback via Online Convex Optimization

Arxiv

0+阅读 · 3月13日

A Unified Framework for Analyzing Meta-algorithms in Online Convex Optimization

Arxiv

0+阅读 · 2月20日

Distributed Online Convex Optimization with Nonseparable Costs and Constraints

Arxiv

0+阅读 · 2月17日

Improved Regret Guarantees for Online Mirror Descent using a Portfolio of Mirror Maps

Arxiv

0+阅读 · 2月13日

Improved Approximate Regret for Decentralized Online Continuous Submodular Maximization via Reductions

Arxiv

0+阅读 · 2月10日

A Simple, Optimal and Efficient Algorithm for Online Exp-Concave Optimization

Arxiv

0+阅读 · 2月10日

Near-optimal Swap Regret Minimization for Convex Losses

Arxiv

0+阅读 · 2月9日

Small Gradient Norm Regret for Online Convex Optimization

Arxiv

0+阅读 · 2月9日

Single-loop Algorithms for Stochastic Non-convex Optimization with Weakly-Convex Constraints

Arxiv

0+阅读 · 2月6日

Finite and Corruption-Robust Regret Bounds in Online Inverse Linear Optimization under M-Convex Action Sets

Arxiv

0+阅读 · 2月2日

VIP会员

文章信息

相关主题

在线凸优化

最新内容

以色列-美国-伊朗战争中的无人机：关键要点

以色列-美国-伊朗战争中的无人机：关键要点

专知会员服务

1+阅读 · 今天14:04

美以伊战争：首次人工智能战争——军事自主性困境

美以伊战争：首次人工智能战争——军事自主性困境

专知会员服务

1+阅读 · 今天13:54

《Palantir任务保障性软件安全标准（MA-S2）》

《Palantir任务保障性软件安全标准（MA-S2）》

专知会员服务

5+阅读 · 今天13:49

《美海军利用扩展现实增强知识流动研究》300页报告

《美海军利用扩展现实增强知识流动研究》300页报告

专知会员服务

3+阅读 · 今天13:38

基于声学的无人机检测技术综述

基于声学的无人机检测技术综述

专知会员服务

3+阅读 · 今天13:37

《当代混合战争分析框架：俄乌战争经验教训》

《当代混合战争分析框架：俄乌战争经验教训》

专知会员服务

4+阅读 · 今天13:11

生成式AI基础小册子绪论解读：一条数学地基路线，178页pdf

生成式AI基础小册子绪论解读：一条数学地基路线，178页pdf

专知会员服务

10+阅读 · 5月29日

AutoScientists：自组织智能体团队驱动长期科学实验

AutoScientists：自组织智能体团队驱动长期科学实验

专知会员服务

5+阅读 · 5月29日

《阿利·伯克级驱逐舰的战损修理：桌面推演结果》报告

《阿利·伯克级驱逐舰的战损修理：桌面推演结果》报告

专知会员服务

5+阅读 · 5月29日

战略前沿人工智能的再思考（中文）

战略前沿人工智能的再思考（中文）

专知会员服务

7+阅读 · 5月29日

《量化地基防空系统间接效应的博弈论方法》

《量化地基防空系统间接效应的博弈论方法》

专知会员服务

5+阅读 · 5月29日

传感器网络：美国如何探测来自伊朗的导弹与无人机

传感器网络：美国如何探测来自伊朗的导弹与无人机

专知会员服务

6+阅读 · 5月29日

《无人机战争中的经济不对称：伊朗“沙赫德-136”对抗以色列“铁穹”防御系统的案例研究》

《无人机战争中的经济不对称：伊朗“沙赫德-136”对抗以色列“铁穹”防御系统的案例研究》

专知会员服务

8+阅读 · 5月29日

“史诗怒火行动”中美军损失的作战飞机

“史诗怒火行动”中美军损失的作战飞机

专知会员服务

6+阅读 · 5月29日

ICML 2026 | 理解上下文持续学习中的泛化与遗忘

ICML 2026 | 理解上下文持续学习中的泛化与遗忘

专知会员服务

5+阅读 · 5月28日

相关VIP内容

【ICML2024】多目标强化学习的最大-最小公式：从理论到无模型算法

【ICML2024】多目标强化学习的最大-最小公式：从理论到无模型算法

专知会员服务

43+阅读 · 2024年6月16日

ICML2023教程《学习、控制与动力系统中的最优传输》, 附406页Slides

ICML2023教程《学习、控制与动力系统中的最优传输》, 附406页Slides

专知会员服务

33+阅读 · 2023年9月24日

【新书】机器学习凸优化，379页pdf，Convex Optimization for Machine Learning

【新书】机器学习凸优化，379页pdf，Convex Optimization for Machine Learning

专知会员服务

149+阅读 · 2022年12月18日

【经典书】凸优化全面介绍，Lectureson Convex Optimization，603页pdf

【经典书】凸优化全面介绍，Lectureson Convex Optimization，603页pdf

专知会员服务

74+阅读 · 2022年6月3日

机器学习必读新书-《凸优化算法原理详解》，334页pdf

机器学习必读新书-《凸优化算法原理详解》，334页pdf

专知会员服务

97+阅读 · 2022年1月4日

【2021新书稿】在线凸优化导论(第二版)，260页pdf

【2021新书稿】在线凸优化导论(第二版)，260页pdf

专知会员服务

74+阅读 · 2021年12月23日

【MIT】约束最小-最大优化的复杂性，84页pdf

专知会员服务

44+阅读 · 2020年9月25日

【耶鲁2020新书】凸优化算法, 328页pdf

专知会员服务

203+阅读 · 2020年9月1日

斯坦福EE364a《凸优化》课件，301页ppt

斯坦福EE364a《凸优化》课件，301页ppt

专知会员服务

100+阅读 · 2020年7月14日

【斯坦福】凸优化圣经- Convex Optimization （附730pdf下载）

【斯坦福】凸优化圣经- Convex Optimization （附730pdf下载）

专知会员服务

231+阅读 · 2020年6月5日

热门VIP内容

开通专知VIP会员享更多权益服务

美以伊战争：首次人工智能战争——军事自主性困境

《美海军利用扩展现实增强知识流动研究》300页报告

以色列-美国-伊朗战争中的无人机：关键要点

《Palantir任务保障性软件安全标准（MA-S2）》

相关资讯

【CMU博士论文】黑盒和多目标优化策略，151页pdf

【CMU博士论文】黑盒和多目标优化策略，151页pdf

专知

13+阅读 · 2022年11月24日

【干货书】凸随机优化，320页pdf

【干货书】凸随机优化，320页pdf

专知

12+阅读 · 2022年9月16日

机器学习必读新书-《凸优化算法原理详解》，334页pdf

机器学习必读新书-《凸优化算法原理详解》，334页pdf

专知

10+阅读 · 2022年1月4日

Google at KDD 2020，提出MoSE框架显式建模用户行为序列提升多任务学习效果

Google at KDD 2020，提出MoSE框架显式建模用户行为序列提升多任务学习效果

AINLP

11+阅读 · 2020年7月7日

【干货书-斯坦福】最优化算法，521页pdf，《Algorithms for Optimization》MIT出版社

【干货书-斯坦福】最优化算法，521页pdf，《Algorithms for Optimization》MIT出版社

专知

58+阅读 · 2020年7月2日

淘宝 at KDD 2020，提出M2GRL优化大规模推荐中的多任务多视角图表示学习

淘宝 at KDD 2020，提出M2GRL优化大规模推荐中的多任务多视角图表示学习

AINLP

23+阅读 · 2020年6月16日

【综述】深度学习在视频多目标跟踪上的应用

【综述】深度学习在视频多目标跟踪上的应用

专知

14+阅读 · 2019年8月8日

最新最权威《深度学习显著目标检测综述》论文代码数据发布，带你全面了解显著目标检测方法

最新最权威《深度学习显著目标检测综述》论文代码数据发布，带你全面了解显著目标检测方法

专知

79+阅读 · 2019年4月24日

【泡泡图灵智库】Complex-YOLO：一个用于实时点云3D目标检测的欧拉区域提议网络（arXiv）

【泡泡图灵智库】Complex-YOLO：一个用于实时点云3D目标检测的欧拉区域提议网络（arXiv）

泡泡机器人SLAM

20+阅读 · 2018年12月27日

博客 | 机器学习中的数学基础（凸优化）

博客 | 机器学习中的数学基础（凸优化）

AI研习社

14+阅读 · 2018年12月16日

相关论文

SINR Estimation under Limited Feedback via Online Convex Optimization

Arxiv

0+阅读 · 3月13日

A Unified Framework for Analyzing Meta-algorithms in Online Convex Optimization

Arxiv

0+阅读 · 2月20日

Distributed Online Convex Optimization with Nonseparable Costs and Constraints

Arxiv

0+阅读 · 2月17日

Improved Regret Guarantees for Online Mirror Descent using a Portfolio of Mirror Maps

Arxiv

0+阅读 · 2月13日

Improved Approximate Regret for Decentralized Online Continuous Submodular Maximization via Reductions

Arxiv

0+阅读 · 2月10日

A Simple, Optimal and Efficient Algorithm for Online Exp-Concave Optimization

Arxiv

0+阅读 · 2月10日

Near-optimal Swap Regret Minimization for Convex Losses

Arxiv

0+阅读 · 2月9日

Small Gradient Norm Regret for Online Convex Optimization

Arxiv

0+阅读 · 2月9日

Single-loop Algorithms for Stochastic Non-convex Optimization with Weakly-Convex Constraints

Arxiv

0+阅读 · 2月6日

Finite and Corruption-Robust Regret Bounds in Online Inverse Linear Optimization under M-Convex Action Sets

Arxiv

0+阅读 · 2月2日

相关基金

最小化加权完工时间和的在线排序研究

国家自然科学基金

0+阅读 · 2015年12月31日

最大化接收工件总利益的在线排序研究

国家自然科学基金

0+阅读 · 2015年12月31日

基于排序法和分解的高维多目标演化算法研究

国家自然科学基金

0+阅读 · 2015年12月31日

基于秩一张量近似的多目标跟踪

国家自然科学基金

0+阅读 · 2015年12月31日

基于广义输出调节的非线性多个体系统的协调控制与优化

国家自然科学基金

1+阅读 · 2015年12月31日

非光滑非凸优化问题的交替线性化算法及其应用

国家自然科学基金

6+阅读 · 2015年12月31日

基于凸松弛-滤子算法的切换系统全局最优控制及应用

国家自然科学基金

0+阅读 · 2015年12月31日

针对多目标优化的人工蜂群算法改进及在水文模型参数优化中的应用

国家自然科学基金

0+阅读 · 2014年12月31日

基于桁架-机构映射的多体系统拓扑优化方法

国家自然科学基金

0+阅读 · 2014年12月31日

多项式优化的最优性条件与最优化算法及其应用

国家自然科学基金

1+阅读 · 2014年12月31日

微信扫码咨询专知VIP会员