Contextual Bandits with Packing and Covering Constraints: A Modular Lagrangian Approach via Regression - 专知论文

会员服务 ·

0

约束条件 · 约束 · 线性约束 · 上下文 · Packing ·

2023 年 3 月 24 日

Contextual Bandits with Packing and Covering Constraints: A Modular Lagrangian Approach via Regression

翻译：具有打包和覆盖约束的上下文赌博机：基于回归的模块化拉格朗日方法

Aleksandrs Slivkins,Karthik Abinav Sankararaman,Dylan J. Foster

We consider contextual bandits with linear constraints (CBwLC), a variant of contextual bandits in which the algorithm consumes multiple resources subject to linear constraints on total consumption. This problem generalizes contextual bandits with knapsacks (CBwK), allowing for packing and covering constraints, as well as positive and negative resource consumption. We provide the first algorithm for CBwLC (or CBwK) that is based on regression oracles. The algorithm is simple, computationally efficient, and admits vanishing regret. It is statistically optimal for the variant of CBwK in which the algorithm must stop once some constraint is violated. Further, we provide the first vanishing-regret guarantees for CBwLC (or CBwK) that extend beyond the stochastic environment. We side-step strong impossibility results from prior work by identifying a weaker (and, arguably, fairer) benchmark to compare against. Our algorithm builds on LagrangeBwK (Immorlica et al., FOCS 2019), a Lagrangian-based technique for CBwK, and SquareCB (Foster and Rakhlin, ICML 2020), a regression-based technique for contextual bandits. Our analysis leverages the inherent modularity of both techniques.

翻译：我们考虑具有线性约束的上下文赌博机（CBwLC），这是上下文赌博机的一种变体，其中算法在总消耗受线性约束的情况下消耗多种资源。该问题推广了具有背包约束的上下文赌博机（CBwK），允许打包和覆盖约束以及正负资源消耗。我们提出了首个基于回归预言的CBwLC（或CBwK）算法。该算法简洁、计算高效，且具有渐近消失的遗憾值。对于算法必须在违反某个约束时停止的CBwK变体，该算法在统计上是最优的。此外，我们首次为CBwLC（或CBwK）提供了适用于随机环境之外的渐近遗憾保证。通过识别一个更弱（且可以说更公平）的比较基准，我们避开了先前工作中的强不可能性结果。我们的算法基于LagrangeBwK（Immorlica等人，FOCS 2019）——一种用于CBwK的拉格朗日技术，以及SquareCB（Foster和Rakhlin，ICML 2020）——一种用于上下文赌博机的回归技术。我们的分析利用了这两种技术固有的模块化特性。

0

相关内容

约束条件

【ICDM 2022教程】图挖掘中的公平性:度量、算法和应用

【ICDM 2022教程】图挖掘中的公平性:度量、算法和应用

专知会员服务

28+阅读 · 2022年12月26日

不可错过！《机器学习100讲》课程，UBC Mark Schmidt讲授

不可错过！《机器学习100讲》课程，UBC Mark Schmidt讲授

专知会员服务

76+阅读 · 2022年6月28日

NeurIPS 2021 | 用简单的梯度下降算法逃离鞍点

NeurIPS 2021 | 用简单的梯度下降算法逃离鞍点

专知会员服务

24+阅读 · 2021年12月6日

【经典书】图模型: 指数族和变分推断，305页pdf

专知会员服务

52+阅读 · 2020年12月10日

【NeurIPS2020-北大】非凸优化裁剪算法的改进分析

【NeurIPS2020-北大】非凸优化裁剪算法的改进分析

专知会员服务

29+阅读 · 2020年10月11日

NLP必读经典文献100篇

专知会员服务

124+阅读 · 2020年9月8日

【新书】人工智能Python代码，227页pdf，Python code for Artificial Intelligence: Foundations of Computational Agents

【新书】人工智能Python代码，227页pdf，Python code for Artificial Intelligence: Foundations of Computational Agents

专知会员服务

107+阅读 · 2020年6月21日

【NeurIPS 2019|经典论文奖】正则随机学习和在线优化的双重平均法（Dual Averaging Method for Regularized Stochastic Learning and Online Optimization），微软研究院Lin Xiao

【NeurIPS 2019|经典论文奖】正则随机学习和在线优化的双重平均法（Dual Averaging Method for Regularized Stochastic Learning and Online Optimization），微软研究院Lin Xiao

专知会员服务

17+阅读 · 2019年12月9日

【ICCV 2019 Toturial】Global Optimization for Geometric Understanding with Provable Guarantees（具有可证明保证的几何理解的全局优化）

【ICCV 2019 Toturial】Global Optimization for Geometric Understanding with Provable Guarantees（具有可证明保证的几何理解的全局优化）

专知会员服务

18+阅读 · 2019年11月1日

【SIGGRAPH2019】TensorFlow 2.0深度学习计算机图形学应用

【SIGGRAPH2019】TensorFlow 2.0深度学习计算机图形学应用

专知会员服务

41+阅读 · 2019年10月9日

灾难性遗忘问题新视角：迁移-干扰平衡

灾难性遗忘问题新视角：迁移-干扰平衡

CreateAMind

17+阅读 · 2019年7月6日

Hierarchically Structured Meta-learning

Hierarchically Structured Meta-learning

CreateAMind

27+阅读 · 2019年5月22日

深度自进化聚类：Deep Self-Evolution Clustering

深度自进化聚类：Deep Self-Evolution Clustering

我爱读PAMI

15+阅读 · 2019年4月13日

Github项目推荐 | Dragonfly：可扩展贝叶斯优化库（Python）

Github项目推荐 | Dragonfly：可扩展贝叶斯优化库（Python）

AI研习社

11+阅读 · 2019年3月22日

逆强化学习-学习人先验的动机

逆强化学习-学习人先验的动机

CreateAMind

16+阅读 · 2019年1月18日

利用动态深度学习预测金融时间序列基于Python

利用动态深度学习预测金融时间序列基于Python

量化投资与机器学习

18+阅读 · 2018年10月30日

【跟踪Tracking】15篇论文+代码 | 中秋快乐~

【跟踪Tracking】15篇论文+代码 | 中秋快乐~

专知

18+阅读 · 2018年9月24日

【泡泡一分钟】动态环境下稳健的单目SLAM

【泡泡一分钟】动态环境下稳健的单目SLAM

泡泡机器人SLAM

13+阅读 · 2018年3月22日

【论文】变分推断（Variational inference)的总结

【论文】变分推断（Variational inference)的总结

机器学习研究会

39+阅读 · 2017年11月16日

【推荐】RNN/LSTM时序预测

【推荐】RNN/LSTM时序预测

机器学习研究会

25+阅读 · 2017年9月8日

基于流密码架构的认证加密方案设计

国家自然科学基金

0+阅读 · 2014年12月31日

基于子集模拟的连续体结构可靠性拓扑优化全局方法研究

国家自然科学基金

0+阅读 · 2013年12月31日

考虑观测值时空相关性的InSAR三维形变估计方法

国家自然科学基金

0+阅读 · 2013年12月31日

谱范数下矩阵的广义最小秩逼近问题及应用

国家自然科学基金

0+阅读 · 2013年12月31日

微电网环境下多约束复杂自主体网络建模与协调优化的研究

国家自然科学基金

0+阅读 · 2013年12月31日

复杂交通条件下弱环境约束区域无人驾驶车辆相对定位方法关键问题的研究

国家自然科学基金

1+阅读 · 2013年12月31日

高超声速飞行器实时再入轨迹与姿态协调控制策略研究

国家自然科学基金

0+阅读 · 2012年12月31日

认知无线传感器网络中的信道感知与分配算法

国家自然科学基金

1+阅读 · 2012年12月31日

不确定环境下独立微网系统的优化规划设计方法研究

国家自然科学基金

0+阅读 · 2012年12月31日

实用后量子线性公钥加密的错误嵌入与通用构造

国家自然科学基金

0+阅读 · 2011年12月31日

A Hierarchical Encoding-Decoding Scheme for Abstractive Multi-document Summarization

Arxiv

0+阅读 · 2023年5月16日

Geometric Hitting Set for Line-Constrained Disks and Related Problems

Arxiv

0+阅读 · 2023年5月15日

Decentralization and Acceleration Enables Large-Scale Bundle Adjustment

Arxiv

0+阅读 · 2023年5月15日

Bin Packing with Partition Matroid can be Approximated within $o(OPT)$ Bins

Arxiv

0+阅读 · 2023年5月14日

A general framework for enumerating equivalence classes of solutions

Arxiv

0+阅读 · 2023年5月14日

Impacts of Differential Privacy on Fostering more Racially and Ethnically Diverse Elementary Schools

Arxiv

0+阅读 · 2023年5月12日

Should Bank Stress Tests Be Fair?

Arxiv

0+阅读 · 2023年5月12日

ZARA: Improving Few-Shot Self-Rationalization for Small Language Models

Arxiv

0+阅读 · 2023年5月12日

On the Fair Comparison of Optimization Algorithms in Different Machines

Arxiv

0+阅读 · 2023年5月12日

Generalized Iterative Scaling for Regularized Optimal Transport with Affine Constraints: Application Examples

Arxiv

0+阅读 · 2023年5月11日

VIP会员

文章信息

相关主题

最新内容

ICML 2026 | VOTP：用视频基础模型与最优传输，让离线偏好强化学习只需少量反馈

ICML 2026 | VOTP：用视频基础模型与最优传输，让离线偏好强化学习只需少量反馈

专知会员服务

1+阅读 · 今天13:56

多模态代码智能综述：从视觉输入到可执行代码系统

多模态代码智能综述：从视觉输入到可执行代码系统

专知会员服务

1+阅读 · 今天13:54

美国马六甲“三重网”概念：安全网、威慑网与杀伤网

美国马六甲“三重网”概念：安全网、威慑网与杀伤网

专知会员服务

4+阅读 · 今天8:18

《面向导弹有效发射时机的监督机器学习方法：基于超视距空战仿真》

《面向导弹有效发射时机的监督机器学习方法：基于超视距空战仿真》

专知会员服务

3+阅读 · 今天7:39

《通用大语言模型：无人机指挥与控制接口》最新40页

《通用大语言模型：无人机指挥与控制接口》最新40页

专知会员服务

10+阅读 · 今天7:33

《通过小型无人机系统将情报能力“作战化”》

《通过小型无人机系统将情报能力“作战化”》

专知会员服务

3+阅读 · 今天7:28

《神经安全型有人–无人协同：面向认知自适应作战能力的参考架构》

《神经安全型有人–无人协同：面向认知自适应作战能力的参考架构》

专知会员服务

6+阅读 · 今天7:14

《在指挥链中通过多准则决策分析传达指挥官意图：空战实验》

《在指挥链中通过多准则决策分析传达指挥官意图：空战实验》

专知会员服务

19+阅读 · 6月15日

消耗优势：美军的“精确规模化”概念

消耗优势：美军的“精确规模化”概念

专知会员服务

8+阅读 · 6月15日

五角大楼的AI优先战略及其对现代战争的启示：来自与伊朗冲突的经验教训

五角大楼的AI优先战略及其对现代战争的启示：来自与伊朗冲突的经验教训

专知会员服务

9+阅读 · 6月15日

《网络空间兵棋推演：挑战、局限性与混合路径》报告

《网络空间兵棋推演：挑战、局限性与混合路径》报告

专知会员服务

9+阅读 · 6月15日

《离线语言支持系统：面向空战战术决策》

《离线语言支持系统：面向空战战术决策》

专知会员服务

8+阅读 · 6月15日

《以通信为中心的6G–LLM架构：面向可扩展的战术自主防御车辆网络》

《以通信为中心的6G–LLM架构：面向可扩展的战术自主防御车辆网络》

专知会员服务

8+阅读 · 6月15日

ICML 2026｜ECA：面向开放式图文生成的高效持续对齐

ICML 2026｜ECA：面向开放式图文生成的高效持续对齐

专知会员服务

6+阅读 · 6月14日

可信智能体AI综述：安全、鲁棒性、隐私与系统安全

可信智能体AI综述：安全、鲁棒性、隐私与系统安全

专知会员服务

6+阅读 · 6月14日

相关VIP内容

【ICDM 2022教程】图挖掘中的公平性:度量、算法和应用

【ICDM 2022教程】图挖掘中的公平性:度量、算法和应用

专知会员服务

28+阅读 · 2022年12月26日

不可错过！《机器学习100讲》课程，UBC Mark Schmidt讲授

不可错过！《机器学习100讲》课程，UBC Mark Schmidt讲授

专知会员服务

76+阅读 · 2022年6月28日

NeurIPS 2021 | 用简单的梯度下降算法逃离鞍点

NeurIPS 2021 | 用简单的梯度下降算法逃离鞍点

专知会员服务

24+阅读 · 2021年12月6日

【经典书】图模型: 指数族和变分推断，305页pdf

专知会员服务

52+阅读 · 2020年12月10日

【NeurIPS2020-北大】非凸优化裁剪算法的改进分析

【NeurIPS2020-北大】非凸优化裁剪算法的改进分析

专知会员服务

29+阅读 · 2020年10月11日

NLP必读经典文献100篇

专知会员服务

124+阅读 · 2020年9月8日

【新书】人工智能Python代码，227页pdf，Python code for Artificial Intelligence: Foundations of Computational Agents

【新书】人工智能Python代码，227页pdf，Python code for Artificial Intelligence: Foundations of Computational Agents

专知会员服务

107+阅读 · 2020年6月21日

【NeurIPS 2019|经典论文奖】正则随机学习和在线优化的双重平均法（Dual Averaging Method for Regularized Stochastic Learning and Online Optimization），微软研究院Lin Xiao

【NeurIPS 2019|经典论文奖】正则随机学习和在线优化的双重平均法（Dual Averaging Method for Regularized Stochastic Learning and Online Optimization），微软研究院Lin Xiao

专知会员服务

17+阅读 · 2019年12月9日

【ICCV 2019 Toturial】Global Optimization for Geometric Understanding with Provable Guarantees（具有可证明保证的几何理解的全局优化）

【ICCV 2019 Toturial】Global Optimization for Geometric Understanding with Provable Guarantees（具有可证明保证的几何理解的全局优化）

专知会员服务

18+阅读 · 2019年11月1日

【SIGGRAPH2019】TensorFlow 2.0深度学习计算机图形学应用

【SIGGRAPH2019】TensorFlow 2.0深度学习计算机图形学应用

专知会员服务

41+阅读 · 2019年10月9日

热门VIP内容

开通专知VIP会员享更多权益服务

多模态代码智能综述：从视觉输入到可执行代码系统

《面向导弹有效发射时机的监督机器学习方法：基于超视距空战仿真》

ICML 2026 | VOTP：用视频基础模型与最优传输，让离线偏好强化学习只需少量反馈

美国马六甲“三重网”概念：安全网、威慑网与杀伤网

相关资讯

灾难性遗忘问题新视角：迁移-干扰平衡

灾难性遗忘问题新视角：迁移-干扰平衡

CreateAMind

17+阅读 · 2019年7月6日

Hierarchically Structured Meta-learning

Hierarchically Structured Meta-learning

CreateAMind

27+阅读 · 2019年5月22日

深度自进化聚类：Deep Self-Evolution Clustering

深度自进化聚类：Deep Self-Evolution Clustering

我爱读PAMI

15+阅读 · 2019年4月13日

Github项目推荐 | Dragonfly：可扩展贝叶斯优化库（Python）

Github项目推荐 | Dragonfly：可扩展贝叶斯优化库（Python）

AI研习社

11+阅读 · 2019年3月22日

逆强化学习-学习人先验的动机

逆强化学习-学习人先验的动机

CreateAMind

16+阅读 · 2019年1月18日

利用动态深度学习预测金融时间序列基于Python

利用动态深度学习预测金融时间序列基于Python

量化投资与机器学习

18+阅读 · 2018年10月30日

【跟踪Tracking】15篇论文+代码 | 中秋快乐~

【跟踪Tracking】15篇论文+代码 | 中秋快乐~

专知

18+阅读 · 2018年9月24日

【泡泡一分钟】动态环境下稳健的单目SLAM

【泡泡一分钟】动态环境下稳健的单目SLAM

泡泡机器人SLAM

13+阅读 · 2018年3月22日

【论文】变分推断（Variational inference)的总结

【论文】变分推断（Variational inference)的总结

机器学习研究会

39+阅读 · 2017年11月16日

【推荐】RNN/LSTM时序预测

【推荐】RNN/LSTM时序预测

机器学习研究会

25+阅读 · 2017年9月8日

相关论文

A Hierarchical Encoding-Decoding Scheme for Abstractive Multi-document Summarization

Arxiv

0+阅读 · 2023年5月16日

Geometric Hitting Set for Line-Constrained Disks and Related Problems

Arxiv

0+阅读 · 2023年5月15日

Decentralization and Acceleration Enables Large-Scale Bundle Adjustment

Arxiv

0+阅读 · 2023年5月15日

Bin Packing with Partition Matroid can be Approximated within $o(OPT)$ Bins

Arxiv

0+阅读 · 2023年5月14日

A general framework for enumerating equivalence classes of solutions

Arxiv

0+阅读 · 2023年5月14日

Impacts of Differential Privacy on Fostering more Racially and Ethnically Diverse Elementary Schools

Arxiv

0+阅读 · 2023年5月12日

Should Bank Stress Tests Be Fair?

Arxiv

0+阅读 · 2023年5月12日

ZARA: Improving Few-Shot Self-Rationalization for Small Language Models

Arxiv

0+阅读 · 2023年5月12日

On the Fair Comparison of Optimization Algorithms in Different Machines

Arxiv

0+阅读 · 2023年5月12日

Generalized Iterative Scaling for Regularized Optimal Transport with Affine Constraints: Application Examples

Arxiv

0+阅读 · 2023年5月11日

相关基金

基于流密码架构的认证加密方案设计

国家自然科学基金

0+阅读 · 2014年12月31日

基于子集模拟的连续体结构可靠性拓扑优化全局方法研究

国家自然科学基金

0+阅读 · 2013年12月31日

考虑观测值时空相关性的InSAR三维形变估计方法

国家自然科学基金

0+阅读 · 2013年12月31日

谱范数下矩阵的广义最小秩逼近问题及应用

国家自然科学基金

0+阅读 · 2013年12月31日

微电网环境下多约束复杂自主体网络建模与协调优化的研究

国家自然科学基金

0+阅读 · 2013年12月31日

复杂交通条件下弱环境约束区域无人驾驶车辆相对定位方法关键问题的研究

国家自然科学基金

1+阅读 · 2013年12月31日

高超声速飞行器实时再入轨迹与姿态协调控制策略研究

国家自然科学基金

0+阅读 · 2012年12月31日

认知无线传感器网络中的信道感知与分配算法

国家自然科学基金

1+阅读 · 2012年12月31日

不确定环境下独立微网系统的优化规划设计方法研究

国家自然科学基金

0+阅读 · 2012年12月31日

实用后量子线性公钥加密的错误嵌入与通用构造

国家自然科学基金

0+阅读 · 2011年12月31日

微信扫码咨询专知VIP会员