Taming the Heavy Tail: Age-Optimal Preemption - 专知论文

会员服务 ·

0

最优 · 代价 · 重尾分布 · 调度 · 基准 ·

Taming the Heavy Tail: Age-Optimal Preemption

翻译：驯服重尾分布：面向年龄最优的抢占式调度

Aimin Li,Yiğit İnce,Elif Uysal

from arxiv, 11 pages

This paper studies a continuous-time joint sampling-and-preemption problem, incorporating sampling and preemption penalties under general service-time distributions. We formulate the system as an impulse-controlled piecewise-deterministic Markov process (PDMP) and derive coupled integral average-cost optimality equations via the dynamic programming principle, thereby avoiding the smoothness assumptions typically required for an average-cost Hamilton-Jacobi-Bellman quasi-variational inequality (HJB-QVI) characterization. A key invariance in the busy phase collapses the dynamics onto a one-dimensional busy-start boundary, reducing preemption control to an optimal stopping problem. Building on this structure, we develop an efficient policy iteration algorithm with heavy-tail acceleration, employing a hybrid (uniform/log-spaced) action grid and a far-field linear closure. Simulations under Pareto and log-normal service times demonstrate substantial improvements over AoI-optimal non-preemptive sampling and zero-wait baselines, achieving up to a 30x reduction in average cost in heavy-tailed regimes. Finally, simulations uncover a counterintuitive insight: under preemption, delay variance, despite typically being a liability, can become a strategic advantage for information freshness.

翻译：本文研究一个连续时间联合采样与抢占问题，该问题在一般服务时间分布下同时考虑了采样与抢占惩罚。我们将系统建模为脉冲控制的分段确定性马尔可夫过程（PDMP），并基于动态规划原理推导出耦合的积分型平均代价最优性方程，从而避免了通常为建立平均代价哈密顿-雅可比-贝尔曼拟变分不等式（HJB-QVI）表征所需的光滑性假设。繁忙阶段的一个关键不变性将动态过程压缩至一维繁忙起始边界，从而将抢占控制简化为一个最优停止问题。基于此结构，我们开发了一种结合重尾加速的高效策略迭代算法，该算法采用混合（均匀/对数间隔）动作网格及远场线性闭包。在帕累托与对数正态服务时间分布下的仿真结果表明，相较于面向信息年龄最优的非抢占式采样基准与零等待基准，该方法取得了显著改进，在重尾区域平均代价降低高达30倍。最后，仿真揭示了一个反直觉的发现：在抢占机制下，延迟方差——尽管通常被视为不利因素——反而可能成为提升信息新鲜度的策略性优势。

0

相关内容

【EMNLP2025】面向大语言模型的权重旋转偏好优化

【EMNLP2025】面向大语言模型的权重旋转偏好优化

专知会员服务

12+阅读 · 2025年8月27日

《组合优化问题强化学习框架在动态武器目标分配中的应用》61页

《组合优化问题强化学习框架在动态武器目标分配中的应用》61页

专知会员服务

67+阅读 · 2025年3月21日

面向战场移动威胁的预测模型：利用预测性数据模型打击大规模移动目标

面向战场移动威胁的预测模型：利用预测性数据模型打击大规模移动目标

专知会员服务

42+阅读 · 2024年12月23日

基于深度强化学习的海上编队防空任务分配

基于深度强化学习的海上编队防空任务分配

专知会员服务

90+阅读 · 2023年8月14日

【伯克利博士论文】不确定性序列决策:最优性保证，组合学习，以及在机器人技术和生态学中的应用，256页pdf

【伯克利博士论文】不确定性序列决策:最优性保证，组合学习，以及在机器人技术和生态学中的应用，256页pdf

专知会员服务

38+阅读 · 2023年5月17日

《战术自主蜂群网络优化中的时延与收敛速度》美空军36页报告

《战术自主蜂群网络优化中的时延与收敛速度》美空军36页报告

专知会员服务

58+阅读 · 2023年4月24日

《联合火力自动化的效应任务优化方法》2022最新30页技术报告，加拿大国防研究与发展部

《联合火力自动化的效应任务优化方法》2022最新30页技术报告，加拿大国防研究与发展部

专知会员服务

56+阅读 · 2023年1月12日

推荐！《基于多智能体学习的任务分配动态邻域优化》2022最新41页综述论文，伦敦国王学院

推荐！《基于多智能体学习的任务分配动态邻域优化》2022最新41页综述论文，伦敦国王学院

专知会员服务

146+阅读 · 2022年11月14日

【清华大学】Delta调优:预训练语言模型参数有效方法的综合研究，Delta Tuning: A Comprehensive Study of Parameter Efficient Methods for Pre-trained Language Models

【清华大学】Delta调优:预训练语言模型参数有效方法的综合研究，Delta Tuning: A Comprehensive Study of Parameter Efficient Methods for Pre-trained Language Models

专知会员服务

26+阅读 · 2022年3月15日

【谷歌大脑新论文】利用可微摄动优化器进行学习，Learning with Differentiable Perturbed Optimizers

【谷歌大脑新论文】利用可微摄动优化器进行学习，Learning with Differentiable Perturbed Optimizers

专知会员服务

29+阅读 · 2020年2月22日

推荐！《不确定性下的作战决策：推理、序贯和对抗性方法》美国空军293页博士论文，含代码

推荐！《不确定性下的作战决策：推理、序贯和对抗性方法》美国空军293页博士论文，含代码

专知

50+阅读 · 2022年11月16日

推荐！《基于多智能体学习的任务分配动态邻域优化》2022最新41页综述论文，伦敦国王学院

推荐！《基于多智能体学习的任务分配动态邻域优化》2022最新41页综述论文，伦敦国王学院

专知

17+阅读 · 2022年11月15日

注意力机制 | 图卷积多跳注意力机制 | Direct multi-hop Attention based GNN

注意力机制 | 图卷积多跳注意力机制 | Direct multi-hop Attention based GNN

AINLP

22+阅读 · 2020年11月29日

淘宝 at KDD 2020，提出M2GRL优化大规模推荐中的多任务多视角图表示学习

淘宝 at KDD 2020，提出M2GRL优化大规模推荐中的多任务多视角图表示学习

AINLP

23+阅读 · 2020年6月16日

AAAI 2020 | 华为：短小时序，如何预测？——基于特征重构的张量ARIMA

AAAI 2020 | 华为：短小时序，如何预测？——基于特征重构的张量ARIMA

AI科技评论

13+阅读 · 2020年2月5日

用Attention玩转CV，一文总览自注意力语义分割进展

用Attention玩转CV，一文总览自注意力语义分割进展

机器之心

14+阅读 · 2019年8月26日

分割、检测与定位，高分辨率网络显神威！这会是席卷深度学习的通用结构吗？

分割、检测与定位，高分辨率网络显神威！这会是席卷深度学习的通用结构吗？

极市平台

11+阅读 · 2019年4月17日

深度学习中Attention Mechanism详细介绍：原理、分类及应用

深度学习中Attention Mechanism详细介绍：原理、分类及应用

深度学习与NLP

10+阅读 · 2019年2月18日

时间卷积网络（TCN）将取代RNN成为NLP预测领域王者

时间卷积网络（TCN）将取代RNN成为NLP预测领域王者

AI前线

11+阅读 · 2018年5月14日

模型汇总24 - 深度学习中Attention Mechanism详细介绍：原理、分类及应用

模型汇总24 - 深度学习中Attention Mechanism详细介绍：原理、分类及应用

深度学习与NLP

12+阅读 · 2017年11月30日

网络化非线性系统的协调控制及其在分布式可重构航天器中的应用

国家自然科学基金

0+阅读 · 2015年12月31日

云计算平台中大规模交互式服务长尾延迟消减关键技术研究

国家自然科学基金

0+阅读 · 2015年12月31日

状态依赖时滞耦合拥塞控制系统的振荡与同步

国家自然科学基金

0+阅读 · 2015年12月31日

基于强化学习的分布参数系统数据驱动控制

国家自然科学基金

7+阅读 · 2015年12月31日

演化优化的自适应约束处理机理及在生化过程中的应用

国家自然科学基金

0+阅读 · 2015年12月31日

考虑外包的生产重调度问题模型与优化方法研究

国家自然科学基金

0+阅读 · 2015年12月31日

随机动态系统的风险分析及其最优控制问题

国家自然科学基金

1+阅读 · 2014年12月31日

具有服务等级的平行机在线排序问题研究

国家自然科学基金

0+阅读 · 2014年12月31日

基于神经网络和强化学习的车辆装配系统中的多载量小车实时调度方法

国家自然科学基金

4+阅读 · 2014年12月31日

机制转化下的最优停时问题研究---以金融中投资决策分析为例

国家自然科学基金

2+阅读 · 2014年12月31日

Attack-Resistant Uniform Fairness for Linear and Smooth Contextual Bandits

Arxiv

0+阅读 · 2月4日

Preemptive Scheduling for Age of Job Minimization in Task-Specific Machine Networks

Arxiv

0+阅读 · 2月2日

Age Optimal Sampling and Routing under Intermittent Links and Energy Constraints

Arxiv

0+阅读 · 1月30日

Optimal Asynchronous Stochastic Nonconvex Optimization under Heavy-Tailed Noise

Arxiv

0+阅读 · 1月27日

Tail-Latency-Aware Federated Learning with Pinching Antenna: Latency, Participation, and Placement

Arxiv

0+阅读 · 1月26日

Taming the Long-Tail: Efficient Reasoning RL Training with Adaptive Drafter

Arxiv

0+阅读 · 1月21日

Utilizing the Perceived Age to Maximize Freshness in Query-Based Update Systems

Arxiv

0+阅读 · 1月20日

Tail-Aware Density Forecasting of Locally Explosive Time Series: A Neural Network Approach

Arxiv

0+阅读 · 1月20日

Hierarchical Importance Sampling for Estimating Occupation Time for SDE Solutions

Arxiv

0+阅读 · 1月14日

TreeAdv: Tree-Structured Advantage Redistribution for Group-Based RL

Arxiv

0+阅读 · 1月7日

VIP会员

文章信息

相关主题

最新内容

【NTU博士论文】3D人体动作生成

【NTU博士论文】3D人体动作生成

专知会员服务

1+阅读 · 今天14:48

DeepSeek-V4：百万 Token 上下文背后，大模型正在进入“长程智能”时代（附中英文pdf版）

DeepSeek-V4：百万 Token 上下文背后，大模型正在进入“长程智能”时代（附中英文pdf版）

专知会员服务

1+阅读 · 今天14:38

以色列军事技术对美国军力发展的持续性赋能

以色列军事技术对美国军力发展的持续性赋能

专知会员服务

7+阅读 · 今天8:46

战场之外的较量：美伊冲突中的认知战与心理博弈

战场之外的较量：美伊冲突中的认知战与心理博弈

专知会员服务

5+阅读 · 今天7:41

俄乌战争中乌克兰防空能力演变与见解（中文版）

俄乌战争中乌克兰防空能力演变与见解（中文版）

专知会员服务

3+阅读 · 今天7:22

《面向巡飞弹药系统的情境感知深度强化学习自主非线性机动控制》

《面向巡飞弹药系统的情境感知深度强化学习自主非线性机动控制》

专知会员服务

8+阅读 · 今天6:04

《深度强化学习在兵棋推演中的应用》40页报告

《深度强化学习在兵棋推演中的应用》40页报告

专知会员服务

9+阅读 · 今天5:37

《多域作战面临复杂现实》

《多域作战面临复杂现实》

专知会员服务

7+阅读 · 今天5:35

《印度的多域作战：条令与能力发展》报告

《印度的多域作战：条令与能力发展》报告

专知会员服务

3+阅读 · 今天5:24

《是“修复情报”还是修复部队？阿富汗反叛乱行动中的美军情报调整》400页

《是“修复情报”还是修复部队？阿富汗反叛乱行动中的美军情报调整》400页

专知会员服务

3+阅读 · 今天5:18

美军的算法化军备库：无人机优势计划（DDP）、复制者倡议（Replicator）与联合全域指挥控制（JADC2）如何重写战争规则

美军的算法化军备库：无人机优势计划（DDP）、复制者倡议（Replicator）与联合全域指挥控制（JADC2）如何重写战争规则

专知会员服务

3+阅读 · 今天3:25

（中文版）美空军部发布《空军部数据战略》与《人工智能战略》两份战略：旨在加速建立军事优势

（中文版）美空军部发布《空军部数据战略》与《人工智能战略》两份战略：旨在加速建立军事优势

专知会员服务

17+阅读 · 今天2:55

【斯坦福博士论文】语言模型的机械可解释性与控制

【斯坦福博士论文】语言模型的机械可解释性与控制

专知会员服务

4+阅读 · 4月23日

大语言模型智能体长期记忆安全性综述：迈向记忆主权

大语言模型智能体长期记忆安全性综述：迈向记忆主权

专知会员服务

5+阅读 · 4月23日

美军被摧毁的空战装备：伊朗战争如何重创美国空中力量

美军被摧毁的空战装备：伊朗战争如何重创美国空中力量

专知会员服务

5+阅读 · 4月23日

相关VIP内容

【EMNLP2025】面向大语言模型的权重旋转偏好优化

【EMNLP2025】面向大语言模型的权重旋转偏好优化

专知会员服务

12+阅读 · 2025年8月27日

《组合优化问题强化学习框架在动态武器目标分配中的应用》61页

《组合优化问题强化学习框架在动态武器目标分配中的应用》61页

专知会员服务

67+阅读 · 2025年3月21日

面向战场移动威胁的预测模型：利用预测性数据模型打击大规模移动目标

面向战场移动威胁的预测模型：利用预测性数据模型打击大规模移动目标

专知会员服务

42+阅读 · 2024年12月23日

基于深度强化学习的海上编队防空任务分配

基于深度强化学习的海上编队防空任务分配

专知会员服务

90+阅读 · 2023年8月14日

【伯克利博士论文】不确定性序列决策:最优性保证，组合学习，以及在机器人技术和生态学中的应用，256页pdf

【伯克利博士论文】不确定性序列决策:最优性保证，组合学习，以及在机器人技术和生态学中的应用，256页pdf

专知会员服务

38+阅读 · 2023年5月17日

《战术自主蜂群网络优化中的时延与收敛速度》美空军36页报告

《战术自主蜂群网络优化中的时延与收敛速度》美空军36页报告

专知会员服务

58+阅读 · 2023年4月24日

《联合火力自动化的效应任务优化方法》2022最新30页技术报告，加拿大国防研究与发展部

《联合火力自动化的效应任务优化方法》2022最新30页技术报告，加拿大国防研究与发展部

专知会员服务

56+阅读 · 2023年1月12日

推荐！《基于多智能体学习的任务分配动态邻域优化》2022最新41页综述论文，伦敦国王学院

推荐！《基于多智能体学习的任务分配动态邻域优化》2022最新41页综述论文，伦敦国王学院

专知会员服务

146+阅读 · 2022年11月14日

【清华大学】Delta调优:预训练语言模型参数有效方法的综合研究，Delta Tuning: A Comprehensive Study of Parameter Efficient Methods for Pre-trained Language Models

【清华大学】Delta调优:预训练语言模型参数有效方法的综合研究，Delta Tuning: A Comprehensive Study of Parameter Efficient Methods for Pre-trained Language Models

专知会员服务

26+阅读 · 2022年3月15日

【谷歌大脑新论文】利用可微摄动优化器进行学习，Learning with Differentiable Perturbed Optimizers

【谷歌大脑新论文】利用可微摄动优化器进行学习，Learning with Differentiable Perturbed Optimizers

专知会员服务

29+阅读 · 2020年2月22日

热门VIP内容

开通专知VIP会员享更多权益服务

DeepSeek-V4：百万 Token 上下文背后，大模型正在进入“长程智能”时代（附中英文pdf版）

战场之外的较量：美伊冲突中的认知战与心理博弈

【NTU博士论文】3D人体动作生成

以色列军事技术对美国军力发展的持续性赋能

相关资讯

推荐！《不确定性下的作战决策：推理、序贯和对抗性方法》美国空军293页博士论文，含代码

推荐！《不确定性下的作战决策：推理、序贯和对抗性方法》美国空军293页博士论文，含代码

专知

50+阅读 · 2022年11月16日

推荐！《基于多智能体学习的任务分配动态邻域优化》2022最新41页综述论文，伦敦国王学院

推荐！《基于多智能体学习的任务分配动态邻域优化》2022最新41页综述论文，伦敦国王学院

专知

17+阅读 · 2022年11月15日

注意力机制 | 图卷积多跳注意力机制 | Direct multi-hop Attention based GNN

注意力机制 | 图卷积多跳注意力机制 | Direct multi-hop Attention based GNN

AINLP

22+阅读 · 2020年11月29日

淘宝 at KDD 2020，提出M2GRL优化大规模推荐中的多任务多视角图表示学习

淘宝 at KDD 2020，提出M2GRL优化大规模推荐中的多任务多视角图表示学习

AINLP

23+阅读 · 2020年6月16日

AAAI 2020 | 华为：短小时序，如何预测？——基于特征重构的张量ARIMA

AAAI 2020 | 华为：短小时序，如何预测？——基于特征重构的张量ARIMA

AI科技评论

13+阅读 · 2020年2月5日

用Attention玩转CV，一文总览自注意力语义分割进展

用Attention玩转CV，一文总览自注意力语义分割进展

机器之心

14+阅读 · 2019年8月26日

分割、检测与定位，高分辨率网络显神威！这会是席卷深度学习的通用结构吗？

分割、检测与定位，高分辨率网络显神威！这会是席卷深度学习的通用结构吗？

极市平台

11+阅读 · 2019年4月17日

深度学习中Attention Mechanism详细介绍：原理、分类及应用

深度学习中Attention Mechanism详细介绍：原理、分类及应用

深度学习与NLP

10+阅读 · 2019年2月18日

时间卷积网络（TCN）将取代RNN成为NLP预测领域王者

时间卷积网络（TCN）将取代RNN成为NLP预测领域王者

AI前线

11+阅读 · 2018年5月14日

模型汇总24 - 深度学习中Attention Mechanism详细介绍：原理、分类及应用

模型汇总24 - 深度学习中Attention Mechanism详细介绍：原理、分类及应用

深度学习与NLP

12+阅读 · 2017年11月30日

相关论文

Attack-Resistant Uniform Fairness for Linear and Smooth Contextual Bandits

Arxiv

0+阅读 · 2月4日

Preemptive Scheduling for Age of Job Minimization in Task-Specific Machine Networks

Arxiv

0+阅读 · 2月2日

Age Optimal Sampling and Routing under Intermittent Links and Energy Constraints

Arxiv

0+阅读 · 1月30日

Optimal Asynchronous Stochastic Nonconvex Optimization under Heavy-Tailed Noise

Arxiv

0+阅读 · 1月27日

Tail-Latency-Aware Federated Learning with Pinching Antenna: Latency, Participation, and Placement

Arxiv

0+阅读 · 1月26日

Taming the Long-Tail: Efficient Reasoning RL Training with Adaptive Drafter

Arxiv

0+阅读 · 1月21日

Utilizing the Perceived Age to Maximize Freshness in Query-Based Update Systems

Arxiv

0+阅读 · 1月20日

Tail-Aware Density Forecasting of Locally Explosive Time Series: A Neural Network Approach

Arxiv

0+阅读 · 1月20日

Hierarchical Importance Sampling for Estimating Occupation Time for SDE Solutions

Arxiv

0+阅读 · 1月14日

TreeAdv: Tree-Structured Advantage Redistribution for Group-Based RL

Arxiv

0+阅读 · 1月7日

相关基金

网络化非线性系统的协调控制及其在分布式可重构航天器中的应用

国家自然科学基金

0+阅读 · 2015年12月31日

云计算平台中大规模交互式服务长尾延迟消减关键技术研究

国家自然科学基金

0+阅读 · 2015年12月31日

状态依赖时滞耦合拥塞控制系统的振荡与同步

国家自然科学基金

0+阅读 · 2015年12月31日

基于强化学习的分布参数系统数据驱动控制

国家自然科学基金

7+阅读 · 2015年12月31日

演化优化的自适应约束处理机理及在生化过程中的应用

国家自然科学基金

0+阅读 · 2015年12月31日

考虑外包的生产重调度问题模型与优化方法研究

国家自然科学基金

0+阅读 · 2015年12月31日

随机动态系统的风险分析及其最优控制问题

国家自然科学基金

1+阅读 · 2014年12月31日

具有服务等级的平行机在线排序问题研究

国家自然科学基金

0+阅读 · 2014年12月31日

基于神经网络和强化学习的车辆装配系统中的多载量小车实时调度方法

国家自然科学基金

4+阅读 · 2014年12月31日

机制转化下的最优停时问题研究---以金融中投资决策分析为例

国家自然科学基金

2+阅读 · 2014年12月31日

微信扫码咨询专知VIP会员