Drift-to-Action Controllers: Budgeted Interventions with Online Risk Certificates - 专知论文

会员服务 ·

0

控制器 · 标注 · 在线 · 约束 · 系统 ·

Drift-to-Action Controllers: Budgeted Interventions with Online Risk Certificates

翻译：漂移至行动控制器：具有在线风险证书的预算干预

Ismail Lamaakal,Chaymae Yahyati,Khalid El Makkaoui,Ibrahim Ouahbi,Yassine Maleh

from arxiv, Published as a conference paper at CAO Workshop at ICLR 2026

Deployed machine learning systems face distribution drift, yet most monitoring pipelines stop at alarms and leave the response underspecified under labeling, compute, and latency constraints. We introduce Drift2Act, a drift-to-action controller that treats monitoring as constrained decision-making with explicit safety. Drift2Act combines a sensing layer that maps unlabeled monitoring signals to a belief over drift types with an active risk certificate that queries a small set of delayed labels from a recent window to produce an anytime-valid upper bound $U_t(δ)$ on current risk. The certificate gates operation: if $U_t(δ) \le τ$, the controller selects low-cost actions (e.g., recalibration or test-time adaptation); if $U_t(δ) > τ$, it activates abstain/handoff and escalates to rollback or retraining under cooldowns. In a realistic streaming protocol with label delay and explicit intervention costs, Drift2Act achieves near-zero safety violations and fast recovery at moderate cost on WILDS Camelyon17, DomainNet, and a controlled synthetic drift stream, outperforming alarm-only monitoring, adapt-always adaptation, schedule-based retraining, selective prediction alone, and an ablation without certification. Overall, online risk certification enables reliable drift response and reframes monitoring as decision-making with safety.

翻译：已部署的机器学习系统面临分布漂移，然而大多数监控流程仅止于发出警报，且在标注、计算和延迟约束下，其响应措施往往未明确指定。我们提出Drift2Act，一种漂移至行动控制器，它将监控视为具有明确安全性的约束决策问题。Drift2Act结合了一个感知层——将未标注的监控信号映射到关于漂移类型的信念，以及一个主动风险证书——从最近的时间窗口查询少量延迟标注，以生成当前风险的一个任意时间有效的上界$U_t(δ)$。该证书控制操作：若$U_t(δ) \le τ$，控制器选择低成本行动（例如重新校准或测试时适应）；若$U_t(δ) > τ$，则启动弃权/移交机制，并在冷却期下升级至回滚或重新训练。在一个具有标注延迟和明确干预成本的现实流式协议中，Drift2Act在WILDS Camelyon17、DomainNet以及一个受控的合成漂移流上，以适中成本实现了近乎零的安全违规和快速恢复，其性能优于仅报警监控、始终适应策略、基于计划的重新训练、单独的选择性预测以及一个无证书的消融实验。总体而言，在线风险认证实现了可靠的漂移响应，并将监控重新定义为具有安全性的决策过程。

0

相关内容

控制器

《基于大语言模型的避障决策和自主水面航行器控制》

《基于大语言模型的避障决策和自主水面航行器控制》

专知会员服务

35+阅读 · 2024年12月5日

【牛津大学博士论文】面向对象的生成模型在机器人感知与行动中的应用，148页pdf

【牛津大学博士论文】面向对象的生成模型在机器人感知与行动中的应用，148页pdf

专知会员服务

22+阅读 · 2024年2月13日

《实现网络防御态势感知能力的决策支持要素和使能技术》2023最新博士论文

《实现网络防御态势感知能力的决策支持要素和使能技术》2023最新博士论文

专知会员服务

41+阅读 · 2023年11月15日

【ICML2023】BLIP-2:基于冻结图像编码器和大型语言模型的Bootstrapping语言-图像预训练

【ICML2023】BLIP-2:基于冻结图像编码器和大型语言模型的Bootstrapping语言-图像预训练

专知会员服务

30+阅读 · 2023年5月1日

《使用生成对抗式模仿学习（GAIL）预测认知发射器行为》认知雷达论文 | 美海军

《使用生成对抗式模仿学习（GAIL）预测认知发射器行为》认知雷达论文 | 美海军

专知会员服务

37+阅读 · 2023年2月8日

《通过强化训练改善漂移——惯性传感器》2022最新64页技术报告，美太平洋海军信息战中心

《通过强化训练改善漂移——惯性传感器》2022最新64页技术报告，美太平洋海军信息战中心

专知会员服务

26+阅读 · 2022年11月23日

【ICML2022】CtrlFormer: 通过Transformer学习视觉控制的可迁移状态表示

【ICML2022】CtrlFormer: 通过Transformer学习视觉控制的可迁移状态表示

专知会员服务

16+阅读 · 2022年6月21日

《使用模型预测控制和博弈论方法的移动机器人实时控制》140页博士论文

《使用模型预测控制和博弈论方法的移动机器人实时控制》140页博士论文

专知会员服务

56+阅读 · 2022年6月16日

中文版《实现联合全域指挥与控制的JADC2基本指南》11页slides，Splunk公司产品助力JADC2实施

中文版《实现联合全域指挥与控制的JADC2基本指南》11页slides，Splunk公司产品助力JADC2实施

专知会员服务

147+阅读 · 2022年6月1日

【AAAI 2022】基于数据分布生成的可预测概念漂移适应

【AAAI 2022】基于数据分布生成的可预测概念漂移适应

专知会员服务

34+阅读 · 2022年1月12日

推荐！【DARPA终身学习机器（L2M）】《自主系统中用于感知和行动的终身学习》美空军、宾大2022最新234页技术报告

推荐！【DARPA终身学习机器（L2M）】《自主系统中用于感知和行动的终身学习》美空军、宾大2022最新234页技术报告

专知

27+阅读 · 2022年11月24日

【JADC2指南】《实现联合全域指挥与控制的JADC2基本指南》11页slides，Splunk公司产品助力JADC2实施

【JADC2指南】《实现联合全域指挥与控制的JADC2基本指南》11页slides，Splunk公司产品助力JADC2实施

专知

23+阅读 · 2022年6月3日

美国兰德提出《在联合全域指挥控制中发展人工智能的路径》报告

美国兰德提出《在联合全域指挥控制中发展人工智能的路径》报告

专知

77+阅读 · 2022年4月20日

美国「联合全域指挥与控制 (JADC2)」战略发展最新总结报告，12页pdf

美国「联合全域指挥与控制 (JADC2)」战略发展最新总结报告，12页pdf

专知

186+阅读 · 2022年3月23日

【泡泡图灵智库】Detect-SLAM：目标检测和SLAM相互收益

【泡泡图灵智库】Detect-SLAM：目标检测和SLAM相互收益

泡泡机器人SLAM

14+阅读 · 2019年6月28日

【泡泡读者来搞】ROS、Simulink、Carsim的互联与规划、控制算法的验证

【泡泡读者来搞】ROS、Simulink、Carsim的互联与规划、控制算法的验证

泡泡机器人SLAM

17+阅读 · 2019年5月1日

加入Transformer-XL，这个PyTorch包能调用各种NLP预训练模型

加入Transformer-XL，这个PyTorch包能调用各种NLP预训练模型

机器之心

15+阅读 · 2019年2月13日

pytorch-pretrained-BERT：BERT PyTorch实现，可加载Google BERT预训练模型

pytorch-pretrained-BERT：BERT PyTorch实现，可加载Google BERT预训练模型

AINLP

35+阅读 · 2018年11月6日

推荐系统、风控模型、知识图谱，竟然都可以用网络挖掘来实现

推荐系统、风控模型、知识图谱，竟然都可以用网络挖掘来实现

数据分析

13+阅读 · 2018年8月15日

【论文推荐】最新5篇目标跟踪（Object Tracking）相关论文—并行跟踪和验证、光流、自动跟踪、相关滤波集成、CFNet

【论文推荐】最新5篇目标跟踪（Object Tracking）相关论文—并行跟踪和验证、光流、自动跟踪、相关滤波集成、CFNet

专知

25+阅读 · 2018年2月6日

基于无线传感器网络的风电场在线监测和动态风速预测

国家自然科学基金

0+阅读 · 2015年12月31日

支持智能终端通信的物联网管控机制研究

国家自然科学基金

2+阅读 · 2015年12月31日

基于子模优化的远程预警传感器管理研究

国家自然科学基金

2+阅读 · 2015年12月31日

基于控制器动态线性化的数据驱动控制方法及在精馏过程的应用

国家自然科学基金

1+阅读 · 2015年12月31日

面向估计性能优化的网络化控制系统传感器调度

国家自然科学基金

0+阅读 · 2015年12月31日

动态不确定性条件下基于混杂约束满足问题的水下移动传感器网络节点自定位方法研究

国家自然科学基金

3+阅读 · 2015年12月31日

基于调度协议的离散系统网络控制：时滞系统方法

国家自然科学基金

0+阅读 · 2015年12月31日

基于多源证据的繁忙水域交管雷达异常目标识别方法研究

国家自然科学基金

0+阅读 · 2015年12月31日

航空发动机分布式控制系统传感器故障在线检测与解析重构算法研究

国家自然科学基金

0+阅读 · 2015年12月31日

基于物联网的滑坡灾害应急预案仿真研究

国家自然科学基金

1+阅读 · 2014年12月31日

Sliding Mode Control for Safe Trajectory Tracking with Moving Obstacles Avoidance: Experimental Validation on Planar Robots

Arxiv

0+阅读 · 4月27日

SafeMind: A Risk-Aware Differentiable Control Framework for Adaptive and Safe Quadruped Locomotion

Arxiv

0+阅读 · 4月10日

Drift-Aware Online Dynamic Learning for Nonstationary Multivariate Time Series: Application to Sintering Quality Prediction

Arxiv

0+阅读 · 4月10日

DRIFT: Harnessing Inherent Fault Tolerance for Efficient and Reliable Diffusion Model Inference

Arxiv

0+阅读 · 4月10日

Drift-Based Policy Optimization: Native One-Step Policy Learning for Online Robot Control

Arxiv

0+阅读 · 4月9日

SafetyDrift: Predicting When AI Agents Cross the Line Before They Actually Do

Arxiv

0+阅读 · 3月28日

DriftGuard: Mitigating Asynchronous Data Drift in Federated Learning

Arxiv

0+阅读 · 3月19日

SaferPath: Hierarchical Visual Navigation with Learned Guidance and Safety-Constrained Control

Arxiv

0+阅读 · 3月2日

Drift Localization using Conformal Predictions

Arxiv

0+阅读 · 2月23日

DriftLite: Lightweight Drift Control for Inference-Time Scaling of Diffusion Models

Arxiv

0+阅读 · 2月21日

VIP会员

文章信息

相关主题

最新内容

深入Project Maven：为何人工智能在战场上依然失灵

深入Project Maven：为何人工智能在战场上依然失灵

专知会员服务

12+阅读 · 7月19日

锻造未来士兵：外骨骼、基因工程与赛博格

锻造未来士兵：外骨骼、基因工程与赛博格

专知会员服务

7+阅读 · 7月19日

《无人机系统（UAS）通信网状网络试验性部署》50页报告

《无人机系统（UAS）通信网状网络试验性部署》50页报告

专知会员服务

6+阅读 · 7月19日

《无人机蜂群通信技术研究》50页

《无人机蜂群通信技术研究》50页

专知会员服务

7+阅读 · 7月19日

《基于智能体建模与仿真的无人机蜂群模型目标定位涌现行为比较分析》360页

《基于智能体建模与仿真的无人机蜂群模型目标定位涌现行为比较分析》360页

专知会员服务

10+阅读 · 7月18日

欧洲智能弹药战略创新管理：迈向制导弹药、巡飞系统与自主无人机蜂群的技术主权研究路线图

欧洲智能弹药战略创新管理：迈向制导弹药、巡飞系统与自主无人机蜂群的技术主权研究路线图

专知会员服务

8+阅读 · 7月18日

从领域适配到部署与可解释：Berkeley博士论文解析大语言模型真实落地

从领域适配到部署与可解释：Berkeley博士论文解析大语言模型真实落地

专知会员服务

13+阅读 · 7月18日

综述 | 长程智能体研究全景：基础、演化、框架、优化与前沿

综述 | 长程智能体研究全景：基础、演化、框架、优化与前沿

专知会员服务

9+阅读 · 7月18日

DARPA拟打造十万规模自主思考作战的AI智能体集群：“受控涌现式分布式人工智能”（DICE）项目

DARPA拟打造十万规模自主思考作战的AI智能体集群：“受控涌现式分布式人工智能”（DICE）项目

专知会员服务

10+阅读 · 7月17日

《边缘端实时无线感知赋能现场多机器人部署》200页

《边缘端实时无线感知赋能现场多机器人部署》200页

专知会员服务

10+阅读 · 7月17日

战力倍增器：自主武器系统与乌克兰及加沙冲突

战力倍增器：自主武器系统与乌克兰及加沙冲突

专知会员服务

6+阅读 · 7月17日

人工智能赋能战场情报：提速决策进程

人工智能赋能战场情报：提速决策进程

专知会员服务

6+阅读 · 7月17日

《拥抱新兴技术：面向未来军官的教育革新》

《拥抱新兴技术：面向未来军官的教育革新》

专知会员服务

8+阅读 · 7月17日

ACM MM 2026 | MAR-GRPO：稳定混合图像生成的强化学习训练

ACM MM 2026 | MAR-GRPO：稳定混合图像生成的强化学习训练

专知会员服务

6+阅读 · 7月17日

综述 | 大模型水印理论与部署：来源追踪、攻击鲁棒与可信治理

综述 | 大模型水印理论与部署：来源追踪、攻击鲁棒与可信治理

专知会员服务

7+阅读 · 7月17日

相关VIP内容

《基于大语言模型的避障决策和自主水面航行器控制》

《基于大语言模型的避障决策和自主水面航行器控制》

专知会员服务

35+阅读 · 2024年12月5日

【牛津大学博士论文】面向对象的生成模型在机器人感知与行动中的应用，148页pdf

【牛津大学博士论文】面向对象的生成模型在机器人感知与行动中的应用，148页pdf

专知会员服务

22+阅读 · 2024年2月13日

《实现网络防御态势感知能力的决策支持要素和使能技术》2023最新博士论文

《实现网络防御态势感知能力的决策支持要素和使能技术》2023最新博士论文

专知会员服务

41+阅读 · 2023年11月15日

【ICML2023】BLIP-2:基于冻结图像编码器和大型语言模型的Bootstrapping语言-图像预训练

【ICML2023】BLIP-2:基于冻结图像编码器和大型语言模型的Bootstrapping语言-图像预训练

专知会员服务

30+阅读 · 2023年5月1日

《使用生成对抗式模仿学习（GAIL）预测认知发射器行为》认知雷达论文 | 美海军

《使用生成对抗式模仿学习（GAIL）预测认知发射器行为》认知雷达论文 | 美海军

专知会员服务

37+阅读 · 2023年2月8日

《通过强化训练改善漂移——惯性传感器》2022最新64页技术报告，美太平洋海军信息战中心

《通过强化训练改善漂移——惯性传感器》2022最新64页技术报告，美太平洋海军信息战中心

专知会员服务

26+阅读 · 2022年11月23日

【ICML2022】CtrlFormer: 通过Transformer学习视觉控制的可迁移状态表示

【ICML2022】CtrlFormer: 通过Transformer学习视觉控制的可迁移状态表示

专知会员服务

16+阅读 · 2022年6月21日

《使用模型预测控制和博弈论方法的移动机器人实时控制》140页博士论文

《使用模型预测控制和博弈论方法的移动机器人实时控制》140页博士论文

专知会员服务

56+阅读 · 2022年6月16日

中文版《实现联合全域指挥与控制的JADC2基本指南》11页slides，Splunk公司产品助力JADC2实施

中文版《实现联合全域指挥与控制的JADC2基本指南》11页slides，Splunk公司产品助力JADC2实施

专知会员服务

147+阅读 · 2022年6月1日

【AAAI 2022】基于数据分布生成的可预测概念漂移适应

【AAAI 2022】基于数据分布生成的可预测概念漂移适应

专知会员服务

34+阅读 · 2022年1月12日

热门VIP内容

开通专知VIP会员享更多权益服务

锻造未来士兵：外骨骼、基因工程与赛博格

《无人机蜂群通信技术研究》50页

深入Project Maven：为何人工智能在战场上依然失灵

《无人机系统（UAS）通信网状网络试验性部署》50页报告

相关资讯

推荐！【DARPA终身学习机器（L2M）】《自主系统中用于感知和行动的终身学习》美空军、宾大2022最新234页技术报告

推荐！【DARPA终身学习机器（L2M）】《自主系统中用于感知和行动的终身学习》美空军、宾大2022最新234页技术报告

专知

27+阅读 · 2022年11月24日

【JADC2指南】《实现联合全域指挥与控制的JADC2基本指南》11页slides，Splunk公司产品助力JADC2实施

【JADC2指南】《实现联合全域指挥与控制的JADC2基本指南》11页slides，Splunk公司产品助力JADC2实施

专知

23+阅读 · 2022年6月3日

美国兰德提出《在联合全域指挥控制中发展人工智能的路径》报告

美国兰德提出《在联合全域指挥控制中发展人工智能的路径》报告

专知

77+阅读 · 2022年4月20日

美国「联合全域指挥与控制 (JADC2)」战略发展最新总结报告，12页pdf

美国「联合全域指挥与控制 (JADC2)」战略发展最新总结报告，12页pdf

专知

186+阅读 · 2022年3月23日

【泡泡图灵智库】Detect-SLAM：目标检测和SLAM相互收益

【泡泡图灵智库】Detect-SLAM：目标检测和SLAM相互收益

泡泡机器人SLAM

14+阅读 · 2019年6月28日

【泡泡读者来搞】ROS、Simulink、Carsim的互联与规划、控制算法的验证

【泡泡读者来搞】ROS、Simulink、Carsim的互联与规划、控制算法的验证

泡泡机器人SLAM

17+阅读 · 2019年5月1日

加入Transformer-XL，这个PyTorch包能调用各种NLP预训练模型

加入Transformer-XL，这个PyTorch包能调用各种NLP预训练模型

机器之心

15+阅读 · 2019年2月13日

pytorch-pretrained-BERT：BERT PyTorch实现，可加载Google BERT预训练模型

pytorch-pretrained-BERT：BERT PyTorch实现，可加载Google BERT预训练模型

AINLP

35+阅读 · 2018年11月6日

推荐系统、风控模型、知识图谱，竟然都可以用网络挖掘来实现

推荐系统、风控模型、知识图谱，竟然都可以用网络挖掘来实现

数据分析

13+阅读 · 2018年8月15日

【论文推荐】最新5篇目标跟踪（Object Tracking）相关论文—并行跟踪和验证、光流、自动跟踪、相关滤波集成、CFNet

【论文推荐】最新5篇目标跟踪（Object Tracking）相关论文—并行跟踪和验证、光流、自动跟踪、相关滤波集成、CFNet

专知

25+阅读 · 2018年2月6日

相关论文

Sliding Mode Control for Safe Trajectory Tracking with Moving Obstacles Avoidance: Experimental Validation on Planar Robots

Arxiv

0+阅读 · 4月27日

SafeMind: A Risk-Aware Differentiable Control Framework for Adaptive and Safe Quadruped Locomotion

Arxiv

0+阅读 · 4月10日

Drift-Aware Online Dynamic Learning for Nonstationary Multivariate Time Series: Application to Sintering Quality Prediction

Arxiv

0+阅读 · 4月10日

DRIFT: Harnessing Inherent Fault Tolerance for Efficient and Reliable Diffusion Model Inference

Arxiv

0+阅读 · 4月10日

Drift-Based Policy Optimization: Native One-Step Policy Learning for Online Robot Control

Arxiv

0+阅读 · 4月9日

SafetyDrift: Predicting When AI Agents Cross the Line Before They Actually Do

Arxiv

0+阅读 · 3月28日

DriftGuard: Mitigating Asynchronous Data Drift in Federated Learning

Arxiv

0+阅读 · 3月19日

SaferPath: Hierarchical Visual Navigation with Learned Guidance and Safety-Constrained Control

Arxiv

0+阅读 · 3月2日

Drift Localization using Conformal Predictions

Arxiv

0+阅读 · 2月23日

DriftLite: Lightweight Drift Control for Inference-Time Scaling of Diffusion Models

Arxiv

0+阅读 · 2月21日

相关基金

基于无线传感器网络的风电场在线监测和动态风速预测

国家自然科学基金

0+阅读 · 2015年12月31日

支持智能终端通信的物联网管控机制研究

国家自然科学基金

2+阅读 · 2015年12月31日

基于子模优化的远程预警传感器管理研究

国家自然科学基金

2+阅读 · 2015年12月31日

基于控制器动态线性化的数据驱动控制方法及在精馏过程的应用

国家自然科学基金

1+阅读 · 2015年12月31日

面向估计性能优化的网络化控制系统传感器调度

国家自然科学基金

0+阅读 · 2015年12月31日

动态不确定性条件下基于混杂约束满足问题的水下移动传感器网络节点自定位方法研究

国家自然科学基金

3+阅读 · 2015年12月31日

基于调度协议的离散系统网络控制：时滞系统方法

国家自然科学基金

0+阅读 · 2015年12月31日

基于多源证据的繁忙水域交管雷达异常目标识别方法研究

国家自然科学基金

0+阅读 · 2015年12月31日

航空发动机分布式控制系统传感器故障在线检测与解析重构算法研究

国家自然科学基金

0+阅读 · 2015年12月31日

基于物联网的滑坡灾害应急预案仿真研究

国家自然科学基金

1+阅读 · 2014年12月31日

微信扫码咨询专知VIP会员