Delay-Aware Diffusion Policy: Bridging the Observation-Execution Gap in Dynamic Tasks - 专知论文

会员服务 ·

0

间隙 · 推理延迟 · 机器人 · 机器人感知 · 泛化 ·

Delay-Aware Diffusion Policy: Bridging the Observation-Execution Gap in Dynamic Tasks

翻译：延迟感知扩散策略：弥合动态任务中的观测-执行间隙

Aileen Liao,Dong-Ki Kim,Max Olan Smith,Ali-akbar Agha-mohammadi,Shayegan Omidshafiei

As a robot senses and selects actions, the world keeps changing. This inference delay creates a gap of tens to hundreds of milliseconds between the observed state and the state at execution. In this work, we take the natural generalization from zero delay to measured delay during training and inference. We introduce Delay-Aware Diffusion Policy (DA-DP), a framework for explicitly incorporating inference delays into policy learning. DA-DP corrects zero-delay trajectories to their delay-compensated counterparts, and augments the policy with delay conditioning. We empirically validate DA-DP on a variety of tasks, robots, and delays and find its success rate more robust to delay than delay-unaware methods. DA-DP is architecture agnostic and transfers beyond diffusion policies, offering a general pattern for delay-aware imitation learning. More broadly, DA-DP encourages evaluation protocols that report performance as a function of measured latency, not just task difficulty.

翻译：当机器人感知环境并选择动作时，世界始终在变化。这种推理延迟会导致观测状态与执行状态之间存在数十至数百毫秒的间隙。在本工作中，我们采取了从零延迟到训练和推理过程中可测量延迟的自然泛化方法。我们提出延迟感知扩散策略（DA-DP），这是一种将推理延迟显式纳入策略学习的框架。DA-DP将零延迟轨迹校正为其延迟补偿对应轨迹，并通过延迟条件增强策略。我们在多种任务、机器人平台和延迟设置下对DA-DP进行了实证验证，发现其成功率相比未考虑延迟的方法对延迟具有更强的鲁棒性。DA-DP具有架构无关性且可迁移至扩散策略之外，为延迟感知模仿学习提供了通用范式。更广泛而言，DA-DP鼓励采用将性能作为可测量延迟函数（而不仅是任务难度）进行报告的评估协议。

0

相关内容

[ICML 2026] 看见的还是思考的？用奖励机制区分“看错”与“想错”：视觉语言模型奖励感知

[ICML 2026] 看见的还是思考的？用奖励机制区分“看错”与“想错”：视觉语言模型奖励感知

专知会员服务

10+阅读 · 5月15日

《提升态势感知对指挥控制系统决策效能的影响分析》

《提升态势感知对指挥控制系统决策效能的影响分析》

专知会员服务

35+阅读 · 1月27日

扩散模型中的缓存方法综述：迈向高效的多模态生成

扩散模型中的缓存方法综述：迈向高效的多模态生成

专知会员服务

9+阅读 · 2025年10月23日

【ICLR2025】DynaPrompt：动态测试时提示调优

【ICLR2025】DynaPrompt：动态测试时提示调优

专知会员服务

10+阅读 · 2025年2月2日

《雷达任务调度与策略梯度强化学习：为连续观察和行动空间创建环境和智能体》最新报告

《雷达任务调度与策略梯度强化学习：为连续观察和行动空间创建环境和智能体》最新报告

专知会员服务

27+阅读 · 2025年1月22日

《基于证据推理的空间态势感知预测传感器任务分配和决策支持》200页

《基于证据推理的空间态势感知预测传感器任务分配和决策支持》200页

专知会员服务

59+阅读 · 2024年9月16日

《视距内空对空作战中遥控飞机指挥和控制延迟的影响》122页

《视距内空对空作战中遥控飞机指挥和控制延迟的影响》122页

专知会员服务

71+阅读 · 2024年3月13日

《解密基于事件的相机延迟：传感器速度取决于像素偏置、光线和空间活动》美陆军2023最新40页技术报告

《解密基于事件的相机延迟：传感器速度取决于像素偏置、光线和空间活动》美陆军2023最新40页技术报告

专知会员服务

27+阅读 · 2023年10月21日

【美国陆军·新方法加速人工智能战场决策】《深度压缩卸载：通过交易边缘计算加速神经网络推理以改善网络延迟》网络传感领域的顶级会议（2020）最佳论文奖

【美国陆军·新方法加速人工智能战场决策】《深度压缩卸载：通过交易边缘计算加速神经网络推理以改善网络延迟》网络传感领域的顶级会议（2020）最佳论文奖

专知会员服务

55+阅读 · 2022年11月1日

清华大学刘云新获MobiSys 2021 最佳论文奖：精准预测深度学习模型在边缘设备上的推理延迟

专知会员服务

33+阅读 · 2021年7月17日

《利用边缘高性能计算 (HPC) 加速战术决策过程》美国陆军，43页报告

《利用边缘高性能计算 (HPC) 加速战术决策过程》美国陆军，43页报告

专知

113+阅读 · 2023年4月5日

推荐！【DARPA终身学习机器（L2M）】《自主系统中用于感知和行动的终身学习》美空军、宾大2022最新234页技术报告

推荐！【DARPA终身学习机器（L2M）】《自主系统中用于感知和行动的终身学习》美空军、宾大2022最新234页技术报告

专知

27+阅读 · 2022年11月24日

推荐！《基于人工智能（AI）的空中和导弹防御（AMD）：以结果为导向的辅助决策》美国海军研究生院系统工程顶点报告145页

推荐！《基于人工智能（AI）的空中和导弹防御（AMD）：以结果为导向的辅助决策》美国海军研究生院系统工程顶点报告145页

专知

118+阅读 · 2022年9月1日

【UCLA】动态图表示学习，40页ppt，Dynamic Graph Representation Learning

【UCLA】动态图表示学习，40页ppt，Dynamic Graph Representation Learning

专知

27+阅读 · 2021年3月7日

一文读懂Attention机制

一文读懂Attention机制

机器学习与推荐算法

63+阅读 · 2020年6月9日

【论文笔记】具有深度注意力网络的协同Bundle（项目组合）推荐

【论文笔记】具有深度注意力网络的协同Bundle（项目组合）推荐

专知

11+阅读 · 2019年10月14日

Dropout、梯度消失/爆炸、Adam优化算法，神经网络优化算法看这一篇就够了

Dropout、梯度消失/爆炸、Adam优化算法，神经网络优化算法看这一篇就够了

AI100

14+阅读 · 2019年9月1日

利用动态深度学习预测金融时间序列基于Python

利用动态深度学习预测金融时间序列基于Python

量化投资与机器学习

18+阅读 · 2018年10月30日

【CVPR2018】如何增强Attention Model的推理能力

【CVPR2018】如何增强Attention Model的推理能力

专知

15+阅读 · 2018年7月2日

模型汇总24 - 深度学习中Attention Mechanism详细介绍：原理、分类及应用

模型汇总24 - 深度学习中Attention Mechanism详细介绍：原理、分类及应用

深度学习与NLP

12+阅读 · 2017年11月30日

基于子模优化的远程预警传感器管理研究

国家自然科学基金

2+阅读 · 2015年12月31日

基于调度协议的离散系统网络控制：时滞系统方法

国家自然科学基金

0+阅读 · 2015年12月31日

延迟偏差对高速DAC动态性能的影响及其校正技术研究

国家自然科学基金

0+阅读 · 2015年12月31日

基于低噪声全并行电荷累加方式的时间延迟积分型CMOS图像传感器设计研究

国家自然科学基金

0+阅读 · 2015年12月31日

数据中心网络中延时敏感的传输控制协议

国家自然科学基金

0+阅读 · 2015年12月31日

数据中心延迟敏感型应用尾端响应时延服务质量保障方法研究

国家自然科学基金

0+阅读 · 2015年12月31日

延迟容忍网络中自适应社会感知路由研究

国家自然科学基金

0+阅读 · 2015年12月31日

行政区划调整对城市蔓延的影响机理—基于空间互动的视角

国家自然科学基金

0+阅读 · 2015年12月31日

扩散过程离散化形式下的若干统计问题的大偏差原理

国家自然科学基金

0+阅读 · 2014年12月31日

随机延迟微分方程数值解的延迟依赖稳定性及自适应技术

国家自然科学基金

0+阅读 · 2014年12月31日

Align then Adapt: Rethinking Parameter-Efficient Transfer Learning in 4D Perception

Arxiv

0+阅读 · 4月28日

VADF: Vision-Adaptive Diffusion Policy Framework for Efficient Robotic Manipulation

Arxiv

0+阅读 · 4月17日

Beyond Augmented-Action Surrogates for Multi-Expert Learning-to-Defer

Arxiv

0+阅读 · 4月17日

Evidence Sufficiency Under Delayed Ground Truth: Proxy Monitoring for Risk Decision Systems

Arxiv

0+阅读 · 4月17日

Beyond Augmented-Action Surrogates for Multi-Expert Learning-to-Defer

Arxiv

0+阅读 · 4月10日

Multi-View Video Diffusion Policy: A 3D Spatio-Temporal-Aware Video Action Model

Arxiv

0+阅读 · 4月3日

DeDelayed: Deleting Remote Inference Delay via On-Device Correction

Arxiv

0+阅读 · 4月2日

Beyond Attention Magnitude: Leveraging Inter-layer Rank Consistency for Efficient Vision-Language-Action Models

Arxiv

0+阅读 · 3月26日

ReMAP-DP: Reprojected Multi-view Aligned PointMaps for Diffusion Policy

Arxiv

0+阅读 · 3月20日

Learning-to-Defer with Expert-Conditioned Advice

Arxiv

0+阅读 · 3月19日

VIP会员

文章信息

相关主题

机器人感知

最新内容

ICML 2026 | CFPO：用反事实策略优化提升多模态推理

ICML 2026 | CFPO：用反事实策略优化提升多模态推理

专知会员服务

1+阅读 · 今天14:45

综述 | 世界动作模型：少做梦，多行动

综述 | 世界动作模型：少做梦，多行动

专知会员服务

1+阅读 · 今天14:43

美以伊冲突：无人机与人工智能的运用

美以伊冲突：无人机与人工智能的运用

专知会员服务

4+阅读 · 今天14:31

《战时图神经网络：整合以色列-伊朗冲突中的网络安全与无人机智能》最新50页文献

《战时图神经网络：整合以色列-伊朗冲突中的网络安全与无人机智能》最新50页文献

专知会员服务

3+阅读 · 今天14:20

《特种部队在透明战场中的生存力》最新报告

《特种部队在透明战场中的生存力》最新报告

专知会员服务

2+阅读 · 今天14:11

《自主无人机蜂群协同与控制系统：人工智能赋能的战场协同与自主任务编排平台》

《自主无人机蜂群协同与控制系统：人工智能赋能的战场协同与自主任务编排平台》

专知会员服务

3+阅读 · 今天14:07

《人工智能生成的零日漏洞：对未来作战的影响》

《人工智能生成的零日漏洞：对未来作战的影响》

专知会员服务

3+阅读 · 今天14:03

《理解伙伴国在防务能力选择中的偏好：探索美国解决方案的替代选择》美智库200页报告

《理解伙伴国在防务能力选择中的偏好：探索美国解决方案的替代选择》美智库200页报告

专知会员服务

2+阅读 · 今天13:59

ICML 2026 | 边界嵌入塑形：用自适应对比学习破解图结构纠缠

ICML 2026 | 边界嵌入塑形：用自适应对比学习破解图结构纠缠

专知会员服务

5+阅读 · 6月22日

综述 | 3D场景图：开放挑战与未来方向

综述 | 3D场景图：开放挑战与未来方向

专知会员服务

8+阅读 · 6月22日

《国防工业6.0：全自主作战系统、量子-人工智能融合与新一代战略威慑》

《国防工业6.0：全自主作战系统、量子-人工智能融合与新一代战略威慑》

专知会员服务

7+阅读 · 6月22日

21世纪的无人机战争

21世纪的无人机战争

专知会员服务

4+阅读 · 6月22日

《伊朗与以色列-美国热战及其对数字技术的影响》

《伊朗与以色列-美国热战及其对数字技术的影响》

专知会员服务

5+阅读 · 6月22日

《量子技术的军事任务技术适配与利用》

《量子技术的军事任务技术适配与利用》

专知会员服务

5+阅读 · 6月22日

《美国陆军军官学校（西点军校）本科生科研中生成式人工智能的使用》

《美国陆军军官学校（西点军校）本科生科研中生成式人工智能的使用》

专知会员服务

8+阅读 · 6月22日

相关VIP内容

[ICML 2026] 看见的还是思考的？用奖励机制区分“看错”与“想错”：视觉语言模型奖励感知

[ICML 2026] 看见的还是思考的？用奖励机制区分“看错”与“想错”：视觉语言模型奖励感知

专知会员服务

10+阅读 · 5月15日

《提升态势感知对指挥控制系统决策效能的影响分析》

《提升态势感知对指挥控制系统决策效能的影响分析》

专知会员服务

35+阅读 · 1月27日

扩散模型中的缓存方法综述：迈向高效的多模态生成

扩散模型中的缓存方法综述：迈向高效的多模态生成

专知会员服务

9+阅读 · 2025年10月23日

【ICLR2025】DynaPrompt：动态测试时提示调优

【ICLR2025】DynaPrompt：动态测试时提示调优

专知会员服务

10+阅读 · 2025年2月2日

《雷达任务调度与策略梯度强化学习：为连续观察和行动空间创建环境和智能体》最新报告

《雷达任务调度与策略梯度强化学习：为连续观察和行动空间创建环境和智能体》最新报告

专知会员服务

27+阅读 · 2025年1月22日

《基于证据推理的空间态势感知预测传感器任务分配和决策支持》200页

《基于证据推理的空间态势感知预测传感器任务分配和决策支持》200页

专知会员服务

59+阅读 · 2024年9月16日

《视距内空对空作战中遥控飞机指挥和控制延迟的影响》122页

《视距内空对空作战中遥控飞机指挥和控制延迟的影响》122页

专知会员服务

71+阅读 · 2024年3月13日

《解密基于事件的相机延迟：传感器速度取决于像素偏置、光线和空间活动》美陆军2023最新40页技术报告

《解密基于事件的相机延迟：传感器速度取决于像素偏置、光线和空间活动》美陆军2023最新40页技术报告

专知会员服务

27+阅读 · 2023年10月21日

【美国陆军·新方法加速人工智能战场决策】《深度压缩卸载：通过交易边缘计算加速神经网络推理以改善网络延迟》网络传感领域的顶级会议（2020）最佳论文奖

【美国陆军·新方法加速人工智能战场决策】《深度压缩卸载：通过交易边缘计算加速神经网络推理以改善网络延迟》网络传感领域的顶级会议（2020）最佳论文奖

专知会员服务

55+阅读 · 2022年11月1日

清华大学刘云新获MobiSys 2021 最佳论文奖：精准预测深度学习模型在边缘设备上的推理延迟

专知会员服务

33+阅读 · 2021年7月17日

热门VIP内容

开通专知VIP会员享更多权益服务

综述 | 世界动作模型：少做梦，多行动

《战时图神经网络：整合以色列-伊朗冲突中的网络安全与无人机智能》最新50页文献

ICML 2026 | CFPO：用反事实策略优化提升多模态推理

美以伊冲突：无人机与人工智能的运用

相关资讯

《利用边缘高性能计算 (HPC) 加速战术决策过程》美国陆军，43页报告

《利用边缘高性能计算 (HPC) 加速战术决策过程》美国陆军，43页报告

专知

113+阅读 · 2023年4月5日

推荐！【DARPA终身学习机器（L2M）】《自主系统中用于感知和行动的终身学习》美空军、宾大2022最新234页技术报告

推荐！【DARPA终身学习机器（L2M）】《自主系统中用于感知和行动的终身学习》美空军、宾大2022最新234页技术报告

专知

27+阅读 · 2022年11月24日

推荐！《基于人工智能（AI）的空中和导弹防御（AMD）：以结果为导向的辅助决策》美国海军研究生院系统工程顶点报告145页

推荐！《基于人工智能（AI）的空中和导弹防御（AMD）：以结果为导向的辅助决策》美国海军研究生院系统工程顶点报告145页

专知

118+阅读 · 2022年9月1日

【UCLA】动态图表示学习，40页ppt，Dynamic Graph Representation Learning

【UCLA】动态图表示学习，40页ppt，Dynamic Graph Representation Learning

专知

27+阅读 · 2021年3月7日

一文读懂Attention机制

一文读懂Attention机制

机器学习与推荐算法

63+阅读 · 2020年6月9日

【论文笔记】具有深度注意力网络的协同Bundle（项目组合）推荐

【论文笔记】具有深度注意力网络的协同Bundle（项目组合）推荐

专知

11+阅读 · 2019年10月14日

Dropout、梯度消失/爆炸、Adam优化算法，神经网络优化算法看这一篇就够了

Dropout、梯度消失/爆炸、Adam优化算法，神经网络优化算法看这一篇就够了

AI100

14+阅读 · 2019年9月1日

利用动态深度学习预测金融时间序列基于Python

利用动态深度学习预测金融时间序列基于Python

量化投资与机器学习

18+阅读 · 2018年10月30日

【CVPR2018】如何增强Attention Model的推理能力

【CVPR2018】如何增强Attention Model的推理能力

专知

15+阅读 · 2018年7月2日

模型汇总24 - 深度学习中Attention Mechanism详细介绍：原理、分类及应用

模型汇总24 - 深度学习中Attention Mechanism详细介绍：原理、分类及应用

深度学习与NLP

12+阅读 · 2017年11月30日

相关论文

Align then Adapt: Rethinking Parameter-Efficient Transfer Learning in 4D Perception

Arxiv

0+阅读 · 4月28日

VADF: Vision-Adaptive Diffusion Policy Framework for Efficient Robotic Manipulation

Arxiv

0+阅读 · 4月17日

Beyond Augmented-Action Surrogates for Multi-Expert Learning-to-Defer

Arxiv

0+阅读 · 4月17日

Evidence Sufficiency Under Delayed Ground Truth: Proxy Monitoring for Risk Decision Systems

Arxiv

0+阅读 · 4月17日

Beyond Augmented-Action Surrogates for Multi-Expert Learning-to-Defer

Arxiv

0+阅读 · 4月10日

Multi-View Video Diffusion Policy: A 3D Spatio-Temporal-Aware Video Action Model

Arxiv

0+阅读 · 4月3日

DeDelayed: Deleting Remote Inference Delay via On-Device Correction

Arxiv

0+阅读 · 4月2日

Beyond Attention Magnitude: Leveraging Inter-layer Rank Consistency for Efficient Vision-Language-Action Models

Arxiv

0+阅读 · 3月26日

ReMAP-DP: Reprojected Multi-view Aligned PointMaps for Diffusion Policy

Arxiv

0+阅读 · 3月20日

Learning-to-Defer with Expert-Conditioned Advice

Arxiv

0+阅读 · 3月19日

相关基金

基于子模优化的远程预警传感器管理研究

国家自然科学基金

2+阅读 · 2015年12月31日

基于调度协议的离散系统网络控制：时滞系统方法

国家自然科学基金

0+阅读 · 2015年12月31日

延迟偏差对高速DAC动态性能的影响及其校正技术研究

国家自然科学基金

0+阅读 · 2015年12月31日

基于低噪声全并行电荷累加方式的时间延迟积分型CMOS图像传感器设计研究

国家自然科学基金

0+阅读 · 2015年12月31日

数据中心网络中延时敏感的传输控制协议

国家自然科学基金

0+阅读 · 2015年12月31日

数据中心延迟敏感型应用尾端响应时延服务质量保障方法研究

国家自然科学基金

0+阅读 · 2015年12月31日

延迟容忍网络中自适应社会感知路由研究

国家自然科学基金

0+阅读 · 2015年12月31日

行政区划调整对城市蔓延的影响机理—基于空间互动的视角

国家自然科学基金

0+阅读 · 2015年12月31日

扩散过程离散化形式下的若干统计问题的大偏差原理

国家自然科学基金

0+阅读 · 2014年12月31日

随机延迟微分方程数值解的延迟依赖稳定性及自适应技术

国家自然科学基金

0+阅读 · 2014年12月31日

微信扫码咨询专知VIP会员