线搜索滤波微分动态规划用于非线性等式约束的最优控制 (Line-Search Filter Differential Dynamic Programming for Optimal Control with Nonlinear Equality Constraints) - 专知论文

会员服务 ·

0

等式约束 · 约束 · 滤波 · 最优 · 线搜索 ·

Line-Search Filter Differential Dynamic Programming for Optimal Control with Nonlinear Equality Constraints

翻译：线搜索滤波微分动态规划用于非线性等式约束的最优控制

Ming Xu,Stephen Gould,Iman Shames

from arxiv, Accepted for publication in the IEEE International Conference on Robotics and Automation (ICRA) 2026

We present FilterDDP, a differential dynamic programming algorithm for solving discrete-time, optimal control problems (OCPs) with nonlinear equality constraints. Unlike prior methods based on merit functions or the augmented Lagrangian class of algorithms, FilterDDP uses a step filter in conjunction with a line search to handle equality constraints. We identify two important design choices for the step filter criteria which lead to robust numerical performance: 1) we use the Lagrangian instead of the cost in the step acceptance criterion and, 2) in the backward pass, we perturb the value function Hessian. Both choices are rigorously justified, for 2) in particular by a formal proof of local quadratic convergence. In addition to providing a primal-dual interior point extension for handling OCPs with both equality and inequality constraints, we validate FilterDDP on three contact implicit trajectory optimisation problems which arise in robotics.

翻译：本文提出FilterDDP，一种用于求解带非线性等式约束的离散时间最优控制问题的微分动态规划算法。与以往基于价值函数或增广拉格朗日类算法的方法不同，FilterDDP采用步长滤波器结合线搜索来处理等式约束。我们确定了步长滤波器准则中两个关键的设计选择，以实现鲁棒的数值性能：1）在步长接受准则中使用拉格朗日函数而非成本函数；2）在后向传播中对价值函数的Hessian矩阵进行扰动。这两种选择均得到严格论证，特别是针对第2）点，我们提供了局部二次收敛性的形式化证明。除了给出处理同时包含等式与不等式约束最优控制问题的原对偶内点法扩展外，我们在机器人学中出现的三个接触隐式轨迹优化问题上验证了FilterDDP的有效性。

0

相关内容

等式约束

【博士论文】自适应、鲁棒且可扩展的贝叶斯滤波方法用于在线学习

【博士论文】自适应、鲁棒且可扩展的贝叶斯滤波方法用于在线学习

专知会员服务

10+阅读 · 2025年5月20日

【CMU博士论文】交错离散搜索与连续优化用于运动规划中的动力学运动规划

【CMU博士论文】交错离散搜索与连续优化用于运动规划中的动力学运动规划

专知会员服务

28+阅读 · 2024年11月3日

【新讲义】《非线性优化》洛桑联邦理工学院(EPFL），147页PDF

【新讲义】《非线性优化》洛桑联邦理工学院(EPFL），147页PDF

专知会员服务

32+阅读 · 2022年4月28日

【CMU-Yuejie Chi等干货书】满足低秩矩阵分解的非凸优化综述，69页pdf，Nonconvex Optimization Meets Low-Rank Matrix Factorization: An Overview

【CMU-Yuejie Chi等干货书】满足低秩矩阵分解的非凸优化综述，69页pdf，Nonconvex Optimization Meets Low-Rank Matrix Factorization: An Overview

专知会员服务

33+阅读 · 2022年3月4日

【ICML2021】在线与非随机控制，普林斯顿等教程，82页ppt

专知会员服务

21+阅读 · 2021年7月28日

【CVPR2020-中科院计算所】弱监督语义分割的自监督等价注意力机制，Self-supervised Equivariant Attention Mechanism for Weakly Supervised Semantic Segmentation

【CVPR2020-中科院计算所】弱监督语义分割的自监督等价注意力机制，Self-supervised Equivariant Attention Mechanism for Weakly Supervised Semantic Segmentation

专知会员服务

76+阅读 · 2020年4月10日

【加州大学-Liwei Wu博士论文】协同过滤与排序，Advances in Collaborative Filtering and Ranking，150页pdf

【加州大学-Liwei Wu博士论文】协同过滤与排序，Advances in Collaborative Filtering and Ranking，150页pdf

专知会员服务

32+阅读 · 2020年3月1日

【谷歌大脑新论文】利用可微摄动优化器进行学习，Learning with Differentiable Perturbed Optimizers

【谷歌大脑新论文】利用可微摄动优化器进行学习，Learning with Differentiable Perturbed Optimizers

专知会员服务

29+阅读 · 2020年2月22日

Google研究院提出FixMatch，简单粗暴却极其有效的半监督学习方法，附14页PDF下载

Google研究院提出FixMatch，简单粗暴却极其有效的半监督学习方法，附14页PDF下载

专知会员服务

54+阅读 · 2020年1月24日

【AAAI2020-清华大学】高效的异构协同过滤推荐（Efficient Heterogeneous Collaborative Filtering without Negative Sampling for Recommendation），张敏，马少平等

【AAAI2020-清华大学】高效的异构协同过滤推荐（Efficient Heterogeneous Collaborative Filtering without Negative Sampling for Recommendation），张敏，马少平等

专知会员服务

61+阅读 · 2019年11月22日

《基于近端策略优化(PPO)算法的制导弹体控制行为学习》美国陆军2022最新27页技术报告

《基于近端策略优化(PPO)算法的制导弹体控制行为学习》美国陆军2022最新27页技术报告

专知

13+阅读 · 2022年11月25日

【干货书-斯坦福】最优化算法，521页pdf，《Algorithms for Optimization》MIT出版社

【干货书-斯坦福】最优化算法，521页pdf，《Algorithms for Optimization》MIT出版社

专知

58+阅读 · 2020年7月2日

地平线提出AFDet：首个Anchor free、NMS free的3D目标检测算法

地平线提出AFDet：首个Anchor free、NMS free的3D目标检测算法

CVer

10+阅读 · 2020年6月27日

集多种半监督学习范式为一体，谷歌新研究提出新型半监督方法 MixMatch

集多种半监督学习范式为一体，谷歌新研究提出新型半监督方法 MixMatch

机器之心

11+阅读 · 2019年6月3日

北大、清华、微软联合提出RepPoints，比边界框更好用的目标检测方法

北大、清华、微软联合提出RepPoints，比边界框更好用的目标检测方法

全球人工智能

13+阅读 · 2019年4月30日

机器学习中的最优化算法总结

机器学习中的最优化算法总结

人工智能前沿讲习班

22+阅读 · 2019年3月22日

【泡泡点云时空】SpiderCNN：利用参数化卷积滤波进行点集深度学习（ECCV2018-13）

【泡泡点云时空】SpiderCNN：利用参数化卷积滤波进行点集深度学习（ECCV2018-13）

泡泡机器人SLAM

10+阅读 · 2018年11月8日

最新｜深度离散哈希算法，可用于图像检索！

最新｜深度离散哈希算法，可用于图像检索！

全球人工智能

14+阅读 · 2017年12月15日

EKF常用于目标跟踪系统的扩展卡尔曼滤波器

EKF常用于目标跟踪系统的扩展卡尔曼滤波器

无人机

10+阅读 · 2017年7月25日

论文笔记：多任务相关粒子滤波跟踪器

论文笔记：多任务相关粒子滤波跟踪器

统计学习与视觉计算组

10+阅读 · 2017年7月7日

基于动态反馈的时滞非线性系统控制理论研究

国家自然科学基金

0+阅读 · 2017年12月31日

非线性加权观测融合滤波算法及其渐近最优性研究

国家自然科学基金

0+阅读 · 2015年12月31日

非线性波前调控中的相位编码技术的研究

国家自然科学基金

0+阅读 · 2015年12月31日

线性互补约束二次规划问题的一个全局算法研究

国家自然科学基金

0+阅读 · 2015年12月31日

随机非线性量化反馈系统的自适应模糊控制研究

国家自然科学基金

0+阅读 · 2015年12月31日

基于神经网络的无约束0-1二次规划全局最优算法研究

国家自然科学基金

3+阅读 · 2015年12月31日

具摩擦非线性系统随机振动分析与最优控制

国家自然科学基金

0+阅读 · 2014年12月31日

基于动态规划粘性解及特征正交分解降维方法的偏微分方程最优控制

国家自然科学基金

0+阅读 · 2014年12月31日

非线性约束全局优化的新方法研究

国家自然科学基金

1+阅读 · 2014年12月31日

非线性对称锥规划的内点算法及在最优控制中的应用

国家自然科学基金

0+阅读 · 2014年12月31日

A Penalty Approach for Differentiation Through Black-Box Quadratic Programming Solvers

Arxiv

0+阅读 · 2月15日

Learning to Control: The iUzawa-Net for Nonsmooth Optimal Control of Linear PDEs

Arxiv

0+阅读 · 2月12日

Mixed-Density Diffuser: Efficient Planning with Non-Uniform Temporal Resolution

Arxiv

0+阅读 · 2月4日

LP-MPPI: Low-Pass Filtering for Efficient Model Predictive Path Integral Control

Arxiv

0+阅读 · 2月3日

Finite-Sample Wasserstein Error Bounds and Concentration Inequalities for Nonlinear Stochastic Approximation

Arxiv

0+阅读 · 2月2日

Offline Goal-Conditioned Reinforcement Learning with Projective Quasimetric Planning

Arxiv

0+阅读 · 1月30日

Study of Switched Step-size Based Filtered-x NLMS Algorithm for Active Noise Cancellation

Arxiv

0+阅读 · 1月23日

Designing faster mixed integer linear programming algorithm via learning the optimal path

Arxiv

0+阅读 · 1月22日

A Stabilized Hybrid Active Noise Control Algorithm of GFANC and FxNLMS with Online Clustering

Arxiv

0+阅读 · 1月22日

Differentially Private Bilevel Optimization

Arxiv

0+阅读 · 1月14日

VIP会员

文章信息

相关主题

相关VIP内容

【博士论文】自适应、鲁棒且可扩展的贝叶斯滤波方法用于在线学习

【博士论文】自适应、鲁棒且可扩展的贝叶斯滤波方法用于在线学习

专知会员服务

10+阅读 · 2025年5月20日

【CMU博士论文】交错离散搜索与连续优化用于运动规划中的动力学运动规划

【CMU博士论文】交错离散搜索与连续优化用于运动规划中的动力学运动规划

专知会员服务

28+阅读 · 2024年11月3日

【新讲义】《非线性优化》洛桑联邦理工学院(EPFL），147页PDF

【新讲义】《非线性优化》洛桑联邦理工学院(EPFL），147页PDF

专知会员服务

32+阅读 · 2022年4月28日

【CMU-Yuejie Chi等干货书】满足低秩矩阵分解的非凸优化综述，69页pdf，Nonconvex Optimization Meets Low-Rank Matrix Factorization: An Overview

【CMU-Yuejie Chi等干货书】满足低秩矩阵分解的非凸优化综述，69页pdf，Nonconvex Optimization Meets Low-Rank Matrix Factorization: An Overview

专知会员服务

33+阅读 · 2022年3月4日

【ICML2021】在线与非随机控制，普林斯顿等教程，82页ppt

专知会员服务

21+阅读 · 2021年7月28日

【CVPR2020-中科院计算所】弱监督语义分割的自监督等价注意力机制，Self-supervised Equivariant Attention Mechanism for Weakly Supervised Semantic Segmentation

【CVPR2020-中科院计算所】弱监督语义分割的自监督等价注意力机制，Self-supervised Equivariant Attention Mechanism for Weakly Supervised Semantic Segmentation

专知会员服务

76+阅读 · 2020年4月10日

【加州大学-Liwei Wu博士论文】协同过滤与排序，Advances in Collaborative Filtering and Ranking，150页pdf

【加州大学-Liwei Wu博士论文】协同过滤与排序，Advances in Collaborative Filtering and Ranking，150页pdf

专知会员服务

32+阅读 · 2020年3月1日

【谷歌大脑新论文】利用可微摄动优化器进行学习，Learning with Differentiable Perturbed Optimizers

【谷歌大脑新论文】利用可微摄动优化器进行学习，Learning with Differentiable Perturbed Optimizers

专知会员服务

29+阅读 · 2020年2月22日

Google研究院提出FixMatch，简单粗暴却极其有效的半监督学习方法，附14页PDF下载

Google研究院提出FixMatch，简单粗暴却极其有效的半监督学习方法，附14页PDF下载

专知会员服务

54+阅读 · 2020年1月24日

【AAAI2020-清华大学】高效的异构协同过滤推荐（Efficient Heterogeneous Collaborative Filtering without Negative Sampling for Recommendation），张敏，马少平等

【AAAI2020-清华大学】高效的异构协同过滤推荐（Efficient Heterogeneous Collaborative Filtering without Negative Sampling for Recommendation），张敏，马少平等

专知会员服务

61+阅读 · 2019年11月22日

热门VIP内容

开通专知VIP会员享更多权益服务

【CMU博士论文】基于自适应表征的高效视觉建模

《多域作战中融合网络、电子战与动能机动》

AI智能体时代大模型安全风险与攻防新挑战

迈向个性化大语言模型驱动的智能体：基础、评估与未来方向

相关资讯

《基于近端策略优化(PPO)算法的制导弹体控制行为学习》美国陆军2022最新27页技术报告

《基于近端策略优化(PPO)算法的制导弹体控制行为学习》美国陆军2022最新27页技术报告

专知

13+阅读 · 2022年11月25日

【干货书-斯坦福】最优化算法，521页pdf，《Algorithms for Optimization》MIT出版社

【干货书-斯坦福】最优化算法，521页pdf，《Algorithms for Optimization》MIT出版社

专知

58+阅读 · 2020年7月2日

地平线提出AFDet：首个Anchor free、NMS free的3D目标检测算法

地平线提出AFDet：首个Anchor free、NMS free的3D目标检测算法

CVer

10+阅读 · 2020年6月27日

集多种半监督学习范式为一体，谷歌新研究提出新型半监督方法 MixMatch

集多种半监督学习范式为一体，谷歌新研究提出新型半监督方法 MixMatch

机器之心

11+阅读 · 2019年6月3日

北大、清华、微软联合提出RepPoints，比边界框更好用的目标检测方法

北大、清华、微软联合提出RepPoints，比边界框更好用的目标检测方法

全球人工智能

13+阅读 · 2019年4月30日

机器学习中的最优化算法总结

机器学习中的最优化算法总结

人工智能前沿讲习班

22+阅读 · 2019年3月22日

【泡泡点云时空】SpiderCNN：利用参数化卷积滤波进行点集深度学习（ECCV2018-13）

【泡泡点云时空】SpiderCNN：利用参数化卷积滤波进行点集深度学习（ECCV2018-13）

泡泡机器人SLAM

10+阅读 · 2018年11月8日

最新｜深度离散哈希算法，可用于图像检索！

最新｜深度离散哈希算法，可用于图像检索！

全球人工智能

14+阅读 · 2017年12月15日

EKF常用于目标跟踪系统的扩展卡尔曼滤波器

EKF常用于目标跟踪系统的扩展卡尔曼滤波器

无人机

10+阅读 · 2017年7月25日

论文笔记：多任务相关粒子滤波跟踪器

论文笔记：多任务相关粒子滤波跟踪器

统计学习与视觉计算组

10+阅读 · 2017年7月7日

相关论文

A Penalty Approach for Differentiation Through Black-Box Quadratic Programming Solvers

Arxiv

0+阅读 · 2月15日

Learning to Control: The iUzawa-Net for Nonsmooth Optimal Control of Linear PDEs

Arxiv

0+阅读 · 2月12日

Mixed-Density Diffuser: Efficient Planning with Non-Uniform Temporal Resolution

Arxiv

0+阅读 · 2月4日

LP-MPPI: Low-Pass Filtering for Efficient Model Predictive Path Integral Control

Arxiv

0+阅读 · 2月3日

Finite-Sample Wasserstein Error Bounds and Concentration Inequalities for Nonlinear Stochastic Approximation

Arxiv

0+阅读 · 2月2日

Offline Goal-Conditioned Reinforcement Learning with Projective Quasimetric Planning

Arxiv

0+阅读 · 1月30日

Study of Switched Step-size Based Filtered-x NLMS Algorithm for Active Noise Cancellation

Arxiv

0+阅读 · 1月23日

Designing faster mixed integer linear programming algorithm via learning the optimal path

Arxiv

0+阅读 · 1月22日

A Stabilized Hybrid Active Noise Control Algorithm of GFANC and FxNLMS with Online Clustering

Arxiv

0+阅读 · 1月22日

Differentially Private Bilevel Optimization

Arxiv

0+阅读 · 1月14日

相关基金

基于动态反馈的时滞非线性系统控制理论研究

国家自然科学基金

0+阅读 · 2017年12月31日

非线性加权观测融合滤波算法及其渐近最优性研究

国家自然科学基金

0+阅读 · 2015年12月31日

非线性波前调控中的相位编码技术的研究

国家自然科学基金

0+阅读 · 2015年12月31日

线性互补约束二次规划问题的一个全局算法研究

国家自然科学基金

0+阅读 · 2015年12月31日

随机非线性量化反馈系统的自适应模糊控制研究

国家自然科学基金

0+阅读 · 2015年12月31日

基于神经网络的无约束0-1二次规划全局最优算法研究

国家自然科学基金

3+阅读 · 2015年12月31日

具摩擦非线性系统随机振动分析与最优控制

国家自然科学基金

0+阅读 · 2014年12月31日

基于动态规划粘性解及特征正交分解降维方法的偏微分方程最优控制

国家自然科学基金

0+阅读 · 2014年12月31日

非线性约束全局优化的新方法研究

国家自然科学基金

1+阅读 · 2014年12月31日

非线性对称锥规划的内点算法及在最优控制中的应用

国家自然科学基金

0+阅读 · 2014年12月31日

微信扫码咨询专知VIP会员