Mitigating Implicit Inconsistencies in Patch Porting - 专知论文

会员服务 ·

0

Mitigating Implicit Inconsistencies in Patch Porting

翻译：缓解补丁移植中的隐式不一致性

Shengyi Pan,Zhongxin Liu,Jiayuan Zhou,Xing Hu,Xin Xia,Shanping Li

Promptly porting patches from a source codebase to its variants (e.g., forks and branches) is essential for mitigating propagated defects and vulnerabilities. Recent studies have explored automated patch porting to reduce manual effort and delay, but existing approaches mainly handle inconsistencies visible in a patch's local context and struggle with those requiring global mapping knowledge between codebases. We refer to such non-local inconsistencies as implicit inconsistencies. Implicit inconsistencies pose greater challenges for developers to resolve due to their non-local nature. To address them, we propose MIP, which enables collaboration among an LLM, a compiler, and code analysis utilities. MIP adopts different strategies for different cases: when source identifiers exist in the target codebase, it leverages compiler diagnostics; otherwise, it retrieves matched code segment pairs from the two codebases as mapping knowledge for mitigation. Experiments on two representative scenarios, cross-fork and cross-branch patch porting, show that MIP successfully resolves more than twice as many patches as the best-performing baseline in both settings. A user study with our industry partner further demonstrates its practical effectiveness.

翻译：及时将补丁从源代码库移植到其变体（如分支和派生版本）对于减轻传播的缺陷和漏洞至关重要。近期研究探索了自动化补丁移植以减少人工成本和延迟，但现有方法主要处理补丁局部上下文中可见的不一致，难以应对需要跨代码库全局映射知识的问题。我们将这类非局部不一致称为隐式不一致。由于其跨局部特性，隐式不一致给开发者带来更大的解决挑战。为此，我们提出MIP方法，该方法能够协调大语言模型、编译器和代码分析工具协同工作。MIP针对不同场景采用差异化策略：当源标识符在目标代码库中存在时，利用编译器诊断信息；否则，从两个代码库中检索匹配的代码段对作为映射知识进行缓解。在跨分支和跨派生版本补丁移植两类典型场景的实验表明，MIP在两个实验设置中成功解决的补丁数量均为最优基线的两倍以上。与行业合作伙伴开展的用户研究进一步验证了其实际有效性。

0

相关内容

【博士论文】深度学习中的推理不一致性及其缓解方法

【博士论文】深度学习中的推理不一致性及其缓解方法

专知会员服务

27+阅读 · 2025年4月5日

【牛津大学博士论文】学习分布不确定性估计的语义分割，191页pdf

【牛津大学博士论文】学习分布不确定性估计的语义分割，191页pdf

专知会员服务

30+阅读 · 2024年7月31日

【CMU博士论文】理解、正式表征和鲁棒处理现实世界的分布转移，437页pdf

【CMU博士论文】理解、正式表征和鲁棒处理现实世界的分布转移，437页pdf

专知会员服务

24+阅读 · 2024年7月4日

《不敏感弹药 (IM) 技术和新设计的实施》2022最新18页技术报告，美国陆军研究实验室

《不敏感弹药 (IM) 技术和新设计的实施》2022最新18页技术报告，美国陆军研究实验室

专知会员服务

15+阅读 · 2022年10月25日

【ICML2022】Branchformer:并行MLP-Attention架构，捕捉局部和全局上下文，用于语音识别和理解

【ICML2022】Branchformer:并行MLP-Attention架构，捕捉局部和全局上下文，用于语音识别和理解

专知会员服务

25+阅读 · 2022年7月8日

【CMU博士论文】缓解负迁移提高迁移学习的泛化和效率，201页pdf

【CMU博士论文】缓解负迁移提高迁移学习的泛化和效率，201页pdf

专知会员服务

57+阅读 · 2022年4月19日

【ICLR 2022 paper解读】将公平性注入机器学习模型，降低模型偏差，即使用于训练模型的数据集是不平衡的

【ICLR 2022 paper解读】将公平性注入机器学习模型，降低模型偏差，即使用于训练模型的数据集是不平衡的

专知会员服务

33+阅读 · 2022年3月10日

【CVPR2021】空间一致性表示学习

专知会员服务

63+阅读 · 2021年3月12日

【斯坦福】探究预训练语言模型中的可迁移性，Investigating Transferability in PLM

【斯坦福】探究预训练语言模型中的可迁移性，Investigating Transferability in PLM

专知会员服务

20+阅读 · 2020年5月3日

【NLP| 推荐文章】从统一文本到文本探讨迁移学习的局限性（Exploring the Limits of Transfer Learning with a Unified Text-to-Text Transformer）

【NLP| 推荐文章】从统一文本到文本探讨迁移学习的局限性（Exploring the Limits of Transfer Learning with a Unified Text-to-Text Transformer）

专知会员服务

20+阅读 · 2019年11月24日

【MIT-伯克利-ICLR2020】对比表示蒸馏，Contrastive Representation Distillation

【MIT-伯克利-ICLR2020】对比表示蒸馏，Contrastive Representation Distillation

专知

54+阅读 · 2020年3月12日

推荐：一文教你如何处理不平衡数据集（附代码）

推荐：一文教你如何处理不平衡数据集（附代码）

数据分析

20+阅读 · 2019年6月3日

一行TensorFlow/Keras代码解决真实场景中数据不平衡(imbalanced)问题

一行TensorFlow/Keras代码解决真实场景中数据不平衡(imbalanced)问题

专知

78+阅读 · 2019年5月31日

TensorFlow官方发布剪枝优化工具：参数减少80%，精度几乎不变

TensorFlow官方发布剪枝优化工具：参数减少80%，精度几乎不变

量子位

11+阅读 · 2019年5月15日

TensorFlow 2.0官方Transformer教程 (Attention is All you Need)

TensorFlow 2.0官方Transformer教程 (Attention is All you Need)

专知

54+阅读 · 2019年4月12日

TensorFlow 2.0新特性之Ragged Tensor

TensorFlow 2.0新特性之Ragged Tensor

深度学习每日摘要

18+阅读 · 2019年4月5日

迁移自适应学习最新综述，附21页论文下载

迁移自适应学习最新综述，附21页论文下载

专知

34+阅读 · 2019年3月13日

pytorch-pretrained-BERT：BERT PyTorch实现，可加载Google BERT预训练模型

pytorch-pretrained-BERT：BERT PyTorch实现，可加载Google BERT预训练模型

AINLP

35+阅读 · 2018年11月6日

Github 项目推荐 | 不容错过的迁移学习领域自适应资源

Github 项目推荐 | 不容错过的迁移学习领域自适应资源

AI研习社

29+阅读 · 2018年4月29日

一次 PyTorch 的踩坑经历，以及如何避免梯度成为NaN

一次 PyTorch 的踩坑经历，以及如何避免梯度成为NaN

AI研习社

14+阅读 · 2017年12月23日

语义Web知识库补全关键技术研究

国家自然科学基金

18+阅读 · 2017年12月31日

混合无线传感器网络的表面覆盖洞修补问题研究

国家自然科学基金

0+阅读 · 2015年12月31日

基于迁移学习的图像隐写分析新方法研究

国家自然科学基金

1+阅读 · 2015年12月31日

极化码串行抵消解码算法误码特性研究

国家自然科学基金

0+阅读 · 2015年12月31日

低密度奇偶校验码的误码平层和迭代译码算法的混沌特性分析

国家自然科学基金

0+阅读 · 2015年12月31日

基于云计算平台的下一代测序数据错误修正算法研究与实现

国家自然科学基金

2+阅读 · 2015年12月31日

分布式中继网络中的物理层攻击检测技术研究

国家自然科学基金

0+阅读 · 2015年12月31日

部分同源片段间基因置换的研究及其可视化网络服务平台的建立

国家自然科学基金

0+阅读 · 2015年12月31日

云移植中遗留系统组件重用研究

国家自然科学基金

0+阅读 · 2014年12月31日

隐写模糊安全性测度及其优化嵌入算法研究

国家自然科学基金

0+阅读 · 2014年12月31日

Mitigating Misalignment Contagion by Steering with Implicit Traits

Arxiv

0+阅读 · 5月4日

Patching LLM Like Software: A Lightweight Method for Improving Safety Policy in Large Language Models

Arxiv

0+阅读 · 4月27日

Mitigating Error Amplification in Fast Adversarial Training

Arxiv

0+阅读 · 4月27日

Mitigating GIL Bottlenecks in Edge AI Systems

Arxiv

0+阅读 · 4月11日

ProtoFlow: Mitigating Forgetting in Class-Incremental Remote Sensing Segmentation via Low-Curvature Prototype Flow

Arxiv

0+阅读 · 4月3日

Rafture: Erasure-coded Raft with Post-Dissemination Pruning

Arxiv

0+阅读 · 3月25日

Revisiting Vulnerability Patch Identification on Data in the Wild

Revisiting Vulnerability Patch Identification on Data in the Wild

Arxiv

0+阅读 · 3月18日

MigrateLib: a tool for end-to-end Python library migration

Arxiv

0+阅读 · 2月23日

On the Variability of Source Code in Maven Package Rebuilds

Arxiv

0+阅读 · 2月22日

Mitigating Subject Dependency in EEG Decoding with Subject-Specific Low-Rank Adapters

Arxiv

0+阅读 · 2月20日

VIP会员

文章信息

相关主题

最新内容

博士论文 | 面向大模型推理的内存高效算法

博士论文 | 面向大模型推理的内存高效算法

专知会员服务

2+阅读 · 7月27日

论文解读 | 从预训练到后训练：理解大模型推理能力如何形成

论文解读 | 从预训练到后训练：理解大模型推理能力如何形成

专知会员服务

3+阅读 · 7月27日

《无人系统互操作性导论——无人系统联合架构（JAUS）》

《无人系统互操作性导论——无人系统联合架构（JAUS）》

专知会员服务

9+阅读 · 7月27日

美空军新型反无人机部队初探

美空军新型反无人机部队初探

专知会员服务

5+阅读 · 7月27日

《对抗性电磁环境下远程巡飞弹作战的安全指挥与控制数据链》

《对抗性电磁环境下远程巡飞弹作战的安全指挥与控制数据链》

专知会员服务

4+阅读 · 7月27日

《北约下一代建模与仿真（NexGen M&S）计划》2026年69页

《北约下一代建模与仿真（NexGen M&S）计划》2026年69页

专知会员服务

3+阅读 · 7月27日

《防空交战流程的概率建模研究》

《防空交战流程的概率建模研究》

专知会员服务

7+阅读 · 7月27日

ICML 2026 教程 | 数值优化理论还重要吗？

ICML 2026 教程 | 数值优化理论还重要吗？

专知会员服务

6+阅读 · 7月26日

ICM 2026 | 陶哲轩：人工智能时代的数学

ICM 2026 | 陶哲轩：人工智能时代的数学

专知会员服务

9+阅读 · 7月26日

《面向可扩展高韧性无人机集群网络的速度感知分层通信框架》

《面向可扩展高韧性无人机集群网络的速度感知分层通信框架》

专知会员服务

8+阅读 · 7月26日

《面向概率推理的可定制战术引擎及其在军事任务规划中的应用》

《面向概率推理的可定制战术引擎及其在军事任务规划中的应用》

专知会员服务

11+阅读 · 7月26日

《先进防空系统选型战略框架：基于巴基斯坦的实证启示》

《先进防空系统选型战略框架：基于巴基斯坦的实证启示》

专知会员服务

8+阅读 · 7月26日

《反无人机交战场景下的战斗归零研究》

《反无人机交战场景下的战斗归零研究》

专知会员服务

7+阅读 · 7月26日

霍尔木兹与不对称作战时代：水雷、无人系统与海军力量的重新定义

霍尔木兹与不对称作战时代：水雷、无人系统与海军力量的重新定义

专知会员服务

4+阅读 · 7月26日

博士论文 | 用代码结构感知方法推进代码大模型

博士论文 | 用代码结构感知方法推进代码大模型

专知会员服务

6+阅读 · 7月25日

相关VIP内容

【博士论文】深度学习中的推理不一致性及其缓解方法

【博士论文】深度学习中的推理不一致性及其缓解方法

专知会员服务

27+阅读 · 2025年4月5日

【牛津大学博士论文】学习分布不确定性估计的语义分割，191页pdf

【牛津大学博士论文】学习分布不确定性估计的语义分割，191页pdf

专知会员服务

30+阅读 · 2024年7月31日

【CMU博士论文】理解、正式表征和鲁棒处理现实世界的分布转移，437页pdf

【CMU博士论文】理解、正式表征和鲁棒处理现实世界的分布转移，437页pdf

专知会员服务

24+阅读 · 2024年7月4日

《不敏感弹药 (IM) 技术和新设计的实施》2022最新18页技术报告，美国陆军研究实验室

《不敏感弹药 (IM) 技术和新设计的实施》2022最新18页技术报告，美国陆军研究实验室

专知会员服务

15+阅读 · 2022年10月25日

【ICML2022】Branchformer:并行MLP-Attention架构，捕捉局部和全局上下文，用于语音识别和理解

【ICML2022】Branchformer:并行MLP-Attention架构，捕捉局部和全局上下文，用于语音识别和理解

专知会员服务

25+阅读 · 2022年7月8日

【CMU博士论文】缓解负迁移提高迁移学习的泛化和效率，201页pdf

【CMU博士论文】缓解负迁移提高迁移学习的泛化和效率，201页pdf

专知会员服务

57+阅读 · 2022年4月19日

【ICLR 2022 paper解读】将公平性注入机器学习模型，降低模型偏差，即使用于训练模型的数据集是不平衡的

【ICLR 2022 paper解读】将公平性注入机器学习模型，降低模型偏差，即使用于训练模型的数据集是不平衡的

专知会员服务

33+阅读 · 2022年3月10日

【CVPR2021】空间一致性表示学习

专知会员服务

63+阅读 · 2021年3月12日

【斯坦福】探究预训练语言模型中的可迁移性，Investigating Transferability in PLM

【斯坦福】探究预训练语言模型中的可迁移性，Investigating Transferability in PLM

专知会员服务

20+阅读 · 2020年5月3日

【NLP| 推荐文章】从统一文本到文本探讨迁移学习的局限性（Exploring the Limits of Transfer Learning with a Unified Text-to-Text Transformer）

【NLP| 推荐文章】从统一文本到文本探讨迁移学习的局限性（Exploring the Limits of Transfer Learning with a Unified Text-to-Text Transformer）

专知会员服务

20+阅读 · 2019年11月24日

热门VIP内容

开通专知VIP会员享更多权益服务

论文解读 | 从预训练到后训练：理解大模型推理能力如何形成

美空军新型反无人机部队初探

博士论文 | 面向大模型推理的内存高效算法

《无人系统互操作性导论——无人系统联合架构（JAUS）》

相关资讯

【MIT-伯克利-ICLR2020】对比表示蒸馏，Contrastive Representation Distillation

【MIT-伯克利-ICLR2020】对比表示蒸馏，Contrastive Representation Distillation

专知

54+阅读 · 2020年3月12日

推荐：一文教你如何处理不平衡数据集（附代码）

推荐：一文教你如何处理不平衡数据集（附代码）

数据分析

20+阅读 · 2019年6月3日

一行TensorFlow/Keras代码解决真实场景中数据不平衡(imbalanced)问题

一行TensorFlow/Keras代码解决真实场景中数据不平衡(imbalanced)问题

专知

78+阅读 · 2019年5月31日

TensorFlow官方发布剪枝优化工具：参数减少80%，精度几乎不变

TensorFlow官方发布剪枝优化工具：参数减少80%，精度几乎不变

量子位

11+阅读 · 2019年5月15日

TensorFlow 2.0官方Transformer教程 (Attention is All you Need)

TensorFlow 2.0官方Transformer教程 (Attention is All you Need)

专知

54+阅读 · 2019年4月12日

TensorFlow 2.0新特性之Ragged Tensor

TensorFlow 2.0新特性之Ragged Tensor

深度学习每日摘要

18+阅读 · 2019年4月5日

迁移自适应学习最新综述，附21页论文下载

迁移自适应学习最新综述，附21页论文下载

专知

34+阅读 · 2019年3月13日

pytorch-pretrained-BERT：BERT PyTorch实现，可加载Google BERT预训练模型

pytorch-pretrained-BERT：BERT PyTorch实现，可加载Google BERT预训练模型

AINLP

35+阅读 · 2018年11月6日

Github 项目推荐 | 不容错过的迁移学习领域自适应资源

Github 项目推荐 | 不容错过的迁移学习领域自适应资源

AI研习社

29+阅读 · 2018年4月29日

一次 PyTorch 的踩坑经历，以及如何避免梯度成为NaN

一次 PyTorch 的踩坑经历，以及如何避免梯度成为NaN

AI研习社

14+阅读 · 2017年12月23日

相关论文

Mitigating Misalignment Contagion by Steering with Implicit Traits

Arxiv

0+阅读 · 5月4日

Patching LLM Like Software: A Lightweight Method for Improving Safety Policy in Large Language Models

Arxiv

0+阅读 · 4月27日

Mitigating Error Amplification in Fast Adversarial Training

Arxiv

0+阅读 · 4月27日

Mitigating GIL Bottlenecks in Edge AI Systems

Arxiv

0+阅读 · 4月11日

ProtoFlow: Mitigating Forgetting in Class-Incremental Remote Sensing Segmentation via Low-Curvature Prototype Flow

Arxiv

0+阅读 · 4月3日

Rafture: Erasure-coded Raft with Post-Dissemination Pruning

Arxiv

0+阅读 · 3月25日

Revisiting Vulnerability Patch Identification on Data in the Wild

Revisiting Vulnerability Patch Identification on Data in the Wild

Arxiv

0+阅读 · 3月18日

MigrateLib: a tool for end-to-end Python library migration

Arxiv

0+阅读 · 2月23日

On the Variability of Source Code in Maven Package Rebuilds

Arxiv

0+阅读 · 2月22日

Mitigating Subject Dependency in EEG Decoding with Subject-Specific Low-Rank Adapters

Arxiv

0+阅读 · 2月20日

相关基金

语义Web知识库补全关键技术研究

国家自然科学基金

18+阅读 · 2017年12月31日

混合无线传感器网络的表面覆盖洞修补问题研究

国家自然科学基金

0+阅读 · 2015年12月31日

基于迁移学习的图像隐写分析新方法研究

国家自然科学基金

1+阅读 · 2015年12月31日

极化码串行抵消解码算法误码特性研究

国家自然科学基金

0+阅读 · 2015年12月31日

低密度奇偶校验码的误码平层和迭代译码算法的混沌特性分析

国家自然科学基金

0+阅读 · 2015年12月31日

基于云计算平台的下一代测序数据错误修正算法研究与实现

国家自然科学基金

2+阅读 · 2015年12月31日

分布式中继网络中的物理层攻击检测技术研究

国家自然科学基金

0+阅读 · 2015年12月31日

部分同源片段间基因置换的研究及其可视化网络服务平台的建立

国家自然科学基金

0+阅读 · 2015年12月31日

云移植中遗留系统组件重用研究

国家自然科学基金

0+阅读 · 2014年12月31日

隐写模糊安全性测度及其优化嵌入算法研究

国家自然科学基金

0+阅读 · 2014年12月31日

微信扫码咨询专知VIP会员