Counterfactual Peptide Editing for Causal TCR--pMHC Binding Inference - 专知论文

会员服务 ·

0

反事实 · 不变 · CIP · 推断 · 约束 ·

Counterfactual Peptide Editing for Causal TCR--pMHC Binding Inference

翻译：反事实肽编辑用于因果TCR-pMHC结合推断

Sanjar Khudoyberdiev,Arman Bekov

Neural models for TCR-pMHC binding prediction are susceptible to shortcut learning: they exploit spurious correlations in training data -- such as peptide length bias or V-gene co-occurrence -- rather than the physical binding interface. This renders predictions brittle under family-held-out and distance-aware evaluation, where such shortcuts do not transfer. We introduce \emph{Counterfactual Invariant Prediction} (CIP), a training framework that generates biologically constrained counterfactual peptide edits and enforces invariance to edits at non-anchor positions while amplifying sensitivity at MHC anchor residues. CIP augments the base classifier with two auxiliary objectives: (1) an invariance loss penalizing prediction changes under conservative non-anchor substitutions, and (2) a contrastive loss encouraging large prediction changes under anchor-position disruptions. Evaluated on a curated VDJdb-IEDB benchmark under family-held-out, distance-aware, and random splits, CIP achieves AUROC 0.831 and counterfactual consistency (CFC) 0.724 under the challenging family-held-out protocol -- a 39.7\% reduction in shortcut index relative to the unconstrained baseline. Ablations confirm that anchor-aware edit generation is the dominant driver of OOD gains, providing a practical recipe for causally-grounded TCR specificity modeling.

翻译：神经模型在TCR-pMHC结合预测中易受捷径学习影响：它们利用训练数据中的伪相关性（如肽长度偏差或V基因共现），而非物理结合界面。这使得模型在家族留出和距离感知评估中预测结果脆弱，因为此类捷径无法迁移。我们提出反事实不变预测（CIP）训练框架，该框架生成受生物学约束的反事实肽编辑，并在非锚点位置强制执行编辑不变性，同时放大MHC锚点残基的敏感性。CIP为基础分类器增加两个辅助目标：（1）不变性损失，惩罚保守非锚点替换下的预测变化；（2）对比损失，鼓励锚点位置扰动下的大幅预测变化。在基于VDJdb-IEDB整理基准的家族留出、距离感知和随机划分评估中，CIP在具有挑战性的家族留出协议下达到AUROC 0.831和反事实一致性（CFC）0.724，相比无约束基线捷径指数降低39.7%。消融实验证实，锚点感知编辑生成是分布外性能提升的主导因素，为基于因果的TCR特异性建模提供了实用方案。

0

相关内容

反事实

【EPFL博士论文】因果推断的方法学进展：实验、识别与估计

【EPFL博士论文】因果推断的方法学进展：实验、识别与估计

专知会员服务

16+阅读 · 2025年11月5日

图上如何建模因果性？PSU等最新《图反事实学习》综述，50页pdf全面综述图公平性、可解释性等方法

图上如何建模因果性？PSU等最新《图反事实学习》综述，50页pdf全面综述图公平性、可解释性等方法

专知会员服务

74+阅读 · 2023年4月12日

图上如何可解释？首篇《图反事实解释:定义、方法、评价》综述，46页pdf165篇文献全面概述图反事实解释进展

图上如何可解释？首篇《图反事实解释:定义、方法、评价》综述，46页pdf165篇文献全面概述图反事实解释进展

专知会员服务

41+阅读 · 2022年10月24日

【ICML2022】因果Transformer:估算反事实结果的因果, 附ppt

【ICML2022】因果Transformer:估算反事实结果的因果, 附ppt

专知会员服务

84+阅读 · 2022年7月20日

因果如何用于推荐？中科大最新WWW2022《因果推荐: 进展与未来方向》教程，附123页ppt

因果如何用于推荐？中科大最新WWW2022《因果推荐: 进展与未来方向》教程，附123页ppt

专知会员服务

108+阅读 · 2022年4月28日

因果推断在医药图像的应用：数据缺失和数据不匹配

因果推断在医药图像的应用：数据缺失和数据不匹配

专知会员服务

58+阅读 · 2022年4月2日

GNN如何用于因果推断？TU&DeepMind-AAAI2022投稿论文《关联图神经网络与结构因果模型》阐述基于GNN的因果推理

GNN如何用于因果推断？TU&DeepMind-AAAI2022投稿论文《关联图神经网络与结构因果模型》阐述基于GNN的因果推理

专知会员服务

56+阅读 · 2021年9月10日

因果推断，Causal Inference：The Mixtape

因果推断，Causal Inference：The Mixtape

专知会员服务

110+阅读 · 2021年8月27日

【NeurIPS2020】可处理的反事实推理的深度结构因果模型

【NeurIPS2020】可处理的反事实推理的深度结构因果模型

专知会员服务

49+阅读 · 2020年9月28日

最新「因果推断Causal Inference」综述论文38页pdf，Buffalo、Georgia、阿里巴巴、Virginia

专知会员服务

183+阅读 · 2020年2月11日

图上如何建模因果性？PSU等最新《图反事实学习》综述，50页pdf全面综述图公平性、可解释性等方法

图上如何建模因果性？PSU等最新《图反事实学习》综述，50页pdf全面综述图公平性、可解释性等方法

专知

56+阅读 · 2023年4月13日

「因果推理」概述论文，13页pdf

「因果推理」概述论文，13页pdf

专知

16+阅读 · 2021年3月20日

【KDD2020-Tutorial】因果推理与稳定学习，Causal Inference and Stable Learning

【KDD2020-Tutorial】因果推理与稳定学习，Causal Inference and Stable Learning

专知

11+阅读 · 2020年8月28日

基于深度元学习的因果推断新方法

基于深度元学习的因果推断新方法

图与推荐

12+阅读 · 2020年7月21日

【ICML2020-Tutorial】因果强化学习-CRL，147页ppt，哥伦比亚大学-Elias Bareinboim

【ICML2020-Tutorial】因果强化学习-CRL，147页ppt，哥伦比亚大学-Elias Bareinboim

专知

13+阅读 · 2020年7月16日

【MIT-伯克利-ICLR2020】对比表示蒸馏，Contrastive Representation Distillation

【MIT-伯克利-ICLR2020】对比表示蒸馏，Contrastive Representation Distillation

专知

54+阅读 · 2020年3月12日

最新「因果推断Causal Inference」综述论文38页pdf，阿里巴巴、Buffalo、Georgia、Virginia

最新「因果推断Causal Inference」综述论文38页pdf，阿里巴巴、Buffalo、Georgia、Virginia

专知

68+阅读 · 2020年2月11日

KAUST高欣组研发基于深度学习的研究RNA和RBP相互作用的全新方法｜Nat. Commun.

KAUST高欣组研发基于深度学习的研究RNA和RBP相互作用的全新方法｜Nat. Commun.

科研圈

17+阅读 · 2019年10月30日

【HEC-Montreal唐建博士】图神经网络推理，附27页ppt

【HEC-Montreal唐建博士】图神经网络推理，附27页ppt

专知

47+阅读 · 2019年10月30日

用深度学习揭示数据的因果关系

用深度学习揭示数据的因果关系

专知

28+阅读 · 2019年5月18日

树突膜特异性表达的syndecan-2通过调节actin细胞骨架聚集参与神经病理性痛的机制研究

国家自然科学基金

0+阅读 · 2016年12月31日

Lnc-TRMT2A竞争性结合miR-520a调控炎性通路在精神分裂症发病中的作用研究

国家自然科学基金

0+阅读 · 2015年12月31日

基于串联质谱数据的多肽鉴定半监督学习并行算法研究

国家自然科学基金

0+阅读 · 2015年12月31日

逻辑等价算子在不确定性推理中的应用

国家自然科学基金

1+阅读 · 2015年12月31日

细胞分化过程中长非编码RNA介导的三维基因组遗传信息传递网络的解析

国家自然科学基金

0+阅读 · 2015年12月31日

Ca2+依赖的蛋白酶Calpain对突触后谷氨酸受体的调控机制

国家自然科学基金

0+阅读 · 2015年12月31日

lincRNA-IFNL3P1在丙肝病毒感染中对III型干扰素基因表达调控的机制研究

国家自然科学基金

0+阅读 · 2015年12月31日

含有隐变量的因果结构学习与统计因果推断

国家自然科学基金

21+阅读 · 2013年12月31日

因果推断的统计方法

国家自然科学基金

26+阅读 · 2011年12月31日

因果推断及不完全数据的统计分析

国家自然科学基金

23+阅读 · 2008年12月31日

Causality-Encoded Diffusion Models for Interventional Sampling and Edge Inference

Arxiv

0+阅读 · 4月23日

A Sensitivity Approach to Causal Inference Under Limited Overlap

Arxiv

0+阅读 · 4月18日

Flow-based Generative Modeling of Potential Outcomes and Counterfactuals

Arxiv

0+阅读 · 4月15日

Calibrated Abstention for Reliable TCR--pMHC Binding Prediction under Epitope Shift

Arxiv

0+阅读 · 4月14日

Causal Diffusion Models for Counterfactual Outcome Distributions in Longitudinal Data

Arxiv

0+阅读 · 4月14日

On causal inference with marked point process data

Arxiv

0+阅读 · 4月14日

Causal Process Models: Reframing Dynamic Causal Graph Discovery as a Reinforcement Learning Problem

Arxiv

0+阅读 · 4月5日

A Causal Graph Approach to Oppositional Narrative Analysis

Arxiv

0+阅读 · 3月10日

TCR-EML: Explainable Model Layers for TCR-pMHC Prediction

Arxiv

0+阅读 · 3月5日

Sequential Counterfactual Inference for Temporal Clinical Data: Addressing the Time Traveler Dilemma

Arxiv

0+阅读 · 2月24日

VIP会员

文章信息

相关主题

最新内容

《面向复杂地形下无人机跟踪地面机器人（UAV–UGV）的自适应多滤波器扩展卡尔曼滤波框架》

《面向复杂地形下无人机跟踪地面机器人（UAV–UGV）的自适应多滤波器扩展卡尔曼滤波框架》

专知会员服务

0+阅读 · 6分钟前

纵深侦察：大规模作战行动中远程侦察与监视之迫切需求

纵深侦察：大规模作战行动中远程侦察与监视之迫切需求

专知会员服务

0+阅读 · 34分钟前

共享认知，分布式研判：复杂行动中的美国空军指挥控制（万字长文）

共享认知，分布式研判：复杂行动中的美国空军指挥控制（万字长文）

专知会员服务

0+阅读 · 今天13:27

《无人机对海面作战影响评估》

《无人机对海面作战影响评估》

专知会员服务

11+阅读 · 7月21日

《可损耗无人系统规模化应用对美国军事转型的战略影响（2022-2030）》2026年270页

《可损耗无人系统规模化应用对美国军事转型的战略影响（2022-2030）》2026年270页

专知会员服务

10+阅读 · 7月21日

博士论文 | 后训练如何损害大模型生成多样性？SimpleStrat与Stylus

博士论文 | 后训练如何损害大模型生成多样性？SimpleStrat与Stylus

专知会员服务

4+阅读 · 7月21日

综述 | 面向5G/6G网络的LLM智能体AI：架构、协议与标准化

综述 | 面向5G/6G网络的LLM智能体AI：架构、协议与标准化

专知会员服务

6+阅读 · 7月21日

五角大楼新设无人机办公室（DRPM-UxS）将如何重塑美国无人系统格局（附美国防部设立备忘录）

五角大楼新设无人机办公室（DRPM-UxS）将如何重塑美国无人系统格局（附美国防部设立备忘录）

专知会员服务

8+阅读 · 7月21日

印度精确打击与指挥架构的断层

印度精确打击与指挥架构的断层

专知会员服务

6+阅读 · 7月20日

《NASA喷气推进实验室：高耐久轻质常驻空观测系统（HELIOS）》429页

《NASA喷气推进实验室：高耐久轻质常驻空观测系统（HELIOS）》429页

专知会员服务

8+阅读 · 7月20日

美空军AI完成F-16战斗机自主空战历史性试飞

美空军AI完成F-16战斗机自主空战历史性试飞

专知会员服务

6+阅读 · 7月20日

《美政府问责局——武器系统年度评估（2026年）：强制要求成熟技术或可推动转向快速交付》249页

《美政府问责局——武器系统年度评估（2026年）：强制要求成熟技术或可推动转向快速交付》249页

专知会员服务

9+阅读 · 7月20日

《美国陆军：通过弹性分布式模型库实现自适应AI优势》

《美国陆军：通过弹性分布式模型库实现自适应AI优势》

专知会员服务

8+阅读 · 7月20日

博士论文 | 理解与改进大语言模型推理：从反转诅咒到连续思维链

博士论文 | 理解与改进大语言模型推理：从反转诅咒到连续思维链

专知会员服务

10+阅读 · 7月20日

综述 | 终身视觉表征：持续自监督学习CSSL系统综述

综述 | 终身视觉表征：持续自监督学习CSSL系统综述

专知会员服务

10+阅读 · 7月20日

相关VIP内容

【EPFL博士论文】因果推断的方法学进展：实验、识别与估计

【EPFL博士论文】因果推断的方法学进展：实验、识别与估计

专知会员服务

16+阅读 · 2025年11月5日

图上如何建模因果性？PSU等最新《图反事实学习》综述，50页pdf全面综述图公平性、可解释性等方法

图上如何建模因果性？PSU等最新《图反事实学习》综述，50页pdf全面综述图公平性、可解释性等方法

专知会员服务

74+阅读 · 2023年4月12日

图上如何可解释？首篇《图反事实解释:定义、方法、评价》综述，46页pdf165篇文献全面概述图反事实解释进展

图上如何可解释？首篇《图反事实解释:定义、方法、评价》综述，46页pdf165篇文献全面概述图反事实解释进展

专知会员服务

41+阅读 · 2022年10月24日

【ICML2022】因果Transformer:估算反事实结果的因果, 附ppt

【ICML2022】因果Transformer:估算反事实结果的因果, 附ppt

专知会员服务

84+阅读 · 2022年7月20日

因果如何用于推荐？中科大最新WWW2022《因果推荐: 进展与未来方向》教程，附123页ppt

因果如何用于推荐？中科大最新WWW2022《因果推荐: 进展与未来方向》教程，附123页ppt

专知会员服务

108+阅读 · 2022年4月28日

因果推断在医药图像的应用：数据缺失和数据不匹配

因果推断在医药图像的应用：数据缺失和数据不匹配

专知会员服务

58+阅读 · 2022年4月2日

GNN如何用于因果推断？TU&DeepMind-AAAI2022投稿论文《关联图神经网络与结构因果模型》阐述基于GNN的因果推理

GNN如何用于因果推断？TU&DeepMind-AAAI2022投稿论文《关联图神经网络与结构因果模型》阐述基于GNN的因果推理

专知会员服务

56+阅读 · 2021年9月10日

因果推断，Causal Inference：The Mixtape

因果推断，Causal Inference：The Mixtape

专知会员服务

110+阅读 · 2021年8月27日

【NeurIPS2020】可处理的反事实推理的深度结构因果模型

【NeurIPS2020】可处理的反事实推理的深度结构因果模型

专知会员服务

49+阅读 · 2020年9月28日

最新「因果推断Causal Inference」综述论文38页pdf，Buffalo、Georgia、阿里巴巴、Virginia

专知会员服务

183+阅读 · 2020年2月11日

热门VIP内容

开通专知VIP会员享更多权益服务

纵深侦察：大规模作战行动中远程侦察与监视之迫切需求

《无人机对海面作战影响评估》

《面向复杂地形下无人机跟踪地面机器人（UAV–UGV）的自适应多滤波器扩展卡尔曼滤波框架》

共享认知，分布式研判：复杂行动中的美国空军指挥控制（万字长文）

相关资讯

图上如何建模因果性？PSU等最新《图反事实学习》综述，50页pdf全面综述图公平性、可解释性等方法

图上如何建模因果性？PSU等最新《图反事实学习》综述，50页pdf全面综述图公平性、可解释性等方法

专知

56+阅读 · 2023年4月13日

「因果推理」概述论文，13页pdf

「因果推理」概述论文，13页pdf

专知

16+阅读 · 2021年3月20日

【KDD2020-Tutorial】因果推理与稳定学习，Causal Inference and Stable Learning

【KDD2020-Tutorial】因果推理与稳定学习，Causal Inference and Stable Learning

专知

11+阅读 · 2020年8月28日

基于深度元学习的因果推断新方法

基于深度元学习的因果推断新方法

图与推荐

12+阅读 · 2020年7月21日

【ICML2020-Tutorial】因果强化学习-CRL，147页ppt，哥伦比亚大学-Elias Bareinboim

【ICML2020-Tutorial】因果强化学习-CRL，147页ppt，哥伦比亚大学-Elias Bareinboim

专知

13+阅读 · 2020年7月16日

【MIT-伯克利-ICLR2020】对比表示蒸馏，Contrastive Representation Distillation

【MIT-伯克利-ICLR2020】对比表示蒸馏，Contrastive Representation Distillation

专知

54+阅读 · 2020年3月12日

最新「因果推断Causal Inference」综述论文38页pdf，阿里巴巴、Buffalo、Georgia、Virginia

最新「因果推断Causal Inference」综述论文38页pdf，阿里巴巴、Buffalo、Georgia、Virginia

专知

68+阅读 · 2020年2月11日

KAUST高欣组研发基于深度学习的研究RNA和RBP相互作用的全新方法｜Nat. Commun.

KAUST高欣组研发基于深度学习的研究RNA和RBP相互作用的全新方法｜Nat. Commun.

科研圈

17+阅读 · 2019年10月30日

【HEC-Montreal唐建博士】图神经网络推理，附27页ppt

【HEC-Montreal唐建博士】图神经网络推理，附27页ppt

专知

47+阅读 · 2019年10月30日

用深度学习揭示数据的因果关系

用深度学习揭示数据的因果关系

专知

28+阅读 · 2019年5月18日

相关论文

Causality-Encoded Diffusion Models for Interventional Sampling and Edge Inference

Arxiv

0+阅读 · 4月23日

A Sensitivity Approach to Causal Inference Under Limited Overlap

Arxiv

0+阅读 · 4月18日

Flow-based Generative Modeling of Potential Outcomes and Counterfactuals

Arxiv

0+阅读 · 4月15日

Calibrated Abstention for Reliable TCR--pMHC Binding Prediction under Epitope Shift

Arxiv

0+阅读 · 4月14日

Causal Diffusion Models for Counterfactual Outcome Distributions in Longitudinal Data

Arxiv

0+阅读 · 4月14日

On causal inference with marked point process data

Arxiv

0+阅读 · 4月14日

Causal Process Models: Reframing Dynamic Causal Graph Discovery as a Reinforcement Learning Problem

Arxiv

0+阅读 · 4月5日

A Causal Graph Approach to Oppositional Narrative Analysis

Arxiv

0+阅读 · 3月10日

TCR-EML: Explainable Model Layers for TCR-pMHC Prediction

Arxiv

0+阅读 · 3月5日

Sequential Counterfactual Inference for Temporal Clinical Data: Addressing the Time Traveler Dilemma

Arxiv

0+阅读 · 2月24日

相关基金

树突膜特异性表达的syndecan-2通过调节actin细胞骨架聚集参与神经病理性痛的机制研究

国家自然科学基金

0+阅读 · 2016年12月31日

Lnc-TRMT2A竞争性结合miR-520a调控炎性通路在精神分裂症发病中的作用研究

国家自然科学基金

0+阅读 · 2015年12月31日

基于串联质谱数据的多肽鉴定半监督学习并行算法研究

国家自然科学基金

0+阅读 · 2015年12月31日

逻辑等价算子在不确定性推理中的应用

国家自然科学基金

1+阅读 · 2015年12月31日

细胞分化过程中长非编码RNA介导的三维基因组遗传信息传递网络的解析

国家自然科学基金

0+阅读 · 2015年12月31日

Ca2+依赖的蛋白酶Calpain对突触后谷氨酸受体的调控机制

国家自然科学基金

0+阅读 · 2015年12月31日

lincRNA-IFNL3P1在丙肝病毒感染中对III型干扰素基因表达调控的机制研究

国家自然科学基金

0+阅读 · 2015年12月31日

含有隐变量的因果结构学习与统计因果推断

国家自然科学基金

21+阅读 · 2013年12月31日

因果推断的统计方法

国家自然科学基金

26+阅读 · 2011年12月31日

因果推断及不完全数据的统计分析

国家自然科学基金

23+阅读 · 2008年12月31日

微信扫码咨询专知VIP会员