An Odd Estimator for Shapley Values - 专知论文

会员服务 ·

0

近似 · 子空间 · 推断 · 精确计算 · 启发式 ·

An Odd Estimator for Shapley Values

翻译：Shapley值的奇偶估计器

Fabian Fumagalli,Landon Butler,Justin Singh Kang,Kannan Ramchandran,R. Teal Witter

The Shapley value is a ubiquitous framework for attribution in machine learning, encompassing feature importance, data valuation, and causal inference. However, its exact computation is generally intractable, necessitating efficient approximation methods. While the most effective and popular estimators leverage the paired sampling heuristic to reduce estimation error, the theoretical mechanism driving this improvement has remained opaque. In this work, we provide an elegant and fundamental justification for paired sampling: we prove that the Shapley value depends exclusively on the odd component of the set function, and that paired sampling orthogonalizes the regression objective to filter out the irrelevant even component. Leveraging this insight, we propose OddSHAP, a novel consistent estimator that performs polynomial regression solely on the odd subspace. By utilizing the Fourier basis to isolate this subspace and employing a proxy model to identify high-impact interactions, OddSHAP overcomes the combinatorial explosion of higher-order approximations. Through an extensive benchmark evaluation, we find that OddSHAP achieves state-of-the-art estimation accuracy.

翻译：Shapley值是机器学习中用于归因的普适框架，涵盖特征重要性、数据估值和因果推断。然而，其精确计算通常难以处理，需要高效的近似方法。虽然最有效且流行的估计器利用配对采样启发式方法来减少估计误差，但驱动这种改进的理论机制一直不明确。在本工作中，我们为配对采样提供了一个优雅且根本性的理论依据：我们证明了Shapley值仅依赖于集合函数的奇分量，并且配对采样通过正交化回归目标来滤除无关的偶分量。基于这一洞见，我们提出了OddSHAP——一种仅在奇子空间上进行多项式回归的新型一致估计器。通过利用傅里叶基来分离该子空间，并采用代理模型识别高影响力交互项，OddSHAP克服了高阶近似的组合爆炸问题。在广泛的基准评估中，我们发现OddSHAP实现了最先进的估计精度。

0

相关内容

【ETH博士论文】机器学习数据估值算法与应用研究进展，225页pdf

【ETH博士论文】机器学习数据估值算法与应用研究进展，225页pdf

专知会员服务

38+阅读 · 2023年9月18日

【2023新书】用SHAP解释机器学习模型:Python示例和Shapley值理论指南，216页pdf

【2023新书】用SHAP解释机器学习模型:Python示例和Shapley值理论指南，216页pdf

专知会员服务

83+阅读 · 2023年8月31日

伯克利《因果推断》讲义，因果推断第一课，全文428页

伯克利《因果推断》讲义，因果推断第一课，全文428页

专知会员服务

149+阅读 · 2023年6月3日

【2022新书】机器学习中的概率数值计算，412页pdf

【2022新书】机器学习中的概率数值计算，412页pdf

专知会员服务

93+阅读 · 2022年7月7日

因果推断，Causal Inference：The Mixtape

因果推断，Causal Inference：The Mixtape

专知会员服务

110+阅读 · 2021年8月27日

【KDD2021】基于因果反事实Shapley的MARL信度分配

专知会员服务

19+阅读 · 2021年7月11日

Google最新《机器学习对偶性》报告，48页ppt

Google最新《机器学习对偶性》报告，48页ppt

专知会员服务

36+阅读 · 2020年11月29日

【SIGIR2020-中科院计算所】L2R2: 利用排名进行外展推理，L2R2: Leveraging Ranking for Abductive Reasoning

【SIGIR2020-中科院计算所】L2R2: 利用排名进行外展推理，L2R2: Leveraging Ranking for Abductive Reasoning

专知会员服务

11+阅读 · 2020年5月25日

【北大-阿里巴巴】深度哈希方法综述，23页pdf，A Survey on Deep Hashing Methods

【北大-阿里巴巴】深度哈希方法综述，23页pdf，A Survey on Deep Hashing Methods

专知会员服务

27+阅读 · 2020年3月9日

【独立研究者I-Sheng Yang论文】因果机器学习损失函数（A Loss-Function for Causal Machine-Learning）

【独立研究者I-Sheng Yang论文】因果机器学习损失函数（A Loss-Function for Causal Machine-Learning）

专知会员服务

20+阅读 · 2020年1月7日

【2022新书】机器学习中的概率数值计算，412页pdf

【2022新书】机器学习中的概率数值计算，412页pdf

专知

33+阅读 · 2022年7月7日

最新「因果推断Causal Inference」综述论文38页pdf，阿里巴巴、Buffalo、Georgia、Virginia

最新「因果推断Causal Inference」综述论文38页pdf，阿里巴巴、Buffalo、Georgia、Virginia

专知

68+阅读 · 2020年2月11日

这一份217页斯坦福大学统计学习理论笔记，Percy Liang带你搞清楚难懂的理论基础

这一份217页斯坦福大学统计学习理论笔记，Percy Liang带你搞清楚难懂的理论基础

专知

24+阅读 · 2018年12月20日

斯坦福统计学习理论笔记：Percy Liang带你搞定「贼难」的理论基础

斯坦福统计学习理论笔记：Percy Liang带你搞定「贼难」的理论基础

机器之心

26+阅读 · 2018年12月18日

Facebook AI发布新版本FairSeq序列到序列(Seq2Seq)学习工具，可生成故事与快速推断

Facebook AI发布新版本FairSeq序列到序列(Seq2Seq)学习工具，可生成故事与快速推断

专知

23+阅读 · 2018年6月17日

【机器学习基本理论】详解最大似然估计（MLE）、最大后验概率估计（MAP），以及贝叶斯公式的理解

【机器学习基本理论】详解最大似然估计（MLE）、最大后验概率估计（MAP），以及贝叶斯公式的理解

机器学习研究会

19+阅读 · 2018年3月11日

推荐算法：Match与Rank模型的交织配合

推荐算法：Match与Rank模型的交织配合

从0到1

15+阅读 · 2017年12月18日

最新｜深度离散哈希算法，可用于图像检索！

最新｜深度离散哈希算法，可用于图像检索！

全球人工智能

14+阅读 · 2017年12月15日

【技术分享】智能感知与计算研究中心NIPS 2017论文提出深度离散哈希算法，可用于图像检索

【技术分享】智能感知与计算研究中心NIPS 2017论文提出深度离散哈希算法，可用于图像检索

机器学习研究会

12+阅读 · 2017年11月3日

【机器学习】【推荐系统】做推荐系统之前，希望有人告诉我这些

【机器学习】【推荐系统】做推荐系统之前，希望有人告诉我这些

产业智能官

11+阅读 · 2017年10月14日

处理效应差异中位数的有效估计

国家自然科学基金

0+阅读 · 2015年12月31日

逻辑等价算子在不确定性推理中的应用

国家自然科学基金

1+阅读 · 2015年12月31日

基于复杂数据的回归模型统计推断及其应用

国家自然科学基金

3+阅读 · 2015年12月31日

低密度奇偶校验码的误码平层和迭代译码算法的混沌特性分析

国家自然科学基金

0+阅读 · 2015年12月31日

有理 Krylov 子空间算法的最优参数选取

国家自然科学基金

0+阅读 · 2015年12月31日

振荡哈密尔顿波方程的几何数值积分

国家自然科学基金

0+阅读 · 2015年12月31日

基于深度学习的机器译文质量估计方法研究

国家自然科学基金

3+阅读 · 2014年12月31日

随机Helmholtz型问题的数值方法

国家自然科学基金

0+阅读 · 2014年12月31日

基于似然函数的统计推断

国家自然科学基金

5+阅读 · 2014年12月31日

因果推断的统计方法

国家自然科学基金

26+阅读 · 2011年12月31日

How important are the genes to explain the outcome - the asymmetric Shapley value as an honest importance metric for high-dimensional features

Arxiv

0+阅读 · 3月5日

Local Shapley: Model-Induced Locality and Optimal Reuse in Data Valuation

Arxiv

0+阅读 · 3月4日

Enhancing the Interpretability of SHAP Values Using Large Language Models

Arxiv

0+阅读 · 3月3日

Joint Distribution-Informed Shapley Values for Sparse Counterfactual Explanations

Arxiv

0+阅读 · 2月27日

Statistical Inference and Learning for Shapley Additive Explanations (SHAP)

Arxiv

0+阅读 · 2月11日

Computing Conditional Shapley Values Using Tabular Foundation Models

Arxiv

0+阅读 · 2月10日

Faithful Group Shapley Value

Arxiv

0+阅读 · 2月10日

In-Run Data Shapley for Adam Optimizer

Arxiv

0+阅读 · 2月6日

shapr: Explaining Machine Learning Models with Conditional Shapley Values in R and Python

Arxiv

0+阅读 · 2月2日

CLE-SH: Comprehensive Literal Explanation package for SHapley values by statistical validity

Arxiv

0+阅读 · 1月30日

VIP会员

文章信息

相关主题

最新内容

【斯坦福博士论文】语言模型的机械可解释性与控制

【斯坦福博士论文】语言模型的机械可解释性与控制

专知会员服务

1+阅读 · 4月23日

大语言模型智能体长期记忆安全性综述：迈向记忆主权

大语言模型智能体长期记忆安全性综述：迈向记忆主权

专知会员服务

1+阅读 · 4月23日

美军被摧毁的空战装备：伊朗战争如何重创美国空中力量

美军被摧毁的空战装备：伊朗战争如何重创美国空中力量

专知会员服务

4+阅读 · 4月23日

人工智能赋能无人机：俄乌战争（万字长文）

人工智能赋能无人机：俄乌战争（万字长文）

专知会员服务

6+阅读 · 4月23日

国外海军作战管理系统与作战训练系统

国外海军作战管理系统与作战训练系统

专知会员服务

3+阅读 · 4月23日

美军条令《海军陆战队规划流程（2026版）》

美军条令《海军陆战队规划流程（2026版）》

专知会员服务

10+阅读 · 4月23日

《压缩式分布式交互仿真标准》120页

《压缩式分布式交互仿真标准》120页

专知会员服务

4+阅读 · 4月23日

《电子战数据交换模型研究报告》

《电子战数据交换模型研究报告》

专知会员服务

6+阅读 · 4月23日

美军运用水下无人机与机器人系统竞速清除霍尔木兹海峡水雷

美军运用水下无人机与机器人系统竞速清除霍尔木兹海峡水雷

专知会员服务

4+阅读 · 4月23日

《基于Transformer的异常舰船导航识别与跟踪》80页

《基于Transformer的异常舰船导航识别与跟踪》80页

专知会员服务

8+阅读 · 4月23日

《美国太空系统司令部实验室原型作战管理系统的数据与决策可追溯性》

《美国太空系统司令部实验室原型作战管理系统的数据与决策可追溯性》

专知会员服务

6+阅读 · 4月23日

《低数据领域军事目标检测模型研究》

《低数据领域军事目标检测模型研究》

专知会员服务

6+阅读 · 4月23日

《为韧性而设计：在战略不确定时代提升军事空军基地的生存能力》

《为韧性而设计：在战略不确定时代提升军事空军基地的生存能力》

专知会员服务

6+阅读 · 4月23日

【CMU博士论文】物理世界的视觉感知与深度理解

【CMU博士论文】物理世界的视觉感知与深度理解

专知会员服务

10+阅读 · 4月22日

多智能体系统：从经典范式到大基础模型驱动的未来

多智能体系统：从经典范式到大基础模型驱动的未来

专知会员服务

18+阅读 · 4月22日

相关VIP内容

【ETH博士论文】机器学习数据估值算法与应用研究进展，225页pdf

【ETH博士论文】机器学习数据估值算法与应用研究进展，225页pdf

专知会员服务

38+阅读 · 2023年9月18日

【2023新书】用SHAP解释机器学习模型:Python示例和Shapley值理论指南，216页pdf

【2023新书】用SHAP解释机器学习模型:Python示例和Shapley值理论指南，216页pdf

专知会员服务

83+阅读 · 2023年8月31日

伯克利《因果推断》讲义，因果推断第一课，全文428页

伯克利《因果推断》讲义，因果推断第一课，全文428页

专知会员服务

149+阅读 · 2023年6月3日

【2022新书】机器学习中的概率数值计算，412页pdf

【2022新书】机器学习中的概率数值计算，412页pdf

专知会员服务

93+阅读 · 2022年7月7日

因果推断，Causal Inference：The Mixtape

因果推断，Causal Inference：The Mixtape

专知会员服务

110+阅读 · 2021年8月27日

【KDD2021】基于因果反事实Shapley的MARL信度分配

专知会员服务

19+阅读 · 2021年7月11日

Google最新《机器学习对偶性》报告，48页ppt

Google最新《机器学习对偶性》报告，48页ppt

专知会员服务

36+阅读 · 2020年11月29日

【SIGIR2020-中科院计算所】L2R2: 利用排名进行外展推理，L2R2: Leveraging Ranking for Abductive Reasoning

【SIGIR2020-中科院计算所】L2R2: 利用排名进行外展推理，L2R2: Leveraging Ranking for Abductive Reasoning

专知会员服务

11+阅读 · 2020年5月25日

【北大-阿里巴巴】深度哈希方法综述，23页pdf，A Survey on Deep Hashing Methods

【北大-阿里巴巴】深度哈希方法综述，23页pdf，A Survey on Deep Hashing Methods

专知会员服务

27+阅读 · 2020年3月9日

【独立研究者I-Sheng Yang论文】因果机器学习损失函数（A Loss-Function for Causal Machine-Learning）

【独立研究者I-Sheng Yang论文】因果机器学习损失函数（A Loss-Function for Causal Machine-Learning）

专知会员服务

20+阅读 · 2020年1月7日

热门VIP内容

开通专知VIP会员享更多权益服务

大语言模型智能体长期记忆安全性综述：迈向记忆主权

人工智能赋能无人机：俄乌战争（万字长文）

【斯坦福博士论文】语言模型的机械可解释性与控制

美军被摧毁的空战装备：伊朗战争如何重创美国空中力量

相关资讯

【2022新书】机器学习中的概率数值计算，412页pdf

【2022新书】机器学习中的概率数值计算，412页pdf

专知

33+阅读 · 2022年7月7日

最新「因果推断Causal Inference」综述论文38页pdf，阿里巴巴、Buffalo、Georgia、Virginia

最新「因果推断Causal Inference」综述论文38页pdf，阿里巴巴、Buffalo、Georgia、Virginia

专知

68+阅读 · 2020年2月11日

这一份217页斯坦福大学统计学习理论笔记，Percy Liang带你搞清楚难懂的理论基础

这一份217页斯坦福大学统计学习理论笔记，Percy Liang带你搞清楚难懂的理论基础

专知

24+阅读 · 2018年12月20日

斯坦福统计学习理论笔记：Percy Liang带你搞定「贼难」的理论基础

斯坦福统计学习理论笔记：Percy Liang带你搞定「贼难」的理论基础

机器之心

26+阅读 · 2018年12月18日

Facebook AI发布新版本FairSeq序列到序列(Seq2Seq)学习工具，可生成故事与快速推断

Facebook AI发布新版本FairSeq序列到序列(Seq2Seq)学习工具，可生成故事与快速推断

专知

23+阅读 · 2018年6月17日

【机器学习基本理论】详解最大似然估计（MLE）、最大后验概率估计（MAP），以及贝叶斯公式的理解

【机器学习基本理论】详解最大似然估计（MLE）、最大后验概率估计（MAP），以及贝叶斯公式的理解

机器学习研究会

19+阅读 · 2018年3月11日

推荐算法：Match与Rank模型的交织配合

推荐算法：Match与Rank模型的交织配合

从0到1

15+阅读 · 2017年12月18日

最新｜深度离散哈希算法，可用于图像检索！

最新｜深度离散哈希算法，可用于图像检索！

全球人工智能

14+阅读 · 2017年12月15日

【技术分享】智能感知与计算研究中心NIPS 2017论文提出深度离散哈希算法，可用于图像检索

【技术分享】智能感知与计算研究中心NIPS 2017论文提出深度离散哈希算法，可用于图像检索

机器学习研究会

12+阅读 · 2017年11月3日

【机器学习】【推荐系统】做推荐系统之前，希望有人告诉我这些

【机器学习】【推荐系统】做推荐系统之前，希望有人告诉我这些

产业智能官

11+阅读 · 2017年10月14日

相关论文

How important are the genes to explain the outcome - the asymmetric Shapley value as an honest importance metric for high-dimensional features

Arxiv

0+阅读 · 3月5日

Local Shapley: Model-Induced Locality and Optimal Reuse in Data Valuation

Arxiv

0+阅读 · 3月4日

Enhancing the Interpretability of SHAP Values Using Large Language Models

Arxiv

0+阅读 · 3月3日

Joint Distribution-Informed Shapley Values for Sparse Counterfactual Explanations

Arxiv

0+阅读 · 2月27日

Statistical Inference and Learning for Shapley Additive Explanations (SHAP)

Arxiv

0+阅读 · 2月11日

Computing Conditional Shapley Values Using Tabular Foundation Models

Arxiv

0+阅读 · 2月10日

Faithful Group Shapley Value

Arxiv

0+阅读 · 2月10日

In-Run Data Shapley for Adam Optimizer

Arxiv

0+阅读 · 2月6日

shapr: Explaining Machine Learning Models with Conditional Shapley Values in R and Python

Arxiv

0+阅读 · 2月2日

CLE-SH: Comprehensive Literal Explanation package for SHapley values by statistical validity

Arxiv

0+阅读 · 1月30日

相关基金

处理效应差异中位数的有效估计

国家自然科学基金

0+阅读 · 2015年12月31日

逻辑等价算子在不确定性推理中的应用

国家自然科学基金

1+阅读 · 2015年12月31日

基于复杂数据的回归模型统计推断及其应用

国家自然科学基金

3+阅读 · 2015年12月31日

低密度奇偶校验码的误码平层和迭代译码算法的混沌特性分析

国家自然科学基金

0+阅读 · 2015年12月31日

有理 Krylov 子空间算法的最优参数选取

国家自然科学基金

0+阅读 · 2015年12月31日

振荡哈密尔顿波方程的几何数值积分

国家自然科学基金

0+阅读 · 2015年12月31日

基于深度学习的机器译文质量估计方法研究

国家自然科学基金

3+阅读 · 2014年12月31日

随机Helmholtz型问题的数值方法

国家自然科学基金

0+阅读 · 2014年12月31日

基于似然函数的统计推断

国家自然科学基金

5+阅读 · 2014年12月31日

因果推断的统计方法

国家自然科学基金

26+阅读 · 2011年12月31日

微信扫码咨询专知VIP会员