A Noise Sensitivity Exponent Controls Large Statistical-to-Computational Gaps in Single- and Multi-Index Models - 专知论文

会员服务 ·

0

噪声 · 数控 · 高维 · 高维统计学 · 基准 ·

A Noise Sensitivity Exponent Controls Large Statistical-to-Computational Gaps in Single- and Multi-Index Models

翻译：一个噪声敏感指数控制着单索引和多索引模型中的大统计-计算差距

Leonardo Defilippis,Florent Krzakala,Bruno Loureiro,Antoine Maillard

Understanding when learning is statistically possible yet computationally hard is a central challenge in high-dimensional statistics. In this work, we investigate this question in the context of single- and multi-index models, classes of functions widely studied as benchmarks to probe the ability of machine learning methods to discover features in high-dimensional data. Our main contribution is to show that a Noise Sensitivity Exponent (NSE) - a simple quantity determined by the activation function - governs the existence and magnitude of statistical-to-computational gaps within a broad regime of these models. We first establish that, in single-index models with large additive noise, the onset of a computational bottleneck is fully characterized by the NSE. We then demonstrate that the same exponent controls a statistical-computational gap in the specialization transition of large separable multi-index models, where individual components become learnable. Finally, in hierarchical multi-index models, we show that the NSE governs the optimal computational rate in which different directions are sequentially learned. Taken together, our results identify the NSE as a unifying property linking noise robustness, computational hardness, and feature specialization in high-dimensional learning.

翻译：理解学习在统计上可能但在计算上困难是高维统计学中的一个核心挑战。在这项工作中，我们在单索引和多索引模型的背景下研究这一问题，这些函数类被广泛用作基准，以探究机器学习方法在高维数据中发现特征的能力。我们的主要贡献是证明噪声敏感指数（NSE）——一个由激活函数决定的简单量——在这些模型的广泛范围内控制着统计-计算差距的存在与大小。我们首先表明，在具有大加性噪声的单索引模型中，计算瓶颈的出现完全由NSE刻画。然后，我们证明同一指数控制着大型可分离多索引模型中专门化转变的统计-计算差距，其中单个分量变得可学习。最后，在层次化多索引模型中，我们表明NSE决定了不同方向被顺序学习的最优计算速率。综上所述，我们的结果将NSE识别为一种统一属性，将高维学习中的噪声鲁棒性、计算难度和特征专门化联系起来。

0

相关内容

大型语言模型的规模效应局限

大型语言模型的规模效应局限

专知会员服务

14+阅读 · 2025年11月18日

【普林斯顿博士论文】大规模模型的迁移学习与优化理论

【普林斯顿博士论文】大规模模型的迁移学习与优化理论

专知会员服务

35+阅读 · 2025年2月15日

【斯坦福大学博士论文】高效且可信的机器学习的统计方法，267页pdf

【斯坦福大学博士论文】高效且可信的机器学习的统计方法，267页pdf

专知会员服务

29+阅读 · 2024年8月20日

【MIT博士论文】大规模机器学习算法：效率、估计误差及其拓展

【MIT博士论文】大规模机器学习算法：效率、估计误差及其拓展

专知会员服务

29+阅读 · 2024年8月3日

【牛津大学博士论文】变分自编码器: 监督、校准和多模态学习的变分自编码器，179页pdf

【牛津大学博士论文】变分自编码器: 监督、校准和多模态学习的变分自编码器，179页pdf

专知会员服务

38+阅读 · 2023年6月21日

【CVPR2023】带有噪声标签的孪生对比学习

【CVPR2023】带有噪声标签的孪生对比学习

专知会员服务

33+阅读 · 2023年3月16日

【PSL博士论文】论数据受限环境下机器学习的归纳偏差，112页pdf

【PSL博士论文】论数据受限环境下机器学习的归纳偏差，112页pdf

专知会员服务

40+阅读 · 2023年2月22日

《机器学习的数学与统计学基础》，91页ppt，牛津大学Elizaveta Semenova

《机器学习的数学与统计学基础》，91页ppt，牛津大学Elizaveta Semenova

专知会员服务

89+阅读 · 2022年9月26日

【TPAMI2022】关联关系驱动的多模态分类，AF: An Association-based Fusion Method for Multi-Modal Classification

【TPAMI2022】关联关系驱动的多模态分类，AF: An Association-based Fusion Method for Multi-Modal Classification

专知会员服务

27+阅读 · 2022年3月22日

当SVM碰上对比学习？霍普金斯/MIT学者在AAAI2022提出《最大化间隔对比学习》选择更好的负样例提升对比性能

当SVM碰上对比学习？霍普金斯/MIT学者在AAAI2022提出《最大化间隔对比学习》选择更好的负样例提升对比性能

专知会员服务

48+阅读 · 2021年12月22日

【干货书】高维统计学，572页pdf

【干货书】高维统计学，572页pdf

专知

20+阅读 · 2021年12月3日

机器学习领域必知必会的12种概率分布（附Python代码实现）

机器学习领域必知必会的12种概率分布（附Python代码实现）

算法与数学之美

21+阅读 · 2019年10月18日

一文教你如何处理不平衡数据集（附代码）

一文教你如何处理不平衡数据集（附代码）

大数据文摘

12+阅读 · 2019年6月2日

用深度学习揭示数据的因果关系

用深度学习揭示数据的因果关系

专知

28+阅读 · 2019年5月18日

【机器学习】深入剖析机器学习中的统计思想

【机器学习】深入剖析机器学习中的统计思想

产业智能官

17+阅读 · 2019年1月24日

资源 | 李航老师《统计学习方法》的Python 3.6复现，实测可用

资源 | 李航老师《统计学习方法》的Python 3.6复现，实测可用

专知

40+阅读 · 2018年12月17日

稀疏性的3个优势 -《稀疏统计学习及其应用》

稀疏性的3个优势 -《稀疏统计学习及其应用》

遇见数学

15+阅读 · 2018年10月24日

如何用机器学习精准辨别“背景”和“目标”

如何用机器学习精准辨别“背景”和“目标”

论智

10+阅读 · 2018年10月22日

【干货】机器学习中的五种回归模型及其优缺点

【干货】机器学习中的五种回归模型及其优缺点

专知

21+阅读 · 2018年3月29日

FCS 论坛 | 孟德宇：误差建模原理

FCS 论坛 | 孟德宇：误差建模原理

FCS

15+阅读 · 2017年8月17日

基于对象模型与多点空间统计的高分辨率遥感影像分类策略

国家自然科学基金

4+阅读 · 2015年12月31日

基于约束等距条件的噪音低秩矩阵恢复算法研究

国家自然科学基金

1+阅读 · 2015年12月31日

多标签降维中的多重代价敏感学习问题研究

国家自然科学基金

2+阅读 · 2015年12月31日

高维不平衡数据的集成学习算法研究

国家自然科学基金

17+阅读 · 2015年12月31日

非高斯噪声中基于分数低阶统计量的频谱感知技术研究

国家自然科学基金

1+阅读 · 2015年12月31日

数据内在结构和稀疏保持的大间隔分类方法研究

国家自然科学基金

2+阅读 · 2015年12月31日

基于广义部分线性单指标模型的高维纵向数据统计分析

国家自然科学基金

1+阅读 · 2015年12月31日

复杂数据模型中的分布逼近方法

国家自然科学基金

3+阅读 · 2014年12月31日

高维数据下的模型平均方法

国家自然科学基金

6+阅读 · 2014年12月31日

复杂多元数据的半参数统计推断

国家自然科学基金

5+阅读 · 2014年12月31日

Data Balancing Strategies: A Systematic Survey of Resampling and Augmentation Methods

Arxiv

0+阅读 · 4月28日

Generalising maximum mean discrepancy: kernelised functional Bregman divergences

Arxiv

0+阅读 · 4月27日

BBP transition and the leading eigenvector of the spiked Wigner model with inhomogeneous noise

Arxiv

0+阅读 · 4月20日

Algorithmic Contiguity from Low-Degree Heuristic II: Predicting Detection-Recovery Gaps

Arxiv

0+阅读 · 4月19日

A Sensitivity Approach to Causal Inference Under Limited Overlap

Arxiv

0+阅读 · 4月18日

NeuroPareto: Calibrated Acquisition for Costly Many-Goal Search in Vast Parameter Spaces

Arxiv

0+阅读 · 4月14日

Bridging the Semantic Gap for Categorical Data Clustering via Large Language Models

Arxiv

0+阅读 · 4月5日

Large multi-response linear regression estimation based on low-rank pre-smoothing

Arxiv

0+阅读 · 3月27日

Establishing Stochastic Object Models from Noisy Data via Ambient Measurement-Integrated Diffusion

Arxiv

0+阅读 · 3月25日

Towards The Implicit Bias on Multiclass Separable Data Under Norm Constraints

Arxiv

0+阅读 · 3月24日

VIP会员

文章信息

相关主题

高维统计学

最新内容

ICML 2026 | 边界嵌入塑形：用自适应对比学习破解图结构纠缠

ICML 2026 | 边界嵌入塑形：用自适应对比学习破解图结构纠缠

专知会员服务

2+阅读 · 6月22日

综述 | 3D场景图：开放挑战与未来方向

综述 | 3D场景图：开放挑战与未来方向

专知会员服务

2+阅读 · 6月22日

《国防工业6.0：全自主作战系统、量子-人工智能融合与新一代战略威慑》

《国防工业6.0：全自主作战系统、量子-人工智能融合与新一代战略威慑》

专知会员服务

3+阅读 · 6月22日

21世纪的无人机战争

21世纪的无人机战争

专知会员服务

3+阅读 · 6月22日

《伊朗与以色列-美国热战及其对数字技术的影响》

《伊朗与以色列-美国热战及其对数字技术的影响》

专知会员服务

3+阅读 · 6月22日

《量子技术的军事任务技术适配与利用》

《量子技术的军事任务技术适配与利用》

专知会员服务

3+阅读 · 6月22日

《美国陆军军官学校（西点军校）本科生科研中生成式人工智能的使用》

《美国陆军军官学校（西点军校）本科生科研中生成式人工智能的使用》

专知会员服务

4+阅读 · 6月22日

美国从乌克兰无人机战争中学习经验

美国从乌克兰无人机战争中学习经验

专知会员服务

7+阅读 · 6月21日

ICML 2026 | 面向视觉语言模型的语义鲁棒性认证

ICML 2026 | 面向视觉语言模型的语义鲁棒性认证

专知会员服务

5+阅读 · 6月21日

综述 | 智能体电子设计自动化：从“交接有效性”重新理解Agentic EDA

综述 | 智能体电子设计自动化：从“交接有效性”重新理解Agentic EDA

专知会员服务

8+阅读 · 6月21日

深入解读 Palantir AIP：全球最具争议的人工智能平台究竟如何运作

深入解读 Palantir AIP：全球最具争议的人工智能平台究竟如何运作

专知会员服务

20+阅读 · 6月20日

ICML 2026 | 多任务贝叶斯上下文学习：让 Transformer 在测试时显式适应新先验

ICML 2026 | 多任务贝叶斯上下文学习：让 Transformer 在测试时显式适应新先验

专知会员服务

5+阅读 · 6月19日

ACL 2026综述 | 大规模手语数据集：资源、基准与标注标准

ACL 2026综述 | 大规模手语数据集：资源、基准与标注标准

专知会员服务

8+阅读 · 6月19日

ICML 2026 Spotlight | SmoothSMoE：解析稀疏 MoE 路由不连续

ICML 2026 Spotlight | SmoothSMoE：解析稀疏 MoE 路由不连续

专知会员服务

7+阅读 · 6月18日

综述 | 周期表视角下的大模型推理：范式、方法与失败模式

综述 | 周期表视角下的大模型推理：范式、方法与失败模式

专知会员服务

9+阅读 · 6月18日

相关VIP内容

大型语言模型的规模效应局限

大型语言模型的规模效应局限

专知会员服务

14+阅读 · 2025年11月18日

【普林斯顿博士论文】大规模模型的迁移学习与优化理论

【普林斯顿博士论文】大规模模型的迁移学习与优化理论

专知会员服务

35+阅读 · 2025年2月15日

【斯坦福大学博士论文】高效且可信的机器学习的统计方法，267页pdf

【斯坦福大学博士论文】高效且可信的机器学习的统计方法，267页pdf

专知会员服务

29+阅读 · 2024年8月20日

【MIT博士论文】大规模机器学习算法：效率、估计误差及其拓展

【MIT博士论文】大规模机器学习算法：效率、估计误差及其拓展

专知会员服务

29+阅读 · 2024年8月3日

【牛津大学博士论文】变分自编码器: 监督、校准和多模态学习的变分自编码器，179页pdf

【牛津大学博士论文】变分自编码器: 监督、校准和多模态学习的变分自编码器，179页pdf

专知会员服务

38+阅读 · 2023年6月21日

【CVPR2023】带有噪声标签的孪生对比学习

【CVPR2023】带有噪声标签的孪生对比学习

专知会员服务

33+阅读 · 2023年3月16日

【PSL博士论文】论数据受限环境下机器学习的归纳偏差，112页pdf

【PSL博士论文】论数据受限环境下机器学习的归纳偏差，112页pdf

专知会员服务

40+阅读 · 2023年2月22日

《机器学习的数学与统计学基础》，91页ppt，牛津大学Elizaveta Semenova

《机器学习的数学与统计学基础》，91页ppt，牛津大学Elizaveta Semenova

专知会员服务

89+阅读 · 2022年9月26日

【TPAMI2022】关联关系驱动的多模态分类，AF: An Association-based Fusion Method for Multi-Modal Classification

【TPAMI2022】关联关系驱动的多模态分类，AF: An Association-based Fusion Method for Multi-Modal Classification

专知会员服务

27+阅读 · 2022年3月22日

当SVM碰上对比学习？霍普金斯/MIT学者在AAAI2022提出《最大化间隔对比学习》选择更好的负样例提升对比性能

当SVM碰上对比学习？霍普金斯/MIT学者在AAAI2022提出《最大化间隔对比学习》选择更好的负样例提升对比性能

专知会员服务

48+阅读 · 2021年12月22日

热门VIP内容

开通专知VIP会员享更多权益服务

综述 | 3D场景图：开放挑战与未来方向

21世纪的无人机战争

ICML 2026 | 边界嵌入塑形：用自适应对比学习破解图结构纠缠

《国防工业6.0：全自主作战系统、量子-人工智能融合与新一代战略威慑》

相关资讯

【干货书】高维统计学，572页pdf

【干货书】高维统计学，572页pdf

专知

20+阅读 · 2021年12月3日

机器学习领域必知必会的12种概率分布（附Python代码实现）

机器学习领域必知必会的12种概率分布（附Python代码实现）

算法与数学之美

21+阅读 · 2019年10月18日

一文教你如何处理不平衡数据集（附代码）

一文教你如何处理不平衡数据集（附代码）

大数据文摘

12+阅读 · 2019年6月2日

用深度学习揭示数据的因果关系

用深度学习揭示数据的因果关系

专知

28+阅读 · 2019年5月18日

【机器学习】深入剖析机器学习中的统计思想

【机器学习】深入剖析机器学习中的统计思想

产业智能官

17+阅读 · 2019年1月24日

资源 | 李航老师《统计学习方法》的Python 3.6复现，实测可用

资源 | 李航老师《统计学习方法》的Python 3.6复现，实测可用

专知

40+阅读 · 2018年12月17日

稀疏性的3个优势 -《稀疏统计学习及其应用》

稀疏性的3个优势 -《稀疏统计学习及其应用》

遇见数学

15+阅读 · 2018年10月24日

如何用机器学习精准辨别“背景”和“目标”

如何用机器学习精准辨别“背景”和“目标”

论智

10+阅读 · 2018年10月22日

【干货】机器学习中的五种回归模型及其优缺点

【干货】机器学习中的五种回归模型及其优缺点

专知

21+阅读 · 2018年3月29日

FCS 论坛 | 孟德宇：误差建模原理

FCS 论坛 | 孟德宇：误差建模原理

FCS

15+阅读 · 2017年8月17日

相关论文

Data Balancing Strategies: A Systematic Survey of Resampling and Augmentation Methods

Arxiv

0+阅读 · 4月28日

Generalising maximum mean discrepancy: kernelised functional Bregman divergences

Arxiv

0+阅读 · 4月27日

BBP transition and the leading eigenvector of the spiked Wigner model with inhomogeneous noise

Arxiv

0+阅读 · 4月20日

Algorithmic Contiguity from Low-Degree Heuristic II: Predicting Detection-Recovery Gaps

Arxiv

0+阅读 · 4月19日

A Sensitivity Approach to Causal Inference Under Limited Overlap

Arxiv

0+阅读 · 4月18日

NeuroPareto: Calibrated Acquisition for Costly Many-Goal Search in Vast Parameter Spaces

Arxiv

0+阅读 · 4月14日

Bridging the Semantic Gap for Categorical Data Clustering via Large Language Models

Arxiv

0+阅读 · 4月5日

Large multi-response linear regression estimation based on low-rank pre-smoothing

Arxiv

0+阅读 · 3月27日

Establishing Stochastic Object Models from Noisy Data via Ambient Measurement-Integrated Diffusion

Arxiv

0+阅读 · 3月25日

Towards The Implicit Bias on Multiclass Separable Data Under Norm Constraints

Arxiv

0+阅读 · 3月24日

相关基金

基于对象模型与多点空间统计的高分辨率遥感影像分类策略

国家自然科学基金

4+阅读 · 2015年12月31日

基于约束等距条件的噪音低秩矩阵恢复算法研究

国家自然科学基金

1+阅读 · 2015年12月31日

多标签降维中的多重代价敏感学习问题研究

国家自然科学基金

2+阅读 · 2015年12月31日

高维不平衡数据的集成学习算法研究

国家自然科学基金

17+阅读 · 2015年12月31日

非高斯噪声中基于分数低阶统计量的频谱感知技术研究

国家自然科学基金

1+阅读 · 2015年12月31日

数据内在结构和稀疏保持的大间隔分类方法研究

国家自然科学基金

2+阅读 · 2015年12月31日

基于广义部分线性单指标模型的高维纵向数据统计分析

国家自然科学基金

1+阅读 · 2015年12月31日

复杂数据模型中的分布逼近方法

国家自然科学基金

3+阅读 · 2014年12月31日

高维数据下的模型平均方法

国家自然科学基金

6+阅读 · 2014年12月31日

复杂多元数据的半参数统计推断

国家自然科学基金

5+阅读 · 2014年12月31日

微信扫码咨询专知VIP会员