【博士论文】从语言模型到宇宙结构：一种几何视角的探析 - 专知VIP

会员服务 ·

10

语言模型 · 博士论文 ·

【博士论文】从语言模型到宇宙结构：一种几何视角的探析

专知会员服务

专知，提供专业可信的知识分发服务，让认知协作更快更好！

复杂系统通常表现出特定的自组织几何与拓扑模式，其中蕴含的信息维度往往超越了传统统计方法的捕捉能力。本论文提出了一种统一的几何视角 (unified geometric perspective)，用于剖析两个截然不同的领域：宇宙物质的大尺度分布以及大语言模型（LLM）的内部表示。研究表明，持续同调 (persistent homology) —— 一种旨在追踪跨尺度几何特征“生灭”过程的拓扑数据分析工具 —— 在上述两种场景中均能提供与常规分析方法互补的关键信息。 * 在宇宙学领域：宇宙网的拓扑摘要能够捕捉到傅里叶空间统计量（Fourier-space statistics）所缺失的高阶空间相关性，进而优化对基本物理参数的约束，并有效打破参数间的简并性 (breaking degeneracies)。 * 在机器学习领域：通过追踪拓扑结构在 Transformer 隐藏层间的演化，本研究揭示了信息处理的通用相态 (universal phases)，并为模型压缩 (model compression) 提供了理论依据。

此外，除拓扑特征外，本研究进一步证明了本征维度 (intrinsic dimension) 与统计累积量 (statistical cumulants) 等几何度量能够将内部表示的几何特性与模型行为直接关联。具体而言，Token 表示的本征维度与预测不确定性显著相关，而累积量展开则揭示了模型在训练过程中逐步习得高阶结构动力学过程。 核心结论强调了方法论的互补性：几何与拓扑方法并非旨在取代现有的分析框架，而是对其进行了深度扩展，提取出了原本隐匿的、具有高可解释性的结构特征。这种跨领域的成功应用表明，几何与拓扑学正成为理解从宏观宇宙到人工智能等复杂系统的通用工具。

成为VIP会员查看完整内容

22

相关内容

语言模型

视频理解：从几何与语义表征到统一模型架构

视频理解：从几何与语义表征到统一模型架构

专知会员服务

20+阅读 · 3月21日

从感知到认知：多模态大语言模型中视觉-语言交互推理综述

从感知到认知：多模态大语言模型中视觉-语言交互推理综述

专知会员服务

32+阅读 · 2025年10月1日

【博士论文】学习视觉-语言表示以实现多模态理解

【博士论文】学习视觉-语言表示以实现多模态理解

专知会员服务

28+阅读 · 2025年2月8日

视觉如何模型统一？牛津大学Shuyang Sun博士论文《迈向统一视觉感知》全面阐述

视觉如何模型统一？牛津大学Shuyang Sun博士论文《迈向统一视觉感知》全面阐述

专知会员服务

47+阅读 · 2024年8月11日

几何图神经网络综述：数据结构、模型与应用

几何图神经网络综述：数据结构、模型与应用

专知会员服务

55+阅读 · 2024年3月4日

【MIT博士论文】建模神经网络表示空间的几何结构，365页pdf

【MIT博士论文】建模神经网络表示空间的几何结构，365页pdf

专知会员服务

58+阅读 · 2023年11月11日

【阿姆斯特丹博士论文】将结构融入神经模型进行语言处理，159页pdf

【阿姆斯特丹博士论文】将结构融入神经模型进行语言处理，159页pdf

专知会员服务

38+阅读 · 2023年4月11日

几何观点下的深度学习

几何观点下的深度学习

专知会员服务

37+阅读 · 2022年12月13日

【MIT博士论文】高维贝叶斯线性建模:层次建模、推理和评价的进展，250页pdf

【MIT博士论文】高维贝叶斯线性建模:层次建模、推理和评价的进展，250页pdf

专知会员服务

46+阅读 · 2022年10月1日

【博士论文】多视光场光线空间几何模型研究

【博士论文】多视光场光线空间几何模型研究

专知会员服务

24+阅读 · 2021年12月6日

【MIT博士论文】深度学习几何表示，138页pdf

【MIT博士论文】深度学习几何表示，138页pdf

专知

18+阅读 · 2022年9月4日

多模态视觉语言表征学习研究综述

多模态视觉语言表征学习研究综述

专知

27+阅读 · 2020年12月3日

【浙大博士论文】面向复杂场景理解的视觉内容识别、检测与推理方法研究

【浙大博士论文】面向复杂场景理解的视觉内容识别、检测与推理方法研究

专知

28+阅读 · 2020年7月26日

最新《几何深度学习》教程，100页ppt，Geometric Deep Learning

最新《几何深度学习》教程，100页ppt，Geometric Deep Learning

专知

13+阅读 · 2020年7月16日

论文浅尝 | 基于深度序列模型的知识图谱补全

论文浅尝 | 基于深度序列模型的知识图谱补全

开放知识图谱

29+阅读 · 2019年5月19日

每日论文 | CV中深度学习涉及到的几何和不确定性；用深度学习分析气象；可自动调整模拟器参数的模型

每日论文 | CV中深度学习涉及到的几何和不确定性；用深度学习分析气象；可自动调整模拟器参数的模型

论智

11+阅读 · 2018年10月9日

【深度学习】深度学习的几何观点：流形分布定律、学习能力的上限、概率变换的几何观点

【深度学习】深度学习的几何观点：流形分布定律、学习能力的上限、概率变换的几何观点

产业智能官

10+阅读 · 2018年6月23日

深度丨顾险峰：深度学习的几何观点——流形分布定律

深度丨顾险峰：深度学习的几何观点——流形分布定律

德先生

17+阅读 · 2018年6月11日

论文浅尝 | 基于知识图谱的子图匹配回答自然语言问题

论文浅尝 | 基于知识图谱的子图匹配回答自然语言问题

开放知识图谱

27+阅读 · 2018年5月17日

一文读懂复杂网络（应用、模型和研究历史）

一文读懂复杂网络（应用、模型和研究历史）

AI100

16+阅读 · 2017年11月14日

关于若干模型泛函不等式及其应用的研究

国家自然科学基金

1+阅读 · 2015年12月31日

分布无关的概率图模型结构学习方法的研究

国家自然科学基金

4+阅读 · 2015年12月31日

基于有限正交几何的图的自同构群研究

国家自然科学基金

0+阅读 · 2015年12月31日

基于格值逻辑的语言真值α-群锁语义归结自动推理研究

国家自然科学基金

0+阅读 · 2015年12月31日

异源主被动遥感多视立体成像几何模型研究

国家自然科学基金

0+阅读 · 2015年12月31日

基于草图的几何处理和应用

国家自然科学基金

2+阅读 · 2015年12月31日

几何与随机分析及其应用交叉平台

国家自然科学基金

0+阅读 · 2014年12月31日

基于信息密度的广义不确定直觉模糊集成算子及其应用

国家自然科学基金

0+阅读 · 2014年12月31日

共形几何代数框架下时空拓扑关系的统一表达与计算方法研究

国家自然科学基金

0+阅读 · 2014年12月31日

概率图模型学习及其在数据分析中的应用研究

国家自然科学基金

16+阅读 · 2013年12月31日

Boosting MLLM Spatial Reasoning with Geometrically Referenced 3D Scene Representations

Arxiv

0+阅读 · 3月9日

The Spacetime of Diffusion Models: An Information Geometry Perspective

Arxiv

0+阅读 · 2月26日

Geometric modelling of spatial extremes

Geometric modelling of spatial extremes

Arxiv

0+阅读 · 2月19日

Symmetry in language statistics shapes the geometry of model representations

Arxiv

0+阅读 · 2月16日

A Geometric Analysis of Small-sized Language Model Hallucinations

Arxiv

0+阅读 · 2月16日

Thinking with Geometry: Active Geometry Integration for Spatial Reasoning

Arxiv

0+阅读 · 2月10日

On the Uncertainty of Large Language Model-Based Multi-Agent Systems

Arxiv

0+阅读 · 2月9日

Thinking with Geometry: Active Geometry Integration for Spatial Reasoning

Arxiv

0+阅读 · 2月5日

Orthogonal Hierarchical Decomposition for Structure-Aware Table Understanding with Large Language Models

Arxiv

0+阅读 · 2月2日

Model Complexity of Deep Learning: A Survey

Arxiv

33+阅读 · 2021年3月8日

VIP会员

相关主题

最新内容

《美国空军B-2“幽灵”隐身轰炸机系统工程案例研究》117页

《美国空军B-2“幽灵”隐身轰炸机系统工程案例研究》117页

专知会员服务

5+阅读 · 8月1日

隐身技术前沿综述：物理机理、工程实践与战略展望

隐身技术前沿综述：物理机理、工程实践与战略展望

专知会员服务

4+阅读 · 8月1日

《多变海洋环境下无人水面艇与自主水下机器人对接的最优路径规划》

《多变海洋环境下无人水面艇与自主水下机器人对接的最优路径规划》

专知会员服务

3+阅读 · 8月1日

《以机反机：基于无人机载麦克风的空中周界入侵检测》

《以机反机：基于无人机载麦克风的空中周界入侵检测》

专知会员服务

4+阅读 · 8月1日

《无人机脆弱性利用：网络空间力量的新域》

《无人机脆弱性利用：网络空间力量的新域》

专知会员服务

2+阅读 · 8月1日

美空军如何将人工智能从战场部署至后方机关

美空军如何将人工智能从战场部署至后方机关

专知会员服务

11+阅读 · 7月31日

《美战争部指令文件：网络空间效应与使能能力测试评估》

《美战争部指令文件：网络空间效应与使能能力测试评估》

专知会员服务

7+阅读 · 7月31日

《史诗怒火行动：多域前瞻评估》49页报告

《史诗怒火行动：多域前瞻评估》49页报告

专知会员服务

7+阅读 · 7月31日

《英国防部：未来空战系统数字化战略》33页

《英国防部：未来空战系统数字化战略》33页

专知会员服务

5+阅读 · 7月31日

《面向自主飞行网络的智能体人工智能架构》

《面向自主飞行网络的智能体人工智能架构》

专知会员服务

7+阅读 · 7月31日

“史诗怒火”行动：现代多域作战的重要节点

“史诗怒火”行动：现代多域作战的重要节点

专知会员服务

8+阅读 · 7月30日

《下一代无线网络中的多无人机通信资源管理》

《下一代无线网络中的多无人机通信资源管理》

专知会员服务

8+阅读 · 7月30日

《高分辨率模拟下的聚合战斗建模：以“会战交锋”场景为例》

《高分辨率模拟下的聚合战斗建模：以“会战交锋”场景为例》

专知会员服务

9+阅读 · 7月30日

《人机协同在安全关键型操作决策中的应用》120页

《人机协同在安全关键型操作决策中的应用》120页

专知会员服务

8+阅读 · 7月30日

网络防御与空中力量网络防护：21世纪空中力量历史与理论的启示

网络防御与空中力量网络防护：21世纪空中力量历史与理论的启示

专知会员服务

6+阅读 · 7月30日

相关VIP内容

视频理解：从几何与语义表征到统一模型架构

视频理解：从几何与语义表征到统一模型架构

专知会员服务

20+阅读 · 3月21日

从感知到认知：多模态大语言模型中视觉-语言交互推理综述

从感知到认知：多模态大语言模型中视觉-语言交互推理综述

专知会员服务

32+阅读 · 2025年10月1日

【博士论文】学习视觉-语言表示以实现多模态理解

【博士论文】学习视觉-语言表示以实现多模态理解

专知会员服务

28+阅读 · 2025年2月8日

视觉如何模型统一？牛津大学Shuyang Sun博士论文《迈向统一视觉感知》全面阐述

视觉如何模型统一？牛津大学Shuyang Sun博士论文《迈向统一视觉感知》全面阐述

专知会员服务

47+阅读 · 2024年8月11日

几何图神经网络综述：数据结构、模型与应用

几何图神经网络综述：数据结构、模型与应用

专知会员服务

55+阅读 · 2024年3月4日

【MIT博士论文】建模神经网络表示空间的几何结构，365页pdf

【MIT博士论文】建模神经网络表示空间的几何结构，365页pdf

专知会员服务

58+阅读 · 2023年11月11日

【阿姆斯特丹博士论文】将结构融入神经模型进行语言处理，159页pdf

【阿姆斯特丹博士论文】将结构融入神经模型进行语言处理，159页pdf

专知会员服务

38+阅读 · 2023年4月11日

几何观点下的深度学习

几何观点下的深度学习

专知会员服务

37+阅读 · 2022年12月13日

【MIT博士论文】高维贝叶斯线性建模:层次建模、推理和评价的进展，250页pdf

【MIT博士论文】高维贝叶斯线性建模:层次建模、推理和评价的进展，250页pdf

专知会员服务

46+阅读 · 2022年10月1日

【博士论文】多视光场光线空间几何模型研究

【博士论文】多视光场光线空间几何模型研究

专知会员服务

24+阅读 · 2021年12月6日

热门VIP内容

开通专知VIP会员享更多权益服务

隐身技术前沿综述：物理机理、工程实践与战略展望

《以机反机：基于无人机载麦克风的空中周界入侵检测》

《美国空军B-2“幽灵”隐身轰炸机系统工程案例研究》117页

《多变海洋环境下无人水面艇与自主水下机器人对接的最优路径规划》

相关资讯

【MIT博士论文】深度学习几何表示，138页pdf

【MIT博士论文】深度学习几何表示，138页pdf

专知

18+阅读 · 2022年9月4日

多模态视觉语言表征学习研究综述

多模态视觉语言表征学习研究综述

专知

27+阅读 · 2020年12月3日

【浙大博士论文】面向复杂场景理解的视觉内容识别、检测与推理方法研究

【浙大博士论文】面向复杂场景理解的视觉内容识别、检测与推理方法研究

专知

28+阅读 · 2020年7月26日

最新《几何深度学习》教程，100页ppt，Geometric Deep Learning

最新《几何深度学习》教程，100页ppt，Geometric Deep Learning

专知

13+阅读 · 2020年7月16日

论文浅尝 | 基于深度序列模型的知识图谱补全

论文浅尝 | 基于深度序列模型的知识图谱补全

开放知识图谱

29+阅读 · 2019年5月19日

每日论文 | CV中深度学习涉及到的几何和不确定性；用深度学习分析气象；可自动调整模拟器参数的模型

每日论文 | CV中深度学习涉及到的几何和不确定性；用深度学习分析气象；可自动调整模拟器参数的模型

论智

11+阅读 · 2018年10月9日

【深度学习】深度学习的几何观点：流形分布定律、学习能力的上限、概率变换的几何观点

【深度学习】深度学习的几何观点：流形分布定律、学习能力的上限、概率变换的几何观点

产业智能官

10+阅读 · 2018年6月23日

深度丨顾险峰：深度学习的几何观点——流形分布定律

深度丨顾险峰：深度学习的几何观点——流形分布定律

德先生

17+阅读 · 2018年6月11日

论文浅尝 | 基于知识图谱的子图匹配回答自然语言问题

论文浅尝 | 基于知识图谱的子图匹配回答自然语言问题

开放知识图谱

27+阅读 · 2018年5月17日

一文读懂复杂网络（应用、模型和研究历史）

一文读懂复杂网络（应用、模型和研究历史）

AI100

16+阅读 · 2017年11月14日

相关基金

关于若干模型泛函不等式及其应用的研究

国家自然科学基金

1+阅读 · 2015年12月31日

分布无关的概率图模型结构学习方法的研究

国家自然科学基金

4+阅读 · 2015年12月31日

基于有限正交几何的图的自同构群研究

国家自然科学基金

0+阅读 · 2015年12月31日

基于格值逻辑的语言真值α-群锁语义归结自动推理研究

国家自然科学基金

0+阅读 · 2015年12月31日

异源主被动遥感多视立体成像几何模型研究

国家自然科学基金

0+阅读 · 2015年12月31日

基于草图的几何处理和应用

国家自然科学基金

2+阅读 · 2015年12月31日

几何与随机分析及其应用交叉平台

国家自然科学基金

0+阅读 · 2014年12月31日

基于信息密度的广义不确定直觉模糊集成算子及其应用

国家自然科学基金

0+阅读 · 2014年12月31日

共形几何代数框架下时空拓扑关系的统一表达与计算方法研究

国家自然科学基金

0+阅读 · 2014年12月31日

概率图模型学习及其在数据分析中的应用研究

国家自然科学基金

16+阅读 · 2013年12月31日

相关论文

Boosting MLLM Spatial Reasoning with Geometrically Referenced 3D Scene Representations

Arxiv

0+阅读 · 3月9日

The Spacetime of Diffusion Models: An Information Geometry Perspective

Arxiv

0+阅读 · 2月26日

Geometric modelling of spatial extremes

Geometric modelling of spatial extremes

Arxiv

0+阅读 · 2月19日

Symmetry in language statistics shapes the geometry of model representations

Arxiv

0+阅读 · 2月16日

A Geometric Analysis of Small-sized Language Model Hallucinations

Arxiv

0+阅读 · 2月16日

Thinking with Geometry: Active Geometry Integration for Spatial Reasoning

Arxiv

0+阅读 · 2月10日

On the Uncertainty of Large Language Model-Based Multi-Agent Systems

Arxiv

0+阅读 · 2月9日

Thinking with Geometry: Active Geometry Integration for Spatial Reasoning

Arxiv

0+阅读 · 2月5日

Orthogonal Hierarchical Decomposition for Structure-Aware Table Understanding with Large Language Models

Arxiv

0+阅读 · 2月2日

Model Complexity of Deep Learning: A Survey

Arxiv

33+阅读 · 2021年3月8日

微信扫码咨询专知VIP会员