Controlling Logical Collapse in LLMs via Algebraic Ontology Projection over F2 - 专知论文

会员服务 ·

0

本体 · 投影 · 语言模型 · 结构 · 准确率 ·

Controlling Logical Collapse in LLMs via Algebraic Ontology Projection over F2

翻译：基于F2代数本体投影控制大语言模型中的逻辑坍缩

Hisashi Miyashita,Mgnite Inc

Do large language models internally encode ontological relations in a formally verifiable algebraic structure? We introduce Algebraic Ontology Projection (AOP), which projects LLM hidden states into the Galois Field F2 under Liskov Substitution Principle constraints, using only 42 relational pairs as algebraic keys. AOP achieves up to 93.33% zero-shot inclusion accuracy on unseen concept pairs (Gemma-2 Instruct with optimized prompt), with consistent 86.67% accuracy observed across multiple model families -- with no model tuning, but through prompt alone. This algebraic structure is strongly layer-dependent. We introduce Semantic Crystallisation (SC), a metric that quantifies F2 constraint satisfaction relative to a random baseline and predicts zero-shot accuracy without held-out data. System prompts act as algebraic boundary conditions: only their combination with instruction tuning prevents Late-layer Collapse -- a systematic degradation of logical consistency in the final layers, observed in 7 of 10 conditions. These findings reframe forward computation as an iterative process of algebraic organisation, and open a path toward LLMs whose logical structure is not merely approximated, but formally accessible.

翻译：大型语言模型是否在内部以可形式验证的代数结构编码本体关系？我们提出代数本体投影（AOP），该方法在里氏替换原则约束下将大语言模型隐藏状态投影到伽罗瓦域F2中，仅使用42对关系对作为代数密钥。在未见过概念对上，AOP实现了最高93.33%的零样本包含准确率（Gemma-2 Instruct模型配合优化提示），且在多类模型族中观察到一致的86.67%准确率——无需模型调优，仅通过提示工程实现。该代数结构具有显著的层次依赖性。我们引入语义结晶（SC）指标，该指标量化了F2约束满足度相对于随机基线的偏离程度，并可在无留出数据的情况下预测零样本准确率。系统提示充当代数边界条件：仅当其与指令微调共同作用时，才能阻止深层坍缩——一种在最终层出现的逻辑一致性系统性退化现象，在10种实验条件中有7种观测到该现象。这些发现将前向计算重新定义为代数组织的迭代过程，并为构建逻辑结构不仅可近似、更可形式化访问的大语言模型开辟了新路径。

0

相关内容

管理 LLM 智能体中的演进式记忆：风险、机理及稳定性与安全性受控记忆（SSGM）框架

管理 LLM 智能体中的演进式记忆：风险、机理及稳定性与安全性受控记忆（SSGM）框架

专知会员服务

16+阅读 · 3月14日

NeurIPS 2025 | NMKE：基于神经元归因与动态稀疏掩码的终身知识编辑

NeurIPS 2025 | NMKE：基于神经元归因与动态稀疏掩码的终身知识编辑

专知会员服务

12+阅读 · 2025年12月21日

KDD25 | 大语言模型能否提高图神经网络的对抗鲁棒性？

KDD25 | 大语言模型能否提高图神经网络的对抗鲁棒性？

专知会员服务

19+阅读 · 2024年12月18日

EMNLP 2024 | 基于知识编辑的大模型敏感知识擦除

EMNLP 2024 | 基于知识编辑的大模型敏感知识擦除

专知会员服务

22+阅读 · 2024年11月19日

ICLR2024 | 语言模型知识编辑的鲁棒性研究

ICLR2024 | 语言模型知识编辑的鲁棒性研究

专知会员服务

18+阅读 · 2024年3月15日

ICLR2024｜Mol-Instructions: 面向大模型的大规模生物分子指令数据集

ICLR2024｜Mol-Instructions: 面向大模型的大规模生物分子指令数据集

专知会员服务

12+阅读 · 2024年2月10日

【EMNLP 2023】基于大语言模型辩论的多智能体协作推理分析

【EMNLP 2023】基于大语言模型辩论的多智能体协作推理分析

专知会员服务

44+阅读 · 2023年11月27日

WSDM 2024| LLMs助力图学习？基于大模型的图数据增强

WSDM 2024| LLMs助力图学习？基于大模型的图数据增强

专知会员服务

27+阅读 · 2023年11月19日

EMNLP2023：MMEdit——如何编辑多模态大语言模型？

EMNLP2023：MMEdit——如何编辑多模态大语言模型？

专知会员服务

39+阅读 · 2023年11月5日

【ICCV2023最佳论文】ControlNet: 为文本到图像扩散模型添加条件控制

【ICCV2023最佳论文】ControlNet: 为文本到图像扩散模型添加条件控制

专知会员服务

27+阅读 · 2023年10月4日

NLP领域最近比较火的Prompt，能否借鉴到多模态领域？一文跟进最新进展

NLP领域最近比较火的Prompt，能否借鉴到多模态领域？一文跟进最新进展

PaperWeekly

17+阅读 · 2022年3月8日

“推荐系统”加上“图神经网络”

“推荐系统”加上“图神经网络”

机器学习与推荐算法

12+阅读 · 2020年3月23日

赛尔原创 | EMNLP 2019 基于上下文感知的变分自编码器建模事件背景知识进行If-Then类型常识推理

赛尔原创 | EMNLP 2019 基于上下文感知的变分自编码器建模事件背景知识进行If-Then类型常识推理

哈工大SCIR

17+阅读 · 2019年9月23日

Hierarchically Structured Meta-learning

Hierarchically Structured Meta-learning

CreateAMind

27+阅读 · 2019年5月22日

近期语音类前沿论文

近期语音类前沿论文

深度学习每日摘要

14+阅读 · 2019年3月17日

Unsupervised Learning via Meta-Learning

Unsupervised Learning via Meta-Learning

CreateAMind

44+阅读 · 2019年1月3日

A Technical Overview of AI & ML in 2018 & Trends for 2019

A Technical Overview of AI & ML in 2018 & Trends for 2019

待字闺中

18+阅读 · 2018年12月24日

disentangled-representation-papers

disentangled-representation-papers

CreateAMind

26+阅读 · 2018年9月12日

【论文推荐】最新八篇主题模型相关论文—在线光谱学习、PAM变分推断、章节推荐、多芯片系统、文本分析、动态主题模型

【论文推荐】最新八篇主题模型相关论文—在线光谱学习、PAM变分推断、章节推荐、多芯片系统、文本分析、动态主题模型

专知

12+阅读 · 2018年5月6日

论文浅尝 | Improved Neural Relation Detection for KBQA

论文浅尝 | Improved Neural Relation Detection for KBQA

开放知识图谱

13+阅读 · 2018年1月21日

张量框架下高维遥感影像空-谱协同解译方法研究

国家自然科学基金

1+阅读 · 2016年12月31日

过度拉伸的DNA的微观结构与稳定性的动力学研究

国家自然科学基金

0+阅读 · 2015年12月31日

“模块化自组装”DNA计算模型的研究

国家自然科学基金

3+阅读 · 2015年12月31日

冠状动脉系统建模及其高阶滑模控制研究

国家自然科学基金

1+阅读 · 2015年12月31日

脉冲式干扰下高超声速飞行器的有限时间状态受限控制

国家自然科学基金

0+阅读 · 2015年12月31日

基于Phase-type分布的多状态系统可靠性模型研究

国家自然科学基金

0+阅读 · 2015年12月31日

三角剪切模型控制参数间定量关系的物理模拟研究

国家自然科学基金

0+阅读 · 2015年12月31日

延迟Hamilton系统保结构算法研究及其应用

国家自然科学基金

0+阅读 · 2014年12月31日

大规模格结构数据管理关键技术研究

国家自然科学基金

1+阅读 · 2014年12月31日

基于生物网络的高维多目标算法及其在分布式调度中的应用

国家自然科学基金

0+阅读 · 2014年12月31日

Prior over Evidence: Stereotype-Driven Diagnosis in LLM-Based L2 Pronunciation Feedback

Arxiv

0+阅读 · 6月13日

Game-Theoretic Multi-Agent Control for Robust Contextual Reasoning in LLMs

Arxiv

0+阅读 · 6月12日

SciR: A Controllable Benchmark for Scientific Reasoning in LLMs

Arxiv

0+阅读 · 6月11日

Diagnosing Multi-step Reasoning Failures in Black-box LLMs via Stepwise Confidence Attribution

Arxiv

0+阅读 · 6月7日

Self-Evaluation Is Already There: Eliciting Latent Judge Calibration in Base LLMs with Minimal Data

Arxiv

0+阅读 · 6月3日

Integrating Local and Global Entropy for Uncertainty Quantification in LLMs

Arxiv

0+阅读 · 6月2日

Proof-Carrying Certificates for LLM Pipelines: A Trust-Boundary Architecture

Arxiv

0+阅读 · 5月13日

LLMs as Implicit Imputers: Uncertainty Should Scale with Missing Information

Arxiv

0+阅读 · 5月13日

Parameter-Efficient Neuroevolution for Diverse LLM Generation: Quality-Diversity Optimization via Prompt Embedding Evolution

Arxiv

0+阅读 · 5月10日

Shorthand for Thought: Compressing LLM Reasoning via Entropy-Guided Supertokens

Arxiv

0+阅读 · 5月5日

VIP会员

文章信息

相关主题

最新内容

ICML 2026 | VOTP：用视频基础模型与最优传输，让离线偏好强化学习只需少量反馈

ICML 2026 | VOTP：用视频基础模型与最优传输，让离线偏好强化学习只需少量反馈

专知会员服务

1+阅读 · 53分钟前

多模态代码智能综述：从视觉输入到可执行代码系统

多模态代码智能综述：从视觉输入到可执行代码系统

专知会员服务

1+阅读 · 55分钟前

美国马六甲“三重网”概念：安全网、威慑网与杀伤网

美国马六甲“三重网”概念：安全网、威慑网与杀伤网

专知会员服务

3+阅读 · 今天8:18

《面向导弹有效发射时机的监督机器学习方法：基于超视距空战仿真》

《面向导弹有效发射时机的监督机器学习方法：基于超视距空战仿真》

专知会员服务

3+阅读 · 今天7:39

《通用大语言模型：无人机指挥与控制接口》最新40页

《通用大语言模型：无人机指挥与控制接口》最新40页

专知会员服务

9+阅读 · 今天7:33

《通过小型无人机系统将情报能力“作战化”》

《通过小型无人机系统将情报能力“作战化”》

专知会员服务

3+阅读 · 今天7:28

《神经安全型有人–无人协同：面向认知自适应作战能力的参考架构》

《神经安全型有人–无人协同：面向认知自适应作战能力的参考架构》

专知会员服务

6+阅读 · 今天7:14

《在指挥链中通过多准则决策分析传达指挥官意图：空战实验》

《在指挥链中通过多准则决策分析传达指挥官意图：空战实验》

专知会员服务

18+阅读 · 6月15日

消耗优势：美军的“精确规模化”概念

消耗优势：美军的“精确规模化”概念

专知会员服务

7+阅读 · 6月15日

五角大楼的AI优先战略及其对现代战争的启示：来自与伊朗冲突的经验教训

五角大楼的AI优先战略及其对现代战争的启示：来自与伊朗冲突的经验教训

专知会员服务

8+阅读 · 6月15日

《网络空间兵棋推演：挑战、局限性与混合路径》报告

《网络空间兵棋推演：挑战、局限性与混合路径》报告

专知会员服务

8+阅读 · 6月15日

《离线语言支持系统：面向空战战术决策》

《离线语言支持系统：面向空战战术决策》

专知会员服务

8+阅读 · 6月15日

《以通信为中心的6G–LLM架构：面向可扩展的战术自主防御车辆网络》

《以通信为中心的6G–LLM架构：面向可扩展的战术自主防御车辆网络》

专知会员服务

7+阅读 · 6月15日

ICML 2026｜ECA：面向开放式图文生成的高效持续对齐

ICML 2026｜ECA：面向开放式图文生成的高效持续对齐

专知会员服务

6+阅读 · 6月14日

可信智能体AI综述：安全、鲁棒性、隐私与系统安全

可信智能体AI综述：安全、鲁棒性、隐私与系统安全

专知会员服务

6+阅读 · 6月14日

相关VIP内容

管理 LLM 智能体中的演进式记忆：风险、机理及稳定性与安全性受控记忆（SSGM）框架

管理 LLM 智能体中的演进式记忆：风险、机理及稳定性与安全性受控记忆（SSGM）框架

专知会员服务

16+阅读 · 3月14日

NeurIPS 2025 | NMKE：基于神经元归因与动态稀疏掩码的终身知识编辑

NeurIPS 2025 | NMKE：基于神经元归因与动态稀疏掩码的终身知识编辑

专知会员服务

12+阅读 · 2025年12月21日

KDD25 | 大语言模型能否提高图神经网络的对抗鲁棒性？

KDD25 | 大语言模型能否提高图神经网络的对抗鲁棒性？

专知会员服务

19+阅读 · 2024年12月18日

EMNLP 2024 | 基于知识编辑的大模型敏感知识擦除

EMNLP 2024 | 基于知识编辑的大模型敏感知识擦除

专知会员服务

22+阅读 · 2024年11月19日

ICLR2024 | 语言模型知识编辑的鲁棒性研究

ICLR2024 | 语言模型知识编辑的鲁棒性研究

专知会员服务

18+阅读 · 2024年3月15日

ICLR2024｜Mol-Instructions: 面向大模型的大规模生物分子指令数据集

ICLR2024｜Mol-Instructions: 面向大模型的大规模生物分子指令数据集

专知会员服务

12+阅读 · 2024年2月10日

【EMNLP 2023】基于大语言模型辩论的多智能体协作推理分析

【EMNLP 2023】基于大语言模型辩论的多智能体协作推理分析

专知会员服务

44+阅读 · 2023年11月27日

WSDM 2024| LLMs助力图学习？基于大模型的图数据增强

WSDM 2024| LLMs助力图学习？基于大模型的图数据增强

专知会员服务

27+阅读 · 2023年11月19日

EMNLP2023：MMEdit——如何编辑多模态大语言模型？

EMNLP2023：MMEdit——如何编辑多模态大语言模型？

专知会员服务

39+阅读 · 2023年11月5日

【ICCV2023最佳论文】ControlNet: 为文本到图像扩散模型添加条件控制

【ICCV2023最佳论文】ControlNet: 为文本到图像扩散模型添加条件控制

专知会员服务

27+阅读 · 2023年10月4日

热门VIP内容

开通专知VIP会员享更多权益服务

多模态代码智能综述：从视觉输入到可执行代码系统

《面向导弹有效发射时机的监督机器学习方法：基于超视距空战仿真》

ICML 2026 | VOTP：用视频基础模型与最优传输，让离线偏好强化学习只需少量反馈

美国马六甲“三重网”概念：安全网、威慑网与杀伤网

相关资讯

NLP领域最近比较火的Prompt，能否借鉴到多模态领域？一文跟进最新进展

NLP领域最近比较火的Prompt，能否借鉴到多模态领域？一文跟进最新进展

PaperWeekly

17+阅读 · 2022年3月8日

“推荐系统”加上“图神经网络”

“推荐系统”加上“图神经网络”

机器学习与推荐算法

12+阅读 · 2020年3月23日

赛尔原创 | EMNLP 2019 基于上下文感知的变分自编码器建模事件背景知识进行If-Then类型常识推理

赛尔原创 | EMNLP 2019 基于上下文感知的变分自编码器建模事件背景知识进行If-Then类型常识推理

哈工大SCIR

17+阅读 · 2019年9月23日

Hierarchically Structured Meta-learning

Hierarchically Structured Meta-learning

CreateAMind

27+阅读 · 2019年5月22日

近期语音类前沿论文

近期语音类前沿论文

深度学习每日摘要

14+阅读 · 2019年3月17日

Unsupervised Learning via Meta-Learning

Unsupervised Learning via Meta-Learning

CreateAMind

44+阅读 · 2019年1月3日

A Technical Overview of AI & ML in 2018 & Trends for 2019

A Technical Overview of AI & ML in 2018 & Trends for 2019

待字闺中

18+阅读 · 2018年12月24日

disentangled-representation-papers

disentangled-representation-papers

CreateAMind

26+阅读 · 2018年9月12日

【论文推荐】最新八篇主题模型相关论文—在线光谱学习、PAM变分推断、章节推荐、多芯片系统、文本分析、动态主题模型

【论文推荐】最新八篇主题模型相关论文—在线光谱学习、PAM变分推断、章节推荐、多芯片系统、文本分析、动态主题模型

专知

12+阅读 · 2018年5月6日

论文浅尝 | Improved Neural Relation Detection for KBQA

论文浅尝 | Improved Neural Relation Detection for KBQA

开放知识图谱

13+阅读 · 2018年1月21日

相关论文

Prior over Evidence: Stereotype-Driven Diagnosis in LLM-Based L2 Pronunciation Feedback

Arxiv

0+阅读 · 6月13日

Game-Theoretic Multi-Agent Control for Robust Contextual Reasoning in LLMs

Arxiv

0+阅读 · 6月12日

SciR: A Controllable Benchmark for Scientific Reasoning in LLMs

Arxiv

0+阅读 · 6月11日

Diagnosing Multi-step Reasoning Failures in Black-box LLMs via Stepwise Confidence Attribution

Arxiv

0+阅读 · 6月7日

Self-Evaluation Is Already There: Eliciting Latent Judge Calibration in Base LLMs with Minimal Data

Arxiv

0+阅读 · 6月3日

Integrating Local and Global Entropy for Uncertainty Quantification in LLMs

Arxiv

0+阅读 · 6月2日

Proof-Carrying Certificates for LLM Pipelines: A Trust-Boundary Architecture

Arxiv

0+阅读 · 5月13日

LLMs as Implicit Imputers: Uncertainty Should Scale with Missing Information

Arxiv

0+阅读 · 5月13日

Parameter-Efficient Neuroevolution for Diverse LLM Generation: Quality-Diversity Optimization via Prompt Embedding Evolution

Arxiv

0+阅读 · 5月10日

Shorthand for Thought: Compressing LLM Reasoning via Entropy-Guided Supertokens

Arxiv

0+阅读 · 5月5日

相关基金

张量框架下高维遥感影像空-谱协同解译方法研究

国家自然科学基金

1+阅读 · 2016年12月31日

过度拉伸的DNA的微观结构与稳定性的动力学研究

国家自然科学基金

0+阅读 · 2015年12月31日

“模块化自组装”DNA计算模型的研究

国家自然科学基金

3+阅读 · 2015年12月31日

冠状动脉系统建模及其高阶滑模控制研究

国家自然科学基金

1+阅读 · 2015年12月31日

脉冲式干扰下高超声速飞行器的有限时间状态受限控制

国家自然科学基金

0+阅读 · 2015年12月31日

基于Phase-type分布的多状态系统可靠性模型研究

国家自然科学基金

0+阅读 · 2015年12月31日

三角剪切模型控制参数间定量关系的物理模拟研究

国家自然科学基金

0+阅读 · 2015年12月31日

延迟Hamilton系统保结构算法研究及其应用

国家自然科学基金

0+阅读 · 2014年12月31日

大规模格结构数据管理关键技术研究

国家自然科学基金

1+阅读 · 2014年12月31日

基于生物网络的高维多目标算法及其在分布式调度中的应用

国家自然科学基金

0+阅读 · 2014年12月31日

微信扫码咨询专知VIP会员