Deterministic Event-Graph Substrates as World Models for Counterfactual Reasoning - 专知论文

会员服务 ·

0

反事实 · 事件 · 三元 · 三元组 · 基准 ·

Deterministic Event-Graph Substrates as World Models for Counterfactual Reasoning

翻译：确定性事件图基板作为反事实推理的世界模型

from arxiv, 10 pages, 3 figures, 2 tables

We study event-graph substrates: a class of world models that represent agent state as an append-only log of typed RDF triples and answer counterfactual queries by forking the log under a structured intervention vocabulary. Substrates are inspectable at the triple level, support exact counterfactuals, and transfer across domains without learned components. We formalize the class, prove a duality between explanatory and counterfactual queries that reduces both to the same causal-ancestor traversal, and evaluate a 1,400-line CLEVRER-DSL interpreter atop a domain-agnostic substrate runtime at full CLEVRER validation scale (n=75,618). The substrate exceeds the NS-DR symbolic oracle on all four per-question categories (by 9.89, 20.26, 17.65, and 0.80 percentage points), and exceeds the parametric ALOE baseline on descriptive and explanatory while lagging on predictive and counterfactual. We also introduce twin-EventLog, a 500-specification Park-canonical Smallville counterfactual benchmark on which the substrate exceeds Llama-3.1-8B with full context by 18.80 points joint accuracy.

翻译：我们研究事件图基板：一类世界模型，将智能体状态表示为仅追加类型的RDF三元组日志，并通过在结构化干预词汇下分叉日志来回答反事实查询。基板可在三元组层面进行检查，支持精确反事实，并在无需学习组件的情况下跨领域迁移。我们形式化了该类，证明了解释性查询与反事实查询之间的对偶性，将两者简化为相同的因果祖先遍历，并在领域无关的基板运行时上评估了1,400行的CLEVRER-DSL解释器，覆盖完整CLEVRER验证集规模（n=75,618）。该基板在所有四个问题类别上均超过NS-DR符号预测器（分别高出9.89、20.26、17.65和0.80个百分点），并在描述性和解释性问题上超过参数化ALOE基线，但在预测性和反事实问题上略逊。我们还引入了twin-EventLog——一个包含500个规范、基于Park标准Smallville的反事实基准，在该基准上，基板在联合准确率上超过具备完整上下文的Llama-3.1-8B模型18.80个百分点。

0

相关内容

反事实

【综述】世界模型：架构、方法、推理与应用全景

【综述】世界模型：架构、方法、推理与应用全景

专知会员服务

27+阅读 · 6月2日

《图世界模型：概念、分类体系与未来方向》

《图世界模型：概念、分类体系与未来方向》

专知会员服务

21+阅读 · 5月1日

推荐系统的图基础模型综述

推荐系统的图基础模型综述

专知会员服务

20+阅读 · 2025年2月13日

【WWW2024】博弈论式反事实解释图神经网络

【WWW2024】博弈论式反事实解释图神经网络

专知会员服务

32+阅读 · 2024年2月17日

图上如何建模因果性？PSU等最新《图反事实学习》综述，50页pdf全面综述图公平性、可解释性等方法

图上如何建模因果性？PSU等最新《图反事实学习》综述，50页pdf全面综述图公平性、可解释性等方法

专知会员服务

74+阅读 · 2023年4月12日

图上如何可解释？首篇《图反事实解释:定义、方法、评价》综述，46页pdf165篇文献全面概述图反事实解释进展

图上如何可解释？首篇《图反事实解释:定义、方法、评价》综述，46页pdf165篇文献全面概述图反事实解释进展

专知会员服务

41+阅读 · 2022年10月24日

什么是事件知识图谱？中科院计算所发布《事件知识图谱综述》论文，阐述从历史、本体、实例和应用视角定义EKG

什么是事件知识图谱？中科院计算所发布《事件知识图谱综述》论文，阐述从历史、本体、实例和应用视角定义EKG

专知会员服务

102+阅读 · 2022年1月5日

反事实如何理解？看这份华为KDD2021《反事实解释及在XAI中的应用》教程，附143页Slides

反事实如何理解？看这份华为KDD2021《反事实解释及在XAI中的应用》教程，附143页Slides

专知会员服务

105+阅读 · 2021年8月16日

事件图谱的构建、推理与应用

专知会员服务

129+阅读 · 2021年6月12日

基于事理图谱的应用与实践

专知会员服务

71+阅读 · 2021年4月27日

图上如何建模因果性？PSU等最新《图反事实学习》综述，50页pdf全面综述图公平性、可解释性等方法

图上如何建模因果性？PSU等最新《图反事实学习》综述，50页pdf全面综述图公平性、可解释性等方法

专知

55+阅读 · 2023年4月13日

图谱实战 | 真实世界医疗知识图谱及临床事件图谱构建

图谱实战 | 真实世界医疗知识图谱及临床事件图谱构建

开放知识图谱

11+阅读 · 2022年10月10日

面向大数据领域的事理认知图谱构建与推断分析

面向大数据领域的事理认知图谱构建与推断分析

专知

21+阅读 · 2020年8月11日

事件知识图谱构建技术与应用综述

事件知识图谱构建技术与应用综述

专知

25+阅读 · 2020年8月6日

事件知识图谱构建研究进展与趋势

事件知识图谱构建研究进展与趋势

THU数据派

99+阅读 · 2019年12月11日

论文浅尝 | 基于事理图谱的脚本事件预测

论文浅尝 | 基于事理图谱的脚本事件预测

开放知识图谱

10+阅读 · 2019年12月10日

事理图谱：事件演化的规律和模式

事理图谱：事件演化的规律和模式

哈工大SCIR

34+阅读 · 2019年7月19日

用模型不确定性理解模型

用模型不确定性理解模型

论智

11+阅读 · 2018年9月5日

赛尔原创 | IJCAI 2018基于叙事事理图谱和可扩展图神经⽹络的脚本事件预测模型

赛尔原创 | IJCAI 2018基于叙事事理图谱和可扩展图神经⽹络的脚本事件预测模型

哈工大SCIR

48+阅读 · 2018年5月7日

概率图模型体系：HMM、MEMM、CRF

概率图模型体系：HMM、MEMM、CRF

机器学习研究会

30+阅读 · 2018年2月10日

结合知识图谱的概率话题模型研究

国家自然科学基金

10+阅读 · 2015年12月31日

逻辑等价算子在不确定性推理中的应用

国家自然科学基金

1+阅读 · 2015年12月31日

融入时空关系联合判别学习的地基云图序列分类方法研究

国家自然科学基金

0+阅读 · 2015年12月31日

面向社交大数据的热点事件预测

国家自然科学基金

11+阅读 · 2015年12月31日

复杂数据下带有形状约束的半参数模型统计推断

国家自然科学基金

3+阅读 · 2014年12月31日

面向微博数据的位置相关事件检测和时空异常聚类模式挖掘研究

国家自然科学基金

0+阅读 · 2014年12月31日

面向事件分析的信息意图检测、建模与群体意图推理技术研究

国家自然科学基金

12+阅读 · 2014年12月31日

线性时序关系下推理的概率计量化模型

国家自然科学基金

0+阅读 · 2014年12月31日

概率图模型学习及其在数据分析中的应用研究

国家自然科学基金

16+阅读 · 2013年12月31日

不确定性推理与语义网中知识表示的数学基础

国家自然科学基金

18+阅读 · 2012年12月31日

Critique of World Model: A Generative Latent Prediction Architecture for World Modeling

Arxiv

0+阅读 · 6月16日

EventConnector: Mining Social Event Relations through Temporal Graphs

Arxiv

0+阅读 · 6月13日

ExPLAIND: Unifying Model, Data, and Training Attribution to Study Model Behavior

Arxiv

0+阅读 · 6月11日

WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning

Arxiv

0+阅读 · 6月10日

Querying Counterfactuals on Tissue Graphs with Supervised Disentanglement

Arxiv

0+阅读 · 6月10日

A Counting Process View of Relational Event Models: Practical Asymptotics

Arxiv

0+阅读 · 6月4日

Counterfactual Explanations for Hypergraph Neural Networks

Arxiv

0+阅读 · 5月24日

The Log is the Agent: Event-Sourced Reactive Graphs for Auditable, Forkable Agentic Systems

Arxiv

0+阅读 · 5月21日

An Axiomatic Foundation for Decisions with Counterfactual Utility

Arxiv

0+阅读 · 5月6日

A Survey of Reasoning with Foundation Models

Arxiv

43+阅读 · 2024年1月25日

VIP会员

文章信息

相关主题

最新内容

ICML 2026 | 多任务贝叶斯上下文学习：让 Transformer 在测试时显式适应新先验

ICML 2026 | 多任务贝叶斯上下文学习：让 Transformer 在测试时显式适应新先验

专知会员服务

2+阅读 · 6月19日

ACL 2026综述 | 大规模手语数据集：资源、基准与标注标准

ACL 2026综述 | 大规模手语数据集：资源、基准与标注标准

专知会员服务

4+阅读 · 6月19日

ICML 2026 Spotlight | SmoothSMoE：解析稀疏 MoE 路由不连续

ICML 2026 Spotlight | SmoothSMoE：解析稀疏 MoE 路由不连续

专知会员服务

5+阅读 · 6月18日

综述 | 周期表视角下的大模型推理：范式、方法与失败模式

综述 | 周期表视角下的大模型推理：范式、方法与失败模式

专知会员服务

6+阅读 · 6月18日

《廉价自杀式无人机战争的军事战略影响：乌克兰和伊朗案例研究》

《廉价自杀式无人机战争的军事战略影响：乌克兰和伊朗案例研究》

专知会员服务

11+阅读 · 6月18日

《面向反无人机作战的联邦式可解释射频–光电/红外情报融合：边缘人工智能优化、电子战韧性及分布式监视验证》

《面向反无人机作战的联邦式可解释射频–光电/红外情报融合：边缘人工智能优化、电子战韧性及分布式监视验证》

专知会员服务

9+阅读 · 6月18日

ICML 2026 | FR3D：解耦自车运动的未来动态三维重建世界模型

ICML 2026 | FR3D：解耦自车运动的未来动态三维重建世界模型

专知会员服务

6+阅读 · 6月17日

【伯克利博士论文】迈向可扩展与自我演进的大语言模型智能体

【伯克利博士论文】迈向可扩展与自我演进的大语言模型智能体

专知会员服务

9+阅读 · 6月17日

学习数据的几何：形状空间分析数学综述

学习数据的几何：形状空间分析数学综述

专知会员服务

7+阅读 · 6月17日

《现代防空系统综述：架构、传感器、拦截器及新兴威胁环境对基础设施受限防御环境的影响》2026最新长综述

《现代防空系统综述：架构、传感器、拦截器及新兴威胁环境对基础设施受限防御环境的影响》2026最新长综述

专知会员服务

13+阅读 · 6月17日

定向能反无人机系统最新发展动态

定向能反无人机系统最新发展动态

专知会员服务

8+阅读 · 6月17日

从燃煤战舰到算法战争：水面指挥的永恒要求

从燃煤战舰到算法战争：水面指挥的永恒要求

专知会员服务

6+阅读 · 6月17日

《短程弹道再入飞行器拦截时间中的一项异常现象》

《短程弹道再入飞行器拦截时间中的一项异常现象》

专知会员服务

8+阅读 · 6月17日

《基于回归方法与任务上下文的对抗环境动态战术网络报文优先级排序》

《基于回归方法与任务上下文的对抗环境动态战术网络报文优先级排序》

专知会员服务

8+阅读 · 6月17日

美智库《战术级指挥控制的迫切要求：构建弹性机动式指挥控制网络》报告

美智库《战术级指挥控制的迫切要求：构建弹性机动式指挥控制网络》报告

专知会员服务

10+阅读 · 6月17日

相关VIP内容

【综述】世界模型：架构、方法、推理与应用全景

【综述】世界模型：架构、方法、推理与应用全景

专知会员服务

27+阅读 · 6月2日

《图世界模型：概念、分类体系与未来方向》

《图世界模型：概念、分类体系与未来方向》

专知会员服务

21+阅读 · 5月1日

推荐系统的图基础模型综述

推荐系统的图基础模型综述

专知会员服务

20+阅读 · 2025年2月13日

【WWW2024】博弈论式反事实解释图神经网络

【WWW2024】博弈论式反事实解释图神经网络

专知会员服务

32+阅读 · 2024年2月17日

图上如何建模因果性？PSU等最新《图反事实学习》综述，50页pdf全面综述图公平性、可解释性等方法

图上如何建模因果性？PSU等最新《图反事实学习》综述，50页pdf全面综述图公平性、可解释性等方法

专知会员服务

74+阅读 · 2023年4月12日

图上如何可解释？首篇《图反事实解释:定义、方法、评价》综述，46页pdf165篇文献全面概述图反事实解释进展

图上如何可解释？首篇《图反事实解释:定义、方法、评价》综述，46页pdf165篇文献全面概述图反事实解释进展

专知会员服务

41+阅读 · 2022年10月24日

什么是事件知识图谱？中科院计算所发布《事件知识图谱综述》论文，阐述从历史、本体、实例和应用视角定义EKG

什么是事件知识图谱？中科院计算所发布《事件知识图谱综述》论文，阐述从历史、本体、实例和应用视角定义EKG

专知会员服务

102+阅读 · 2022年1月5日

反事实如何理解？看这份华为KDD2021《反事实解释及在XAI中的应用》教程，附143页Slides

反事实如何理解？看这份华为KDD2021《反事实解释及在XAI中的应用》教程，附143页Slides

专知会员服务

105+阅读 · 2021年8月16日

事件图谱的构建、推理与应用

专知会员服务

129+阅读 · 2021年6月12日

基于事理图谱的应用与实践

专知会员服务

71+阅读 · 2021年4月27日

热门VIP内容

开通专知VIP会员享更多权益服务

ACL 2026综述 | 大规模手语数据集：资源、基准与标注标准

综述 | 周期表视角下的大模型推理：范式、方法与失败模式

ICML 2026 | 多任务贝叶斯上下文学习：让 Transformer 在测试时显式适应新先验

ICML 2026 Spotlight | SmoothSMoE：解析稀疏 MoE 路由不连续

相关资讯

图上如何建模因果性？PSU等最新《图反事实学习》综述，50页pdf全面综述图公平性、可解释性等方法

图上如何建模因果性？PSU等最新《图反事实学习》综述，50页pdf全面综述图公平性、可解释性等方法

专知

55+阅读 · 2023年4月13日

图谱实战 | 真实世界医疗知识图谱及临床事件图谱构建

图谱实战 | 真实世界医疗知识图谱及临床事件图谱构建

开放知识图谱

11+阅读 · 2022年10月10日

面向大数据领域的事理认知图谱构建与推断分析

面向大数据领域的事理认知图谱构建与推断分析

专知

21+阅读 · 2020年8月11日

事件知识图谱构建技术与应用综述

事件知识图谱构建技术与应用综述

专知

25+阅读 · 2020年8月6日

事件知识图谱构建研究进展与趋势

事件知识图谱构建研究进展与趋势

THU数据派

99+阅读 · 2019年12月11日

论文浅尝 | 基于事理图谱的脚本事件预测

论文浅尝 | 基于事理图谱的脚本事件预测

开放知识图谱

10+阅读 · 2019年12月10日

事理图谱：事件演化的规律和模式

事理图谱：事件演化的规律和模式

哈工大SCIR

34+阅读 · 2019年7月19日

用模型不确定性理解模型

用模型不确定性理解模型

论智

11+阅读 · 2018年9月5日

赛尔原创 | IJCAI 2018基于叙事事理图谱和可扩展图神经⽹络的脚本事件预测模型

赛尔原创 | IJCAI 2018基于叙事事理图谱和可扩展图神经⽹络的脚本事件预测模型

哈工大SCIR

48+阅读 · 2018年5月7日

概率图模型体系：HMM、MEMM、CRF

概率图模型体系：HMM、MEMM、CRF

机器学习研究会

30+阅读 · 2018年2月10日

相关论文

Critique of World Model: A Generative Latent Prediction Architecture for World Modeling

Arxiv

0+阅读 · 6月16日

EventConnector: Mining Social Event Relations through Temporal Graphs

Arxiv

0+阅读 · 6月13日

ExPLAIND: Unifying Model, Data, and Training Attribution to Study Model Behavior

Arxiv

0+阅读 · 6月11日

WorldReasoner: Evaluating Whether Language Model Agents Forecast Events with Valid Reasoning

Arxiv

0+阅读 · 6月10日

Querying Counterfactuals on Tissue Graphs with Supervised Disentanglement

Arxiv

0+阅读 · 6月10日

A Counting Process View of Relational Event Models: Practical Asymptotics

Arxiv

0+阅读 · 6月4日

Counterfactual Explanations for Hypergraph Neural Networks

Arxiv

0+阅读 · 5月24日

The Log is the Agent: Event-Sourced Reactive Graphs for Auditable, Forkable Agentic Systems

Arxiv

0+阅读 · 5月21日

An Axiomatic Foundation for Decisions with Counterfactual Utility

Arxiv

0+阅读 · 5月6日

A Survey of Reasoning with Foundation Models

Arxiv

43+阅读 · 2024年1月25日

相关基金

结合知识图谱的概率话题模型研究

国家自然科学基金

10+阅读 · 2015年12月31日

逻辑等价算子在不确定性推理中的应用

国家自然科学基金

1+阅读 · 2015年12月31日

融入时空关系联合判别学习的地基云图序列分类方法研究

国家自然科学基金

0+阅读 · 2015年12月31日

面向社交大数据的热点事件预测

国家自然科学基金

11+阅读 · 2015年12月31日

复杂数据下带有形状约束的半参数模型统计推断

国家自然科学基金

3+阅读 · 2014年12月31日

面向微博数据的位置相关事件检测和时空异常聚类模式挖掘研究

国家自然科学基金

0+阅读 · 2014年12月31日

面向事件分析的信息意图检测、建模与群体意图推理技术研究

国家自然科学基金

12+阅读 · 2014年12月31日

线性时序关系下推理的概率计量化模型

国家自然科学基金

0+阅读 · 2014年12月31日

概率图模型学习及其在数据分析中的应用研究

国家自然科学基金

16+阅读 · 2013年12月31日

不确定性推理与语义网中知识表示的数学基础

国家自然科学基金

18+阅读 · 2012年12月31日

微信扫码咨询专知VIP会员