Towards Solving the Gilbert-Pollak Conjecture via Large Language Models - 专知论文

会员服务 ·

0

下界 · 系统 · 语言模型 · 数学 · 大语言模型 ·

Towards Solving the Gilbert-Pollak Conjecture via Large Language Models

翻译：面向解决吉尔伯特-波拉克猜想：基于大型语言模型的探索

Yisi Ke,Tianyu Huang,Yankai Shu,Di He,Jingchu Gai,Liwei Wang

from arxiv, 44 pages, 11 figures

The Gilbert-Pollak Conjecture \citep{gilbert1968steiner}, also known as the Steiner Ratio Conjecture, states that for any finite point set in the Euclidean plane, the Steiner minimum tree has length at least $\sqrt{3}/2 \approx 0.866$ times that of the Euclidean minimum spanning tree (the Steiner ratio). A sequence of improvements through the 1980s culminated in a lower bound of $0.824$, with no substantial progress reported over the past three decades. Recent advances in LLMs have demonstrated strong performance on contest-level mathematical problems, yet their potential for addressing open, research-level questions remains largely unexplored. In this work, we present a novel AI system for obtaining tighter lower bounds on the Steiner ratio. Rather than directly prompting LLMs to solve the conjecture, we task them with generating rule-constrained geometric lemmas implemented as executable code. These lemmas are then used to construct a collection of specialized functions, which we call verification functions, that yield theoretically certified lower bounds of the Steiner ratio. Through progressive lemma refinement driven by reflection, the system establishes a new certified lower bound of 0.8559 for the Steiner ratio. The entire research effort involves only thousands of LLM calls, demonstrating the strong potential of LLM-based systems for advanced mathematical research.

翻译：吉尔伯特-波拉克猜想 (Gilbert-Pollak Conjecture) \citep{gilbert1968steiner}，亦称斯坦纳比猜想 (Steiner Ratio Conjecture)，指出：对于欧几里得平面中的任意有限点集，其斯坦纳最小树长度至少为欧几里得最小生成树长度的 $\sqrt{3}/2 \approx 0.866$ 倍（即斯坦纳比）。经过20世纪80年代一系列改进，该猜想的下界被提升至 $0.824$，但此后三十年间未取得实质性进展。近年来，大型语言模型 (LLMs) 在竞赛级数学问题上展现出强大性能，但其解决开放式研究级问题的潜力仍鲜有探索。本研究提出一种新型人工智能系统，旨在获得斯坦纳比更紧的下界。该系统并非直接提示LLMs求解该猜想，而是要求其生成受规则约束的几何引理，并以可执行代码形式实现。这些引理随后被用于构建一组专用函数（称为验证函数），从而导出理论上可认证的斯坦纳比下界。通过基于反思的渐进式引理精化，该系统的斯坦纳比认证下界更新为 0.8559。整个研究过程仅涉及数千次LLM调用，充分展示了基于LLM的系统在高级数学研究领域的巨大潜力。

0

相关内容

【博士论文】从语言模型到宇宙结构：一种几何视角的探析

【博士论文】从语言模型到宇宙结构：一种几何视角的探析

专知会员服务

22+阅读 · 3月4日

面向大语言模型对齐的机械解释性：进展、挑战与未来方向

面向大语言模型对齐的机械解释性：进展、挑战与未来方向

专知会员服务

14+阅读 · 2月14日

大语言模型的智能体化推理

大语言模型的智能体化推理

专知会员服务

35+阅读 · 1月21日

AAAI 2026 | 构建模板-定理知识图谱以增强大语言模型的数学推理能力

AAAI 2026 | 构建模板-定理知识图谱以增强大语言模型的数学推理能力

专知会员服务

20+阅读 · 1月17日

大语言模型推理前沿综述：推理扩展、推理学习与智能体系统

大语言模型推理前沿综述：推理扩展、推理学习与智能体系统

专知会员服务

39+阅读 · 2025年4月20日

AAAI 2024 |大模型时代，什么是比代码更好的数值推理中间表示？——方程

AAAI 2024 |大模型时代，什么是比代码更好的数值推理中间表示？——方程

专知会员服务

50+阅读 · 2024年2月2日

大模型如何从思维链(CoT)，到思维树(ToT)，再到思维图(GoT)：用LLMs解决复杂问题！

大模型如何从思维链(CoT)，到思维树(ToT)，再到思维图(GoT)：用LLMs解决复杂问题！

专知会员服务

78+阅读 · 2023年9月3日

「大型语言模型推理」综述

「大型语言模型推理」综述

专知会员服务

95+阅读 · 2022年12月24日

从图(Graph)到图卷积(Graph Convolution)：漫谈图神经网络模型

专知会员服务

97+阅读 · 2020年2月21日

【ECML-PKDD 2019】突破可解释性障碍——解释深度图卷积模型的一种方法（Breaking the interpretability barrier - a methodfor interpreting deep graph convolutional models）

【ECML-PKDD 2019】突破可解释性障碍——解释深度图卷积模型的一种方法（Breaking the interpretability barrier - a methodfor interpreting deep graph convolutional models）

专知会员服务

19+阅读 · 2019年12月1日

Transformer模型-深度学习自然语言处理，17页ppt

Transformer模型-深度学习自然语言处理，17页ppt

专知

14+阅读 · 2020年8月30日

谷歌ALBERT模型V2+中文版来了：之前刷新NLP各大基准，现在GitHub热榜第二

谷歌ALBERT模型V2+中文版来了：之前刷新NLP各大基准，现在GitHub热榜第二

量子位

14+阅读 · 2020年1月2日

KG 高引论文解读两篇 | 两种模型：多层卷积神经网络、知识感知路径递归网络

KG 高引论文解读两篇 | 两种模型：多层卷积神经网络、知识感知路径递归网络

学术头条

18+阅读 · 2019年12月8日

微软亚研提出VL-BERT：通用的视觉-语言预训练模型

微软亚研提出VL-BERT：通用的视觉-语言预训练模型

机器之心

15+阅读 · 2019年9月3日

面试题：简单说说贝叶斯定理

面试题：简单说说贝叶斯定理

七月在线实验室

12+阅读 · 2019年6月12日

论文浅尝 | 一种用于多关系问答的可解释推理网络

论文浅尝 | 一种用于多关系问答的可解释推理网络

开放知识图谱

18+阅读 · 2019年5月21日

中文版-BERT-预训练的深度双向Transformer语言模型-详细介绍

中文版-BERT-预训练的深度双向Transformer语言模型-详细介绍

深度学习与NLP

32+阅读 · 2019年3月30日

【深度学习】深度学习的几何观点：流形分布定律、学习能力的上限、概率变换的几何观点

【深度学习】深度学习的几何观点：流形分布定律、学习能力的上限、概率变换的几何观点

产业智能官

10+阅读 · 2018年6月23日

概率论之概念解析：用贝叶斯推断进行参数估计

概率论之概念解析：用贝叶斯推断进行参数估计

专知

14+阅读 · 2018年1月8日

最新｜深度离散哈希算法，可用于图像检索！

最新｜深度离散哈希算法，可用于图像检索！

全球人工智能

14+阅读 · 2017年12月15日

面向海量高维数据的可深度结合的贝叶斯网学习与推理新方法研究

国家自然科学基金

6+阅读 · 2015年12月31日

基于绝热量子计算模型求解数学问题的理论研究

国家自然科学基金

1+阅读 · 2015年12月31日

有向图的公平划分问题研究

国家自然科学基金

0+阅读 · 2015年12月31日

特殊图的整数流及群连通性问题的研究

国家自然科学基金

0+阅读 · 2015年12月31日

随机波动率模型的统计推断及数值解

国家自然科学基金

1+阅读 · 2015年12月31日

关于 Finsler 流形上调和映射与 Laplacian 的若干问题研究

国家自然科学基金

1+阅读 · 2014年12月31日

动态Gr？bner 基与GVW算法

国家自然科学基金

0+阅读 · 2014年12月31日

一个组合猜想及其相关问题的研究

国家自然科学基金

0+阅读 · 2014年12月31日

某些分形集上拉普拉斯算子的谱分析及相关问题

国家自然科学基金

0+阅读 · 2014年12月31日

不确定性推理与语义网中知识表示的数学基础

国家自然科学基金

18+阅读 · 2012年12月31日

Towards Efficient Large Language Reasoning Models via Extreme-Ratio Chain-of-Thought Compression

Arxiv

0+阅读 · 6月12日

Poker Arena: Multi-Axis Profiling of Strategic Reasoning and Memory in LLMs

Arxiv

0+阅读 · 6月11日

Almost-perfect packings and Tuza's conjecture in the random geometric graph

Arxiv

0+阅读 · 6月8日

DeInfer: Efficient Parallel Inferencing for Decomposed Large Language Models

Arxiv

0+阅读 · 6月3日

High-Dimensional Expanders, the Sparsest Cut Problem, and Steurer's Conjecture

Arxiv

0+阅读 · 5月29日

Counterexamples to a Conjecture on Laplacian Ratios of Trees

Arxiv

0+阅读 · 5月13日

Algorithms and Hardness for Geodetic Set on Tree-like Digraphs

Arxiv

0+阅读 · 5月13日

Counterexamples to an Extremal Conjecture for Random Cycle-Factors

Arxiv

0+阅读 · 5月7日

Rado's covering problem for cubes and balls: a semi-survey

Arxiv

0+阅读 · 4月24日

Efficient Rare-Event Simulation for Random Geometric Graphs via Importance Sampling

Arxiv

0+阅读 · 4月22日

VIP会员

文章信息

相关主题

大语言模型

最新内容

无人机自主控制与人工智能：系统性综述

无人机自主控制与人工智能：系统性综述

专知会员服务

5+阅读 · 今天7:25

巡飞弹与反无人机系统——现代战场的两大支柱

巡飞弹与反无人机系统——现代战场的两大支柱

专知会员服务

2+阅读 · 今天6:54

《打造“黄金舰队”》57页报告

《打造“黄金舰队”》57页报告

专知会员服务

1+阅读 · 今天6:52

《北约数字教官网络发展路径》128页报告

《北约数字教官网络发展路径》128页报告

专知会员服务

1+阅读 · 今天6:33

ECCV 2026 | MIMFlow：MIM与归一化流统一图像生成

ECCV 2026 | MIMFlow：MIM与归一化流统一图像生成

专知会员服务

6+阅读 · 6月25日

超越自回归边界：扩散模型、世界模型与SSM如何重塑代码智能

超越自回归边界：扩散模型、世界模型与SSM如何重塑代码智能

专知会员服务

5+阅读 · 6月25日

重塑决策优势：美军作战艺术与多域作战中联盟联合全域指挥控制（CJADC2）体系的融合

重塑决策优势：美军作战艺术与多域作战中联盟联合全域指挥控制（CJADC2）体系的融合

专知会员服务

9+阅读 · 6月25日

网状网络及其在军事领域的运用

网状网络及其在军事领域的运用

专知会员服务

7+阅读 · 6月25日

《意识即战场——全球安全体系中认知战的演进：乌克兰构建认知作战体系的展望》

《意识即战场——全球安全体系中认知战的演进：乌克兰构建认知作战体系的展望》

专知会员服务

8+阅读 · 6月25日

无美国参与的欧洲战争方式（万字长文）

无美国参与的欧洲战争方式（万字长文）

专知会员服务

8+阅读 · 6月25日

重构“下一场战争”的制胜理论：超越兰彻斯特方程与现代系统

重构“下一场战争”的制胜理论：超越兰彻斯特方程与现代系统

专知会员服务

9+阅读 · 6月25日

《国防工业中基于模型定义的实施：产品定义数字化转型的战略路径》90页

《国防工业中基于模型定义的实施：产品定义数字化转型的战略路径》90页

专知会员服务

9+阅读 · 6月25日

《国防领域敏感性分析白皮书》

《国防领域敏感性分析白皮书》

专知会员服务

9+阅读 · 6月25日

综述 | 从问答到任务完成：Agent系统与Harness设计

综述 | 从问答到任务完成：Agent系统与Harness设计

专知会员服务

9+阅读 · 6月24日

Agentic RL：框架、实践与长程智能体训练

Agentic RL：框架、实践与长程智能体训练

专知会员服务

10+阅读 · 6月24日

相关VIP内容

【博士论文】从语言模型到宇宙结构：一种几何视角的探析

【博士论文】从语言模型到宇宙结构：一种几何视角的探析

专知会员服务

22+阅读 · 3月4日

面向大语言模型对齐的机械解释性：进展、挑战与未来方向

面向大语言模型对齐的机械解释性：进展、挑战与未来方向

专知会员服务

14+阅读 · 2月14日

大语言模型的智能体化推理

大语言模型的智能体化推理

专知会员服务

35+阅读 · 1月21日

AAAI 2026 | 构建模板-定理知识图谱以增强大语言模型的数学推理能力

AAAI 2026 | 构建模板-定理知识图谱以增强大语言模型的数学推理能力

专知会员服务

20+阅读 · 1月17日

大语言模型推理前沿综述：推理扩展、推理学习与智能体系统

大语言模型推理前沿综述：推理扩展、推理学习与智能体系统

专知会员服务

39+阅读 · 2025年4月20日

AAAI 2024 |大模型时代，什么是比代码更好的数值推理中间表示？——方程

AAAI 2024 |大模型时代，什么是比代码更好的数值推理中间表示？——方程

专知会员服务

50+阅读 · 2024年2月2日

大模型如何从思维链(CoT)，到思维树(ToT)，再到思维图(GoT)：用LLMs解决复杂问题！

大模型如何从思维链(CoT)，到思维树(ToT)，再到思维图(GoT)：用LLMs解决复杂问题！

专知会员服务

78+阅读 · 2023年9月3日

「大型语言模型推理」综述

「大型语言模型推理」综述

专知会员服务

95+阅读 · 2022年12月24日

从图(Graph)到图卷积(Graph Convolution)：漫谈图神经网络模型

专知会员服务

97+阅读 · 2020年2月21日

【ECML-PKDD 2019】突破可解释性障碍——解释深度图卷积模型的一种方法（Breaking the interpretability barrier - a methodfor interpreting deep graph convolutional models）

【ECML-PKDD 2019】突破可解释性障碍——解释深度图卷积模型的一种方法（Breaking the interpretability barrier - a methodfor interpreting deep graph convolutional models）

专知会员服务

19+阅读 · 2019年12月1日

热门VIP内容

开通专知VIP会员享更多权益服务

巡飞弹与反无人机系统——现代战场的两大支柱

《北约数字教官网络发展路径》128页报告

无人机自主控制与人工智能：系统性综述

《打造“黄金舰队”》57页报告

相关资讯

Transformer模型-深度学习自然语言处理，17页ppt

Transformer模型-深度学习自然语言处理，17页ppt

专知

14+阅读 · 2020年8月30日

谷歌ALBERT模型V2+中文版来了：之前刷新NLP各大基准，现在GitHub热榜第二

谷歌ALBERT模型V2+中文版来了：之前刷新NLP各大基准，现在GitHub热榜第二

量子位

14+阅读 · 2020年1月2日

KG 高引论文解读两篇 | 两种模型：多层卷积神经网络、知识感知路径递归网络

KG 高引论文解读两篇 | 两种模型：多层卷积神经网络、知识感知路径递归网络

学术头条

18+阅读 · 2019年12月8日

微软亚研提出VL-BERT：通用的视觉-语言预训练模型

微软亚研提出VL-BERT：通用的视觉-语言预训练模型

机器之心

15+阅读 · 2019年9月3日

面试题：简单说说贝叶斯定理

面试题：简单说说贝叶斯定理

七月在线实验室

12+阅读 · 2019年6月12日

论文浅尝 | 一种用于多关系问答的可解释推理网络

论文浅尝 | 一种用于多关系问答的可解释推理网络

开放知识图谱

18+阅读 · 2019年5月21日

中文版-BERT-预训练的深度双向Transformer语言模型-详细介绍

中文版-BERT-预训练的深度双向Transformer语言模型-详细介绍

深度学习与NLP

32+阅读 · 2019年3月30日

【深度学习】深度学习的几何观点：流形分布定律、学习能力的上限、概率变换的几何观点

【深度学习】深度学习的几何观点：流形分布定律、学习能力的上限、概率变换的几何观点

产业智能官

10+阅读 · 2018年6月23日

概率论之概念解析：用贝叶斯推断进行参数估计

概率论之概念解析：用贝叶斯推断进行参数估计

专知

14+阅读 · 2018年1月8日

最新｜深度离散哈希算法，可用于图像检索！

最新｜深度离散哈希算法，可用于图像检索！

全球人工智能

14+阅读 · 2017年12月15日

相关论文

Towards Efficient Large Language Reasoning Models via Extreme-Ratio Chain-of-Thought Compression

Arxiv

0+阅读 · 6月12日

Poker Arena: Multi-Axis Profiling of Strategic Reasoning and Memory in LLMs

Arxiv

0+阅读 · 6月11日

Almost-perfect packings and Tuza's conjecture in the random geometric graph

Arxiv

0+阅读 · 6月8日

DeInfer: Efficient Parallel Inferencing for Decomposed Large Language Models

Arxiv

0+阅读 · 6月3日

High-Dimensional Expanders, the Sparsest Cut Problem, and Steurer's Conjecture

Arxiv

0+阅读 · 5月29日

Counterexamples to a Conjecture on Laplacian Ratios of Trees

Arxiv

0+阅读 · 5月13日

Algorithms and Hardness for Geodetic Set on Tree-like Digraphs

Arxiv

0+阅读 · 5月13日

Counterexamples to an Extremal Conjecture for Random Cycle-Factors

Arxiv

0+阅读 · 5月7日

Rado's covering problem for cubes and balls: a semi-survey

Arxiv

0+阅读 · 4月24日

Efficient Rare-Event Simulation for Random Geometric Graphs via Importance Sampling

Arxiv

0+阅读 · 4月22日

相关基金

面向海量高维数据的可深度结合的贝叶斯网学习与推理新方法研究

国家自然科学基金

6+阅读 · 2015年12月31日

基于绝热量子计算模型求解数学问题的理论研究

国家自然科学基金

1+阅读 · 2015年12月31日

有向图的公平划分问题研究

国家自然科学基金

0+阅读 · 2015年12月31日

特殊图的整数流及群连通性问题的研究

国家自然科学基金

0+阅读 · 2015年12月31日

随机波动率模型的统计推断及数值解

国家自然科学基金

1+阅读 · 2015年12月31日

关于 Finsler 流形上调和映射与 Laplacian 的若干问题研究

国家自然科学基金

1+阅读 · 2014年12月31日

动态Gr？bner 基与GVW算法

国家自然科学基金

0+阅读 · 2014年12月31日

一个组合猜想及其相关问题的研究

国家自然科学基金

0+阅读 · 2014年12月31日

某些分形集上拉普拉斯算子的谱分析及相关问题

国家自然科学基金

0+阅读 · 2014年12月31日

不确定性推理与语义网中知识表示的数学基础

国家自然科学基金

18+阅读 · 2012年12月31日

微信扫码咨询专知VIP会员