A Simple Communication Scheme for Distributed Fast Multipole Methods - 专知论文

会员服务 ·

0

内存 · 多极子 · 通信方案 · 扩展性 · 可扩展性 ·

A Simple Communication Scheme for Distributed Fast Multipole Methods

翻译：一种面向分布式快速多极子方法的简洁通信方案

Srinath Kailasa

from arxiv, 38 pages, 13 figures

We present a simple hierarchical communication scheme for distributed Fast Multipole Methods (FMMs) based on MPI neighborhood collectives and uniform trees. The method targets the common case of extending an existing high-performance shared-memory uniform-tree FMM implementation to distributed memory with minimal redesign while preserving any shared memory optimizations optimizations. Benchmarks on the ARCHER2 supercomputer demonstrate that our method can scale to very large problem sizes, we demonstrate weak-scaling up to 3.2e10 uniformly distributed points on 512 nodes of the machine in our largest runs. Our simplifications based on uniform trees result in worse asymptotic scaling for non-uniform points, however we still obtain practically useful runtimes due to the ability to retain our shared memory optimizations.

翻译：我们提出了一种基于MPI邻域集合与均匀树的分布式快速多极子方法(FMM)的简洁层次化通信方案。该方法针对常见场景：在最小化重新设计的前提下，将现有的高性能共享内存均匀树FMM实现扩展至分布式内存，同时保留所有共享内存优化措施。在ARCHER2超级计算机上的基准测试表明，该方法可扩展至极大规模问题——最大运行中，我们在512个节点上实现了3.2×10¹⁰个均匀分布点的弱可扩展性。基于均匀树的简化策略导致非均匀点的渐近可扩展性变差，但由于能够保留共享内存优化，我们仍能获得实际可用的运行时性能。

0

相关内容

多智能体通信：多智能体强化学习到涌现语言和大语言模型的综述

多智能体通信：多智能体强化学习到涌现语言和大语言模型的综述

专知会员服务

16+阅读 · 2月13日

多智能体强化学习中的稳健且高效的通信

多智能体强化学习中的稳健且高效的通信

专知会员服务

25+阅读 · 2025年11月17日

水下通信《通信感知、可扩展高斯过程在分布式探索中的应用》186页

水下通信《通信感知、可扩展高斯过程在分布式探索中的应用》186页

专知会员服务

21+阅读 · 2025年4月30日

【MIT博士论文】可扩展多智能体几何估计算法和系统，354页pdf

【MIT博士论文】可扩展多智能体几何估计算法和系统，354页pdf

专知会员服务

43+阅读 · 2023年12月7日

【NeurIPS2023】MultiModN:多模态，多任务，可解释的模块化网络

【NeurIPS2023】MultiModN:多模态，多任务，可解释的模块化网络

专知会员服务

40+阅读 · 2023年9月27日

【牛津大学博士论文】深度多任务学习的极简主义方法，229页pdf

【牛津大学博士论文】深度多任务学习的极简主义方法，229页pdf

专知会员服务

43+阅读 · 2023年6月12日

【MIT博士论文】简单、快速、可扩展、可靠的多处理器算法，358页pdf

【MIT博士论文】简单、快速、可扩展、可靠的多处理器算法，358页pdf

专知会员服务

26+阅读 · 2023年5月1日

用Transformer学习通用超参数优化器，DeepMind Yutian Chen博士讲授，附Slides与视频

用Transformer学习通用超参数优化器，DeepMind Yutian Chen博士讲授，附Slides与视频

专知会员服务

40+阅读 · 2023年3月12日

《分布式多智能体强化学习的编码》加州大学等

《分布式多智能体强化学习的编码》加州大学等

专知会员服务

56+阅读 · 2022年11月2日

【博士论文】《多目标网络虚拟化及其对工业网络的适用性》德国帕绍大学173页

【博士论文】《多目标网络虚拟化及其对工业网络的适用性》德国帕绍大学173页

专知会员服务

14+阅读 · 2022年9月5日

推荐！《基于多智能体学习的任务分配动态邻域优化》2022最新41页综述论文，伦敦国王学院

推荐！《基于多智能体学习的任务分配动态邻域优化》2022最新41页综述论文，伦敦国王学院

专知

17+阅读 · 2022年11月15日

注意力机制 | 图卷积多跳注意力机制 | Direct multi-hop Attention based GNN

注意力机制 | 图卷积多跳注意力机制 | Direct multi-hop Attention based GNN

AINLP

22+阅读 · 2020年11月29日

PyTorch 单机多卡操作总结：分布式DataParallel，混合精度，Horovod)

PyTorch 单机多卡操作总结：分布式DataParallel，混合精度，Horovod)

极市平台

19+阅读 · 2020年10月18日

【初学者系列】Factorization Machines 因子分解机详解

【初学者系列】Factorization Machines 因子分解机详解

专知

37+阅读 · 2019年8月17日

【泡泡点云时空】跟踪与三角测量中一种通过兴趣点网络进行多视图2D/3D刚性配准的方法

【泡泡点云时空】跟踪与三角测量中一种通过兴趣点网络进行多视图2D/3D刚性配准的方法

泡泡机器人SLAM

17+阅读 · 2019年7月8日

深度学习中Attention Mechanism详细介绍：原理、分类及应用

深度学习中Attention Mechanism详细介绍：原理、分类及应用

深度学习与NLP

10+阅读 · 2019年2月18日

Fast-OCNet: 更快更好的OCNet.

Fast-OCNet: 更快更好的OCNet.

极市平台

21+阅读 · 2019年2月10日

分布式优化算法及其在多智能体系统与机器学习中的应用【附PPT与视频资料】

分布式优化算法及其在多智能体系统与机器学习中的应用【附PPT与视频资料】

人工智能前沿讲习班

21+阅读 · 2018年12月21日

这可能是「多模态机器学习」最通俗易懂的介绍

这可能是「多模态机器学习」最通俗易懂的介绍

计算机视觉life

113+阅读 · 2018年12月20日

当前最好的非深度迁移学习方法：流形空间下的分布对齐

当前最好的非深度迁移学习方法：流形空间下的分布对齐

PaperWeekly

11+阅读 · 2018年7月31日

基于盲双迭代策略的高可靠变速移动水声多用户通信理论和方法

国家自然科学基金

0+阅读 · 2017年12月31日

高速率、高频谱效率码分多址系统地址码设计研究

国家自然科学基金

0+阅读 · 2015年12月31日

多路径通信网络关键技术研究

国家自然科学基金

0+阅读 · 2015年12月31日

基于云计算的动态分布式多目标粒子群算法研究

国家自然科学基金

1+阅读 · 2015年12月31日

基于微型批量采样的分布式多智能个体网络协同优化算法研究

国家自然科学基金

0+阅读 · 2015年12月31日

基于混合多址的物与物通信资源分配技术研究

国家自然科学基金

0+阅读 · 2015年12月31日

小快拍数下宽带信号超分辨测向性能的多元优化方法研究

国家自然科学基金

0+阅读 · 2015年12月31日

面向无线异构网络中多媒体信息组播的多速率网络编码理论和应用研究

国家自然科学基金

0+阅读 · 2015年12月31日

微波谐振单元的多频耦合调控机理及其应用研究

国家自然科学基金

0+阅读 · 2015年12月31日

基于结构化方法的复杂研发项目多领域集成分析与优化研究

国家自然科学基金

2+阅读 · 2014年12月31日

Eliminating Hidden Serialization in Multi-Node Megakernel Communication

Arxiv

0+阅读 · 5月1日

Multi-User Non-Linearly Separable Distributed Computing

Arxiv

0+阅读 · 4月30日

Enabling Reconfiguration-Communication Overlap for Collective Communication in Optical Networks

Arxiv

0+阅读 · 4月30日

A Simple Communication Scheme for Distributed Fast Multipole Methods

Arxiv

0+阅读 · 4月30日

Distributed Electromagnetic Neural Networks for Task-Oriented Semantic Communications

Arxiv

0+阅读 · 4月26日

Distributed Quantum Optimization for Large-Scale Higher-Order Problems with Dense Interactions

Arxiv

0+阅读 · 4月22日

Quantum Integrated Communication and Computing Over Multiple-Access Bosonic Channel

Arxiv

0+阅读 · 4月9日

Less is More Revisited: Association with Global Protocols and Multiparty Sessions

Arxiv

0+阅读 · 3月30日

A Multi-Port Concurrent Communication Model for handling Compute Intensive Tasks on Distributed Satellite System Constellations

Arxiv

0+阅读 · 3月25日

Communication Complexity of Disjointness under Product Distributions

Arxiv

0+阅读 · 3月19日

VIP会员

文章信息

相关主题

最新内容

ICML 2026 | CFPO：用反事实策略优化提升多模态推理

ICML 2026 | CFPO：用反事实策略优化提升多模态推理

专知会员服务

2+阅读 · 6月23日

综述 | 世界动作模型：少做梦，多行动

综述 | 世界动作模型：少做梦，多行动

专知会员服务

4+阅读 · 6月23日

美以伊冲突：无人机与人工智能的运用

美以伊冲突：无人机与人工智能的运用

专知会员服务

7+阅读 · 6月23日

《战时图神经网络：整合以色列-伊朗冲突中的网络安全与无人机智能》最新50页文献

《战时图神经网络：整合以色列-伊朗冲突中的网络安全与无人机智能》最新50页文献

专知会员服务

3+阅读 · 6月23日

《特种部队在透明战场中的生存力》最新报告

《特种部队在透明战场中的生存力》最新报告

专知会员服务

4+阅读 · 6月23日

《自主无人机蜂群协同与控制系统：人工智能赋能的战场协同与自主任务编排平台》

《自主无人机蜂群协同与控制系统：人工智能赋能的战场协同与自主任务编排平台》

专知会员服务

6+阅读 · 6月23日

《人工智能生成的零日漏洞：对未来作战的影响》

《人工智能生成的零日漏洞：对未来作战的影响》

专知会员服务

5+阅读 · 6月23日

《理解伙伴国在防务能力选择中的偏好：探索美国解决方案的替代选择》美智库200页报告

《理解伙伴国在防务能力选择中的偏好：探索美国解决方案的替代选择》美智库200页报告

专知会员服务

3+阅读 · 6月23日

ICML 2026 | 边界嵌入塑形：用自适应对比学习破解图结构纠缠

ICML 2026 | 边界嵌入塑形：用自适应对比学习破解图结构纠缠

专知会员服务

6+阅读 · 6月22日

综述 | 3D场景图：开放挑战与未来方向

综述 | 3D场景图：开放挑战与未来方向

专知会员服务

8+阅读 · 6月22日

《国防工业6.0：全自主作战系统、量子-人工智能融合与新一代战略威慑》

《国防工业6.0：全自主作战系统、量子-人工智能融合与新一代战略威慑》

专知会员服务

8+阅读 · 6月22日

21世纪的无人机战争

21世纪的无人机战争

专知会员服务

4+阅读 · 6月22日

《伊朗与以色列-美国热战及其对数字技术的影响》

《伊朗与以色列-美国热战及其对数字技术的影响》

专知会员服务

6+阅读 · 6月22日

《量子技术的军事任务技术适配与利用》

《量子技术的军事任务技术适配与利用》

专知会员服务

5+阅读 · 6月22日

《美国陆军军官学校（西点军校）本科生科研中生成式人工智能的使用》

《美国陆军军官学校（西点军校）本科生科研中生成式人工智能的使用》

专知会员服务

9+阅读 · 6月22日

相关VIP内容

多智能体通信：多智能体强化学习到涌现语言和大语言模型的综述

多智能体通信：多智能体强化学习到涌现语言和大语言模型的综述

专知会员服务

16+阅读 · 2月13日

多智能体强化学习中的稳健且高效的通信

多智能体强化学习中的稳健且高效的通信

专知会员服务

25+阅读 · 2025年11月17日

水下通信《通信感知、可扩展高斯过程在分布式探索中的应用》186页

水下通信《通信感知、可扩展高斯过程在分布式探索中的应用》186页

专知会员服务

21+阅读 · 2025年4月30日

【MIT博士论文】可扩展多智能体几何估计算法和系统，354页pdf

【MIT博士论文】可扩展多智能体几何估计算法和系统，354页pdf

专知会员服务

43+阅读 · 2023年12月7日

【NeurIPS2023】MultiModN:多模态，多任务，可解释的模块化网络

【NeurIPS2023】MultiModN:多模态，多任务，可解释的模块化网络

专知会员服务

40+阅读 · 2023年9月27日

【牛津大学博士论文】深度多任务学习的极简主义方法，229页pdf

【牛津大学博士论文】深度多任务学习的极简主义方法，229页pdf

专知会员服务

43+阅读 · 2023年6月12日

【MIT博士论文】简单、快速、可扩展、可靠的多处理器算法，358页pdf

【MIT博士论文】简单、快速、可扩展、可靠的多处理器算法，358页pdf

专知会员服务

26+阅读 · 2023年5月1日

用Transformer学习通用超参数优化器，DeepMind Yutian Chen博士讲授，附Slides与视频

用Transformer学习通用超参数优化器，DeepMind Yutian Chen博士讲授，附Slides与视频

专知会员服务

40+阅读 · 2023年3月12日

《分布式多智能体强化学习的编码》加州大学等

《分布式多智能体强化学习的编码》加州大学等

专知会员服务

56+阅读 · 2022年11月2日

【博士论文】《多目标网络虚拟化及其对工业网络的适用性》德国帕绍大学173页

【博士论文】《多目标网络虚拟化及其对工业网络的适用性》德国帕绍大学173页

专知会员服务

14+阅读 · 2022年9月5日

热门VIP内容

开通专知VIP会员享更多权益服务

综述 | 世界动作模型：少做梦，多行动

《战时图神经网络：整合以色列-伊朗冲突中的网络安全与无人机智能》最新50页文献

ICML 2026 | CFPO：用反事实策略优化提升多模态推理

美以伊冲突：无人机与人工智能的运用

相关资讯

推荐！《基于多智能体学习的任务分配动态邻域优化》2022最新41页综述论文，伦敦国王学院

推荐！《基于多智能体学习的任务分配动态邻域优化》2022最新41页综述论文，伦敦国王学院

专知

17+阅读 · 2022年11月15日

注意力机制 | 图卷积多跳注意力机制 | Direct multi-hop Attention based GNN

注意力机制 | 图卷积多跳注意力机制 | Direct multi-hop Attention based GNN

AINLP

22+阅读 · 2020年11月29日

PyTorch 单机多卡操作总结：分布式DataParallel，混合精度，Horovod)

PyTorch 单机多卡操作总结：分布式DataParallel，混合精度，Horovod)

极市平台

19+阅读 · 2020年10月18日

【初学者系列】Factorization Machines 因子分解机详解

【初学者系列】Factorization Machines 因子分解机详解

专知

37+阅读 · 2019年8月17日

【泡泡点云时空】跟踪与三角测量中一种通过兴趣点网络进行多视图2D/3D刚性配准的方法

【泡泡点云时空】跟踪与三角测量中一种通过兴趣点网络进行多视图2D/3D刚性配准的方法

泡泡机器人SLAM

17+阅读 · 2019年7月8日

深度学习中Attention Mechanism详细介绍：原理、分类及应用

深度学习中Attention Mechanism详细介绍：原理、分类及应用

深度学习与NLP

10+阅读 · 2019年2月18日

Fast-OCNet: 更快更好的OCNet.

Fast-OCNet: 更快更好的OCNet.

极市平台

21+阅读 · 2019年2月10日

分布式优化算法及其在多智能体系统与机器学习中的应用【附PPT与视频资料】

分布式优化算法及其在多智能体系统与机器学习中的应用【附PPT与视频资料】

人工智能前沿讲习班

21+阅读 · 2018年12月21日

这可能是「多模态机器学习」最通俗易懂的介绍

这可能是「多模态机器学习」最通俗易懂的介绍

计算机视觉life

113+阅读 · 2018年12月20日

当前最好的非深度迁移学习方法：流形空间下的分布对齐

当前最好的非深度迁移学习方法：流形空间下的分布对齐

PaperWeekly

11+阅读 · 2018年7月31日

相关论文

Eliminating Hidden Serialization in Multi-Node Megakernel Communication

Arxiv

0+阅读 · 5月1日

Multi-User Non-Linearly Separable Distributed Computing

Arxiv

0+阅读 · 4月30日

Enabling Reconfiguration-Communication Overlap for Collective Communication in Optical Networks

Arxiv

0+阅读 · 4月30日

A Simple Communication Scheme for Distributed Fast Multipole Methods

Arxiv

0+阅读 · 4月30日

Distributed Electromagnetic Neural Networks for Task-Oriented Semantic Communications

Arxiv

0+阅读 · 4月26日

Distributed Quantum Optimization for Large-Scale Higher-Order Problems with Dense Interactions

Arxiv

0+阅读 · 4月22日

Quantum Integrated Communication and Computing Over Multiple-Access Bosonic Channel

Arxiv

0+阅读 · 4月9日

Less is More Revisited: Association with Global Protocols and Multiparty Sessions

Arxiv

0+阅读 · 3月30日

A Multi-Port Concurrent Communication Model for handling Compute Intensive Tasks on Distributed Satellite System Constellations

Arxiv

0+阅读 · 3月25日

Communication Complexity of Disjointness under Product Distributions

Arxiv

0+阅读 · 3月19日

相关基金

基于盲双迭代策略的高可靠变速移动水声多用户通信理论和方法

国家自然科学基金

0+阅读 · 2017年12月31日

高速率、高频谱效率码分多址系统地址码设计研究

国家自然科学基金

0+阅读 · 2015年12月31日

多路径通信网络关键技术研究

国家自然科学基金

0+阅读 · 2015年12月31日

基于云计算的动态分布式多目标粒子群算法研究

国家自然科学基金

1+阅读 · 2015年12月31日

基于微型批量采样的分布式多智能个体网络协同优化算法研究

国家自然科学基金

0+阅读 · 2015年12月31日

基于混合多址的物与物通信资源分配技术研究

国家自然科学基金

0+阅读 · 2015年12月31日

小快拍数下宽带信号超分辨测向性能的多元优化方法研究

国家自然科学基金

0+阅读 · 2015年12月31日

面向无线异构网络中多媒体信息组播的多速率网络编码理论和应用研究

国家自然科学基金

0+阅读 · 2015年12月31日

微波谐振单元的多频耦合调控机理及其应用研究

国家自然科学基金

0+阅读 · 2015年12月31日

基于结构化方法的复杂研发项目多领域集成分析与优化研究

国家自然科学基金

2+阅读 · 2014年12月31日

微信扫码咨询专知VIP会员