The electric power supply for AI data centers is now the most significant bottleneck in the race toward Artificial General Intelligence, surpassing even the constraint of AI accelerator availability. To our knowledge, this paper is the first to describe the end-to-end power management process for a hyper-scale AI datacenter; from early power planning to accommodate next-generation accelerators 6--12 months before their general availability, to tuning power settings after large scale deployment, and finally to dynamic, runtime power management for evolving workloads. We present detailed power measurements for a 150 MW datacenter hosting a cluster of 83K GB200 GPUs. We share insights from building this state-of-the-art AI cluster. We hope this work encourages practitioners across the industry to share their own experiences as well.


翻译:人工智能数据中心的电力供应现已成为迈向通用人工智能(AGI)过程中最显著的瓶颈,其制约程度甚至超过了人工智能加速器的可用性限制。据我们所知,本文首次描述了超大规模AI数据中心端到端的电力管理流程:从下一代加速器普遍可用之前的6至12个月阶段,为容纳该类加速器而进行的早期电力规划,到大规模部署后的电源设置调优,再到针对动态演变工作负载进行的运行时电力管理。我们给出了一个容纳83K块GB200 GPU集群的150兆瓦数据中心的详细电力测量数据,并分享了建设这一先进AI集群的实践经验。希望本文能鼓励业界同行分享各自的相关经验。

0
下载
关闭预览

相关内容

人工智能杂志AI(Artificial Intelligence)是目前公认的发表该领域最新研究成果的主要国际论坛。该期刊欢迎有关AI广泛方面的论文,这些论文构成了整个领域的进步,也欢迎介绍人工智能应用的论文,但重点应该放在新的和新颖的人工智能方法如何提高应用领域的性能,而不是介绍传统人工智能方法的另一个应用。关于应用的论文应该描述一个原则性的解决方案,强调其新颖性,并对正在开发的人工智能技术进行深入的评估。 官网地址:http://dblp.uni-trier.de/db/journals/ai/
《通往人工通用智能之路上的均衡策略》
专知会员服务
9+阅读 · 6月3日
《面向边缘智能应用的AI模型优化技术研究》139页
专知会员服务
43+阅读 · 2025年8月12日
AI应用正当时,详解AI应用开发新范式
专知会员服务
28+阅读 · 2025年7月10日
AI大模型技术在电力系统中的应用及发展趋势
专知会员服务
18+阅读 · 2025年6月23日
《面向边缘AI应用的高性能高能效架构探索》156页
专知会员服务
37+阅读 · 2025年4月12日
算力调度:算力时代的国家电网
专知会员服务
44+阅读 · 2023年11月7日
电力人工智能发展报告
专知会员服务
85+阅读 · 2022年4月11日
浅谈群体智能——新一代AI的重要方向
中国科学院自动化研究所
44+阅读 · 2019年10月16日
完备的 AI 学习路线,最详细的资源整理!
新智元
18+阅读 · 2019年5月4日
完备的 AI 学习路线,最详细的中英文资源整理
机器之心
29+阅读 · 2019年4月28日
企业数据AI化战略:从数据中台到AI中台
36大数据
11+阅读 · 2019年2月18日
【优青论文】深度神经网络压缩与加速综述
计算机研究与发展
17+阅读 · 2018年9月20日
群体智能:新一代人工智能的重要方向
走向智能论坛
12+阅读 · 2017年8月16日
国家自然科学基金
1+阅读 · 2015年12月31日
国家自然科学基金
0+阅读 · 2015年12月31日
国家自然科学基金
2+阅读 · 2015年12月31日
国家自然科学基金
0+阅读 · 2015年12月31日
国家自然科学基金
0+阅读 · 2015年12月31日
国家自然科学基金
7+阅读 · 2014年12月31日
国家自然科学基金
2+阅读 · 2014年12月31日
Arxiv
0+阅读 · 5月27日
VIP会员
最新内容
学习数据的几何:形状空间分析数学综述
专知会员服务
4+阅读 · 6月17日
定向能反无人机系统最新发展动态
专知会员服务
6+阅读 · 6月17日
从燃煤战舰到算法战争:水面指挥的永恒要求
专知会员服务
3+阅读 · 6月17日
相关VIP内容
《通往人工通用智能之路上的均衡策略》
专知会员服务
9+阅读 · 6月3日
《面向边缘智能应用的AI模型优化技术研究》139页
专知会员服务
43+阅读 · 2025年8月12日
AI应用正当时,详解AI应用开发新范式
专知会员服务
28+阅读 · 2025年7月10日
AI大模型技术在电力系统中的应用及发展趋势
专知会员服务
18+阅读 · 2025年6月23日
《面向边缘AI应用的高性能高能效架构探索》156页
专知会员服务
37+阅读 · 2025年4月12日
算力调度:算力时代的国家电网
专知会员服务
44+阅读 · 2023年11月7日
电力人工智能发展报告
专知会员服务
85+阅读 · 2022年4月11日
相关基金
国家自然科学基金
1+阅读 · 2015年12月31日
国家自然科学基金
0+阅读 · 2015年12月31日
国家自然科学基金
2+阅读 · 2015年12月31日
国家自然科学基金
0+阅读 · 2015年12月31日
国家自然科学基金
0+阅读 · 2015年12月31日
国家自然科学基金
7+阅读 · 2014年12月31日
国家自然科学基金
2+阅读 · 2014年12月31日
Top
微信扫码咨询专知VIP会员