TABX：面向多智能体强化学习的高通量沙盒战斗模拟器 (TABX: A High-Throughput Sandbox Battle Simulator for Multi-Agent Reinforcement Learning) - 专知论文

会员服务 ·

0

高通 (Qualcomm) · 高通量 · 沙盒 · 设计 · 智能体 ·

TABX: A High-Throughput Sandbox Battle Simulator for Multi-Agent Reinforcement Learning

翻译：TABX：面向多智能体强化学习的高通量沙盒战斗模拟器

Hayeong Lee,JunHyeok Oh,Byung-Jun Lee

The design of environments plays a critical role in shaping the development and evaluation of cooperative multi-agent reinforcement learning (MARL) algorithms. While existing benchmarks highlight critical challenges, they often lack the modularity required to design custom evaluation scenarios. We introduce the Totally Accelerated Battle Simulator in JAX (TABX), a high-throughput sandbox designed for reconfigurable multi-agent tasks. TABX provides granular control over environmental parameters, permitting a systematic investigation into emergent agent behaviors and algorithmic trade-offs across a diverse spectrum of task complexities. Leveraging JAX for hardware-accelerated execution on GPUs, TABX enables massive parallelization and significantly reduces computational overhead. By providing a fast, extensible, and easily customized framework, TABX facilitates the study of MARL agents in complex structured domains and serves as a scalable foundation for future research. Our code is available at: https://anonymous.4open.science/r/TABX-00CA.

翻译：环境设计在塑造协作式多智能体强化学习算法的开发与评估过程中起着至关重要的作用。尽管现有基准测试突显了关键挑战，但它们往往缺乏设计定制化评估场景所需的模块化特性。我们提出了基于JAX的完全加速战斗模拟器，这是一个专为可重构多智能体任务设计的高通量沙盒环境。TABX提供对环境参数的细粒度控制，允许在多样化的任务复杂度谱系中，对涌现的智能体行为与算法权衡进行系统性研究。通过利用JAX在GPU上的硬件加速执行能力，TABX实现了大规模并行化并显著降低了计算开销。通过提供快速、可扩展且易于定制的框架，TABX促进了复杂结构化领域中MARL智能体的研究，并为未来研究提供了可扩展的基础平台。我们的代码发布于：https://anonymous.4open.science/r/TABX-00CA。

0

相关内容

高通 (Qualcomm)

高通 (Qualcomm)

高通（Qualcomm）是一家生产、提供无线通讯设备和服务的美国电讯公司。

《一种分层混合人工智能方法：在战斗模拟中整合深度强化学习与脚本代理》

《一种分层混合人工智能方法：在战斗模拟中整合深度强化学习与脚本代理》

专知会员服务

24+阅读 · 2025年12月6日

《基于分层多智能体强化学习的逼真空战协同策略》

《基于分层多智能体强化学习的逼真空战协同策略》

专知会员服务

39+阅读 · 2025年10月30日

《具备集体态势感知能力的深度强化学习智能体在超视距空战中的应用研究》最新文献

《具备集体态势感知能力的深度强化学习智能体在超视距空战中的应用研究》最新文献

专知会员服务

43+阅读 · 2025年9月23日

《基于深度强化学习与可解释AI的战斗机导航与作战研究》

《基于深度强化学习与可解释AI的战斗机导航与作战研究》

专知会员服务

40+阅读 · 2025年3月1日

《基于可解释人工智能的深度强化学习实现战斗机导航和作战》

《基于可解释人工智能的深度强化学习实现战斗机导航和作战》

专知会员服务

32+阅读 · 2025年2月23日

《战斗模拟中的强化学习》

《战斗模拟中的强化学习》

专知会员服务

41+阅读 · 2024年12月10日

《基于多智能体强化学习的异构平台数据驱动分布式共同作战图景》

《基于多智能体强化学习的异构平台数据驱动分布式共同作战图景》

专知会员服务

87+阅读 · 2024年12月2日

推荐！《掌握数字战争艺术：基于分层强化学习的兵棋模拟智能体开发》最新261页

推荐！《掌握数字战争艺术：基于分层强化学习的兵棋模拟智能体开发》最新261页

专知会员服务

79+阅读 · 2024年10月17日

《指挥和控制中强化学习智能体的对抗性攻击》

《指挥和控制中强化学习智能体的对抗性攻击》

专知会员服务

73+阅读 · 2024年5月11日

《基于多智能体深度强化学习的空战模拟智能体协作》瑞典林雪平大学

《基于多智能体深度强化学习的空战模拟智能体协作》瑞典林雪平大学

专知会员服务

160+阅读 · 2022年8月24日

《可解释人工智能在多域作战中的智能增强》美国陆军、IBM、卡迪夫大学等论文

《可解释人工智能在多域作战中的智能增强》美国陆军、IBM、卡迪夫大学等论文

专知

67+阅读 · 2022年11月2日

《使用机器学习智能体设计基于模拟的空战飞行员训练系统》2022瑞典林雪平大学页论文

《使用机器学习智能体设计基于模拟的空战飞行员训练系统》2022瑞典林雪平大学页论文

专知

39+阅读 · 2022年10月30日

面向多智能体博弈对抗的对手建模框架

面向多智能体博弈对抗的对手建模框架

专知

18+阅读 · 2022年9月28日

《基于多智能体深度强化学习的空战模拟智能体协作》瑞典林雪平大学

《基于多智能体深度强化学习的空战模拟智能体协作》瑞典林雪平大学

专知

65+阅读 · 2022年8月25日

【AI与军事】机器学习的军事应用，一种文献计量视角

【AI与军事】机器学习的军事应用，一种文献计量视角

专知

54+阅读 · 2022年4月25日

CALDERA 一款对手自动模拟工具

CALDERA 一款对手自动模拟工具

黑白之道

20+阅读 · 2019年9月17日

开源星际争霸2多智能体挑战smac

开源星际争霸2多智能体挑战smac

专知

17+阅读 · 2019年2月13日

【强化学习】用于真实机器人的高效深度强化学习算法、全面解读深度强化学习

【强化学习】用于真实机器人的高效深度强化学习算法、全面解读深度强化学习

产业智能官

16+阅读 · 2018年12月27日

DeepMind无监督表示学习重大突破：语音、图像、文本、强化学习全能冠军！

DeepMind无监督表示学习重大突破：语音、图像、文本、强化学习全能冠军！

新智元

12+阅读 · 2018年7月13日

Github 项目推荐 | 真实全景图像强化学习 AI 平台 —— Matterport3DSimulator

Github 项目推荐 | 真实全景图像强化学习 AI 平台 —— Matterport3DSimulator

AI研习社

10+阅读 · 2018年3月6日

针对大规模环境下复杂任务的策略搜索强化学习方法研究

国家自然科学基金

42+阅读 · 2015年12月31日

基于演化博弈的多智能体环形编队的理论与实验研究

国家自然科学基金

23+阅读 · 2015年12月31日

基于势场法的多智能体系统鲁棒自适应刚性编队控制

国家自然科学基金

3+阅读 · 2015年12月31日

基于仿真大数据的武器装备体系复杂性机理及效能评估方法研究

国家自然科学基金

74+阅读 · 2014年12月31日

基于生物网络的高维多目标算法及其在分布式调度中的应用

国家自然科学基金

0+阅读 · 2014年12月31日

基于群体智能的多无人机编队自主协调控制及验证

国家自然科学基金

20+阅读 · 2013年12月31日

面向人与Agent混合的多团队协作仿真训练方法研究

国家自然科学基金

19+阅读 · 2012年12月31日

强化学习关键技术及其在机器人行为学习中的应用

国家自然科学基金

23+阅读 · 2009年12月31日

基于多智能体强化学习的多机器人系统研究

国家自然科学基金

48+阅读 · 2009年12月31日

基于动态分层与自学习的多智能体自适应协作模型

国家自然科学基金

17+阅读 · 2008年12月31日

Hybrid-Gym: Training Coding Agents to Generalize Across Tasks

Arxiv

0+阅读 · 2月18日

HEAS: Hierarchical Evolutionary Agent Simulation Framework for Cross-Scale Modeling and Multi-Objective Search

Arxiv

0+阅读 · 2月14日

Multi-Agent Model-Based Reinforcement Learning with Joint State-Action Learned Embeddings

Arxiv

0+阅读 · 2月13日

MARSHAL: Incentivizing Multi-Agent Reasoning via Self-Play with Strategic LLMs

Arxiv

0+阅读 · 2月12日

GameDevBench: Evaluating Agentic Capabilities Through Game Development

Arxiv

0+阅读 · 2月11日

CARL: Focusing Agentic Reinforcement Learning on Critical Actions

Arxiv

0+阅读 · 2月5日

GAMMS: Graph based Adversarial Multiagent Modeling Simulator

Arxiv

0+阅读 · 2月4日

Accurate and Efficient World Modeling with Masked Latent Transformers

Arxiv

0+阅读 · 2月3日

Endless Terminals: Scaling RL Environments for Terminal Agents

Arxiv

0+阅读 · 1月23日

LogicEnvGen: Task-Logic Driven Generation of Diverse Simulated Environments for Embodied AI

Arxiv

0+阅读 · 1月20日

VIP会员

文章信息

相关主题

高通 (Qualcomm)

相关VIP内容

《一种分层混合人工智能方法：在战斗模拟中整合深度强化学习与脚本代理》

《一种分层混合人工智能方法：在战斗模拟中整合深度强化学习与脚本代理》

专知会员服务

24+阅读 · 2025年12月6日

《基于分层多智能体强化学习的逼真空战协同策略》

《基于分层多智能体强化学习的逼真空战协同策略》

专知会员服务

39+阅读 · 2025年10月30日

《具备集体态势感知能力的深度强化学习智能体在超视距空战中的应用研究》最新文献

《具备集体态势感知能力的深度强化学习智能体在超视距空战中的应用研究》最新文献

专知会员服务

43+阅读 · 2025年9月23日

《基于深度强化学习与可解释AI的战斗机导航与作战研究》

《基于深度强化学习与可解释AI的战斗机导航与作战研究》

专知会员服务

40+阅读 · 2025年3月1日

《基于可解释人工智能的深度强化学习实现战斗机导航和作战》

《基于可解释人工智能的深度强化学习实现战斗机导航和作战》

专知会员服务

32+阅读 · 2025年2月23日

《战斗模拟中的强化学习》

《战斗模拟中的强化学习》

专知会员服务

41+阅读 · 2024年12月10日

《基于多智能体强化学习的异构平台数据驱动分布式共同作战图景》

《基于多智能体强化学习的异构平台数据驱动分布式共同作战图景》

专知会员服务

87+阅读 · 2024年12月2日

推荐！《掌握数字战争艺术：基于分层强化学习的兵棋模拟智能体开发》最新261页

推荐！《掌握数字战争艺术：基于分层强化学习的兵棋模拟智能体开发》最新261页

专知会员服务

79+阅读 · 2024年10月17日

《指挥和控制中强化学习智能体的对抗性攻击》

《指挥和控制中强化学习智能体的对抗性攻击》

专知会员服务

73+阅读 · 2024年5月11日

《基于多智能体深度强化学习的空战模拟智能体协作》瑞典林雪平大学

《基于多智能体深度强化学习的空战模拟智能体协作》瑞典林雪平大学

专知会员服务

160+阅读 · 2022年8月24日

热门VIP内容

开通专知VIP会员享更多权益服务

智能体记忆深度剖析：评价指标与系统局限性的分类体系及实证分析

《可信人工智能赋能系统的支柱》

【CMU博士论文】可靠轨迹预测的分层基石：数据、评估与方法

人工智能赋能边缘与自主系统：美陆军现代化进程聚焦威胁探测与战术边缘情报

相关资讯

《可解释人工智能在多域作战中的智能增强》美国陆军、IBM、卡迪夫大学等论文

《可解释人工智能在多域作战中的智能增强》美国陆军、IBM、卡迪夫大学等论文

专知

67+阅读 · 2022年11月2日

《使用机器学习智能体设计基于模拟的空战飞行员训练系统》2022瑞典林雪平大学页论文

《使用机器学习智能体设计基于模拟的空战飞行员训练系统》2022瑞典林雪平大学页论文

专知

39+阅读 · 2022年10月30日

面向多智能体博弈对抗的对手建模框架

面向多智能体博弈对抗的对手建模框架

专知

18+阅读 · 2022年9月28日

《基于多智能体深度强化学习的空战模拟智能体协作》瑞典林雪平大学

《基于多智能体深度强化学习的空战模拟智能体协作》瑞典林雪平大学

专知

65+阅读 · 2022年8月25日

【AI与军事】机器学习的军事应用，一种文献计量视角

【AI与军事】机器学习的军事应用，一种文献计量视角

专知

54+阅读 · 2022年4月25日

CALDERA 一款对手自动模拟工具

CALDERA 一款对手自动模拟工具

黑白之道

20+阅读 · 2019年9月17日

开源星际争霸2多智能体挑战smac

开源星际争霸2多智能体挑战smac

专知

17+阅读 · 2019年2月13日

【强化学习】用于真实机器人的高效深度强化学习算法、全面解读深度强化学习

【强化学习】用于真实机器人的高效深度强化学习算法、全面解读深度强化学习

产业智能官

16+阅读 · 2018年12月27日

DeepMind无监督表示学习重大突破：语音、图像、文本、强化学习全能冠军！

DeepMind无监督表示学习重大突破：语音、图像、文本、强化学习全能冠军！

新智元

12+阅读 · 2018年7月13日

Github 项目推荐 | 真实全景图像强化学习 AI 平台 —— Matterport3DSimulator

Github 项目推荐 | 真实全景图像强化学习 AI 平台 —— Matterport3DSimulator

AI研习社

10+阅读 · 2018年3月6日

相关论文

Hybrid-Gym: Training Coding Agents to Generalize Across Tasks

Arxiv

0+阅读 · 2月18日

HEAS: Hierarchical Evolutionary Agent Simulation Framework for Cross-Scale Modeling and Multi-Objective Search

Arxiv

0+阅读 · 2月14日

Multi-Agent Model-Based Reinforcement Learning with Joint State-Action Learned Embeddings

Arxiv

0+阅读 · 2月13日

MARSHAL: Incentivizing Multi-Agent Reasoning via Self-Play with Strategic LLMs

Arxiv

0+阅读 · 2月12日

GameDevBench: Evaluating Agentic Capabilities Through Game Development

Arxiv

0+阅读 · 2月11日

CARL: Focusing Agentic Reinforcement Learning on Critical Actions

Arxiv

0+阅读 · 2月5日

GAMMS: Graph based Adversarial Multiagent Modeling Simulator

Arxiv

0+阅读 · 2月4日

Accurate and Efficient World Modeling with Masked Latent Transformers

Arxiv

0+阅读 · 2月3日

Endless Terminals: Scaling RL Environments for Terminal Agents

Arxiv

0+阅读 · 1月23日

LogicEnvGen: Task-Logic Driven Generation of Diverse Simulated Environments for Embodied AI

Arxiv

0+阅读 · 1月20日

相关基金

针对大规模环境下复杂任务的策略搜索强化学习方法研究

国家自然科学基金

42+阅读 · 2015年12月31日

基于演化博弈的多智能体环形编队的理论与实验研究

国家自然科学基金

23+阅读 · 2015年12月31日

基于势场法的多智能体系统鲁棒自适应刚性编队控制

国家自然科学基金

3+阅读 · 2015年12月31日

基于仿真大数据的武器装备体系复杂性机理及效能评估方法研究

国家自然科学基金

74+阅读 · 2014年12月31日

基于生物网络的高维多目标算法及其在分布式调度中的应用

国家自然科学基金

0+阅读 · 2014年12月31日

基于群体智能的多无人机编队自主协调控制及验证

国家自然科学基金

20+阅读 · 2013年12月31日

面向人与Agent混合的多团队协作仿真训练方法研究

国家自然科学基金

19+阅读 · 2012年12月31日

强化学习关键技术及其在机器人行为学习中的应用

国家自然科学基金

23+阅读 · 2009年12月31日

基于多智能体强化学习的多机器人系统研究

国家自然科学基金

48+阅读 · 2009年12月31日

基于动态分层与自学习的多智能体自适应协作模型

国家自然科学基金

17+阅读 · 2008年12月31日

微信扫码咨询专知VIP会员