人工智能(AI)的进展,特别是深度强化学习(RL),已经产生了能够达到或超过专业人类水平的系统。这项研究探索了RL训练人工智能agent的能力,以实现小型战术交战中的最佳进攻行为。agent在一个简单的、总体级别的军事建设性模拟中接受了训练,其行为得到了规模和经济力量战术原则的验证。结果显示,所应用的战斗模型和RL算法对训练性能的影响最大。此外,特定的超参数训练也有助于行为的质量和类型。未来的工作将寻求在更大和更复杂的战斗场景中验证RL的性能。

成为VIP会员查看完整内容
104

相关内容

军事防务数据板块介绍:系统化采集、存储、管理、分析与军事国防安全相关信息的专用数据板块,其核心在于整合全球新兴国防技术(军事人工智能、无人系统等)、热点案例(俄乌战争、美以伊战争)等方面的最新时讯、研究报告/论文、条令法规、案例分析,为战略研判、情报分析、决策支持等提供知识支撑。
《待命部队概念》美国海军陆战队32页报告
专知会员服务
65+阅读 · 2022年8月5日
《基于强化学习开发战斗行为》美国海军研究生院
专知会员服务
106+阅读 · 2022年6月27日
国家自然科学基金
122+阅读 · 2015年12月31日
国家自然科学基金
0+阅读 · 2015年12月31日
国家自然科学基金
0+阅读 · 2013年12月31日
国家自然科学基金
0+阅读 · 2013年12月31日
国家自然科学基金
1+阅读 · 2013年12月31日
国家自然科学基金
1+阅读 · 2013年12月31日
国家自然科学基金
0+阅读 · 2011年12月31日
国家自然科学基金
0+阅读 · 2011年12月31日
国家自然科学基金
1+阅读 · 2008年12月31日
国家自然科学基金
17+阅读 · 2008年12月31日
Arxiv
13+阅读 · 2020年4月12日
A Multi-Objective Deep Reinforcement Learning Framework
VIP会员
最新内容
美空军新型反无人机部队初探
专知会员服务
3+阅读 · 今天5:45
《防空交战流程的概率建模研究》
专知会员服务
6+阅读 · 今天5:04
ICML 2026 教程 | 数值优化理论还重要吗?
专知会员服务
4+阅读 · 7月26日
ICM 2026 | 陶哲轩:人工智能时代的数学
专知会员服务
7+阅读 · 7月26日
《反无人机交战场景下的战斗归零研究》
专知会员服务
7+阅读 · 7月26日
博士论文 | 用代码结构感知方法推进代码大模型
相关VIP内容
《待命部队概念》美国海军陆战队32页报告
专知会员服务
65+阅读 · 2022年8月5日
《基于强化学习开发战斗行为》美国海军研究生院
专知会员服务
106+阅读 · 2022年6月27日
相关资讯
相关基金
国家自然科学基金
122+阅读 · 2015年12月31日
国家自然科学基金
0+阅读 · 2015年12月31日
国家自然科学基金
0+阅读 · 2013年12月31日
国家自然科学基金
0+阅读 · 2013年12月31日
国家自然科学基金
1+阅读 · 2013年12月31日
国家自然科学基金
1+阅读 · 2013年12月31日
国家自然科学基金
0+阅读 · 2011年12月31日
国家自然科学基金
0+阅读 · 2011年12月31日
国家自然科学基金
1+阅读 · 2008年12月31日
国家自然科学基金
17+阅读 · 2008年12月31日
微信扫码咨询专知VIP会员