《CommandSwarm：面向机器人集群的安全感知自然语言到行为树生成》 - 专知VIP

会员服务 ·

10

军事防务 · 机器人集群 ·

《CommandSwarm：面向机器人集群的安全感知自然语言到行为树生成》

专知会员服务

专知，提供专业可信的知识分发服务，让认知协作更快更好！

自然语言接口可使非专业操作者更便捷地使用集群机器人技术，但其必须将模糊的用户意图转化为可执行的集群行为，同时避免生成不支持的动作、格式错误的程序或不安全的计划。本文提出CommandSwarm，一个安全感知的语言到行为树流水线，用于从语音或文本命令生成XML行为树。该系统结合了多语言翻译、命令级安全过滤、约束提示、经LoRA适配的大语言模型，以及针对可执行集群原语白名单的确定性解析器验证。我们在零样本、单样本和双样本提示下，对十一个参数量为6.7B至14B的开源大语言模型（均使用4位量化）在代表性集群控制场景中进行了评估。Falcon3-Instruct-10B和Mistral-7B-v3是提示工程效果最强的候选模型，在少样本设置下达到了0.60以上的BLEU分数和高语法有效性。在包含2,063个示例的合成指令-行为树语料库上对Falcon3-Instruct-10B进行LoRA适配后，其零样本BLEU分数从0.267提升至0.663，ROUGE-L从0.366提升至0.692，解析器接受的语法有效性从0%提升至72%。翻译实验进一步表明，SeamlessM4T v2-large和EuroLLM-9B为多语言前端提供了最佳的质量-延迟权衡。结果表明，当嵌入经过验证的系统流水线时，紧凑、量化、领域适配的大语言模型能够生成有用的集群行为树。同时，结果也表明解析器接受和安全过滤仍然是必要的执行关卡；仅凭生成质量不足以实现自主部署。

本文做出了四项贡献：1) 一个面向集群的安全感知语言到行为树架构。我们定义了一个涵盖翻译、安全过滤、基于大语言模型的行为树合成以及中间件级解析/执行的CommandSwarm四层流水线。2) 对紧凑型开源大语言模型的系统性基准测试。我们在零样本、单样本和双样本提示下评估了十一个6.7B至14B参数量的模型，所有模型均量化为4位以进行实际比较。3) 一个合成指令-行为树适配流水线。我们构建了一个包含2,063个示例的合成语料库，并使用LoRA适配Falcon3-Instruct-10B，显著提升了零样本生成质量和语法有效性。4) 一个多语言前端评估。我们比较了Whisper和SeamlessM4T用于语音翻译，以及EuroLLM变体用于文本翻译，评估指标包括BLEU、ROUGE-L、METEOR和延迟。

成为VIP会员查看完整内容

16

相关内容

军事防务

军事防务数据板块介绍：系统化采集、存储、管理、分析与军事国防安全相关信息的专用数据板块，其核心在于整合全球新兴国防技术（军事人工智能、无人系统等）、热点案例（俄乌战争、美以伊战争）等方面的最新时讯、研究报告/论文、条令法规、案例分析，为战略研判、情报分析、决策支持等提供知识支撑。

《神经安全型有人–无人协同：面向认知自适应作战能力的参考架构》

《神经安全型有人–无人协同：面向认知自适应作战能力的参考架构》

专知会员服务

19+阅读 · 6月16日

《执行无人机蜂群任务：智能体增强大语言模型推理赋能无人机物联网》

《执行无人机蜂群任务：智能体增强大语言模型推理赋能无人机物联网》

专知会员服务

14+阅读 · 5月12日

【CMU博士论文】观看、预测、行动：机器人学习遇上网络视频

【CMU博士论文】观看、预测、行动：机器人学习遇上网络视频

专知会员服务

15+阅读 · 2025年5月23日

【CVPR2025】CrayonRobo：面向机器人操作的以对象为中心的提示驱动视觉-语言-动作模型

【CVPR2025】CrayonRobo：面向机器人操作的以对象为中心的提示驱动视觉-语言-动作模型

专知会员服务

11+阅读 · 2025年5月6日

《基于人机交互界面的大规模蜂群指挥与控制》

《基于人机交互界面的大规模蜂群指挥与控制》

专知会员服务

64+阅读 · 2024年5月1日

【牛津大学博士论文】面向对象的生成模型在机器人感知与行动中的应用，148页pdf

【牛津大学博士论文】面向对象的生成模型在机器人感知与行动中的应用，148页pdf

专知会员服务

22+阅读 · 2024年2月13日

《Swarm-GPT：将大型语言模型与无人机蜂群编排设计的安全运动规划相结合》最新论文

《Swarm-GPT：将大型语言模型与无人机蜂群编排设计的安全运动规划相结合》最新论文

专知会员服务

105+阅读 · 2024年1月20日

《结合机器人行为以实现安全、智能的执行》

《结合机器人行为以实现安全、智能的执行》

专知会员服务

17+阅读 · 2023年7月4日

《集群机器人中自组织任务分配的全局到局部设计》2022最新12页论文，布鲁塞尔自由大学等

《集群机器人中自组织任务分配的全局到局部设计》2022最新12页论文，布鲁塞尔自由大学等

专知会员服务

52+阅读 · 2022年11月14日

《行为与认知机器人学》，241页pdf

《行为与认知机器人学》，241页pdf

专知会员服务

55+阅读 · 2021年4月11日

【集群机器人】《考虑敌手的多智能体系统协同任务分配与运动规划》2022最新226页博士论文，密歇根大学

【集群机器人】《考虑敌手的多智能体系统协同任务分配与运动规划》2022最新226页博士论文，密歇根大学

专知

30+阅读 · 2022年11月23日

推荐！《用机器学习发掘反综合防空系统（IADS）的蜂群自主行为》【博士论文】2022最新325页论文

推荐！《用机器学习发掘反综合防空系统（IADS）的蜂群自主行为》【博士论文】2022最新325页论文

专知

28+阅读 · 2022年10月22日

【干货书】《Transformers 机器学习:深度探究》，284页pdf

【干货书】《Transformers 机器学习:深度探究》，284页pdf

专知

72+阅读 · 2022年4月21日

NLP大牛Thomas Wolf等新书《Transformer自然语言处理》，466页pdf及代码

NLP大牛Thomas Wolf等新书《Transformer自然语言处理》，466页pdf及代码

专知

36+阅读 · 2022年2月7日

【2022新书】Transformer自然语言处理：构建语言应用

【2022新书】Transformer自然语言处理：构建语言应用

专知

38+阅读 · 2022年1月31日

【Manning新书】自然语言处理实战:深度学习应用，337页pdf

【Manning新书】自然语言处理实战:深度学习应用，337页pdf

专知

24+阅读 · 2021年11月20日

【干货书】用Python进行深思熟虑的机器学习, 216页pdf，Thoughtful ML with Python

【干货书】用Python进行深思熟虑的机器学习, 216页pdf，Thoughtful ML with Python

专知

44+阅读 · 2020年4月4日

一文看懂自然语言生成 - NLG（6个实现步骤+3个典型应用）

一文看懂自然语言生成 - NLG（6个实现步骤+3个典型应用）

AINLP

11+阅读 · 2019年8月11日

Tensorflow实战系列，手把手教你构建一个Chatbot（博文+视频）

Tensorflow实战系列，手把手教你构建一个Chatbot（博文+视频）

专知

10+阅读 · 2017年12月30日

【下载】Python自然语言处理实战书籍和代码《Natural Language Processing in Action》

【下载】Python自然语言处理实战书籍和代码《Natural Language Processing in Action》

专知

41+阅读 · 2017年12月10日

基于三维激光测距的移动机器人室外环境语义地图构建

国家自然科学基金

2+阅读 · 2015年12月31日

基于人机交互的数据驱动式人群行为建模与仿真研究

国家自然科学基金

4+阅读 · 2015年12月31日

空地机器人网络的同时视觉目标定位与分布式运动规划

国家自然科学基金

4+阅读 · 2015年12月31日

面向安全关键系统的时间可预测多核代码生成方法研究

国家自然科学基金

0+阅读 · 2015年12月31日

基于智能空间的云机器人行为知识驱动服务机制研究

国家自然科学基金

3+阅读 · 2015年12月31日

定位系统细胞启发的机器人情景认知地图构建与行为规划研究

国家自然科学基金

3+阅读 · 2015年12月31日

不确定非完整移动机器人基于一致性的分布式编队控制研究

国家自然科学基金

14+阅读 · 2015年12月31日

基于深度学习的特征融合在移动机器人视觉中的场景理解及研究

国家自然科学基金

12+阅读 · 2014年12月31日

强化学习关键技术及其在机器人行为学习中的应用

国家自然科学基金

23+阅读 · 2009年12月31日

基于多智能体强化学习的多机器人系统研究

国家自然科学基金

50+阅读 · 2009年12月31日

Decoupled Object-Centric Video Understanding for Generating Robotic Manipulation Commands

Arxiv

0+阅读 · 6月15日

SynManDex: Synthesizing Human-like Dexterous Grasps from Synthetic Human Pre-Grasps

Arxiv

0+阅读 · 6月8日

CLASP: Language-Driven Robot Skill Selection and Composition using Task-Parameterized Learning

Arxiv

0+阅读 · 6月6日

Physics-Informed Modeling and Control of Emergent Behaviors in Robot Swarms

Arxiv

0+阅读 · 6月1日

Learning Structured Robot Policies from Vision-Language Models via Synthetic Neuro-Symbolic Supervision

Arxiv

0+阅读 · 5月15日

HECTOR: Human-centric Hierarchical Coordination and Supervision of Robotic Fleets under Continual Temporal Tasks

Arxiv

0+阅读 · 5月14日

Self-CriTeach: LLM Self-Teaching and Self-Critiquing for Improving Robotic Planning via Automated Domain Generation

Arxiv

0+阅读 · 5月13日

Melding LLM and temporal logic for reliable human-swarm collaboration in complex scenarios

Arxiv

0+阅读 · 5月8日

CommandSwarm: Safety-Aware Natural Language-to-Behavior-Tree Generation for Robotic Swarms

Arxiv

0+阅读 · 5月8日

Commanding Humanoid by Free-form Language: A Large Language Action Model with Unified Motion Vocabulary

Arxiv

0+阅读 · 4月10日

VIP会员

相关主题

机器人集群

最新内容

《美国空军B-2“幽灵”隐身轰炸机系统工程案例研究》117页

《美国空军B-2“幽灵”隐身轰炸机系统工程案例研究》117页

专知会员服务

5+阅读 · 今天4:35

隐身技术前沿综述：物理机理、工程实践与战略展望

隐身技术前沿综述：物理机理、工程实践与战略展望

专知会员服务

3+阅读 · 今天4:24

《多变海洋环境下无人水面艇与自主水下机器人对接的最优路径规划》

《多变海洋环境下无人水面艇与自主水下机器人对接的最优路径规划》

专知会员服务

3+阅读 · 今天4:18

《以机反机：基于无人机载麦克风的空中周界入侵检测》

《以机反机：基于无人机载麦克风的空中周界入侵检测》

专知会员服务

4+阅读 · 今天4:15

《无人机脆弱性利用：网络空间力量的新域》

《无人机脆弱性利用：网络空间力量的新域》

专知会员服务

2+阅读 · 今天4:08

美空军如何将人工智能从战场部署至后方机关

美空军如何将人工智能从战场部署至后方机关

专知会员服务

11+阅读 · 7月31日

《美战争部指令文件：网络空间效应与使能能力测试评估》

《美战争部指令文件：网络空间效应与使能能力测试评估》

专知会员服务

7+阅读 · 7月31日

《史诗怒火行动：多域前瞻评估》49页报告

《史诗怒火行动：多域前瞻评估》49页报告

专知会员服务

7+阅读 · 7月31日

《英国防部：未来空战系统数字化战略》33页

《英国防部：未来空战系统数字化战略》33页

专知会员服务

5+阅读 · 7月31日

《面向自主飞行网络的智能体人工智能架构》

《面向自主飞行网络的智能体人工智能架构》

专知会员服务

7+阅读 · 7月31日

“史诗怒火”行动：现代多域作战的重要节点

“史诗怒火”行动：现代多域作战的重要节点

专知会员服务

8+阅读 · 7月30日

《下一代无线网络中的多无人机通信资源管理》

《下一代无线网络中的多无人机通信资源管理》

专知会员服务

8+阅读 · 7月30日

《高分辨率模拟下的聚合战斗建模：以“会战交锋”场景为例》

《高分辨率模拟下的聚合战斗建模：以“会战交锋”场景为例》

专知会员服务

9+阅读 · 7月30日

《人机协同在安全关键型操作决策中的应用》120页

《人机协同在安全关键型操作决策中的应用》120页

专知会员服务

8+阅读 · 7月30日

网络防御与空中力量网络防护：21世纪空中力量历史与理论的启示

网络防御与空中力量网络防护：21世纪空中力量历史与理论的启示

专知会员服务

6+阅读 · 7月30日

相关VIP内容

《神经安全型有人–无人协同：面向认知自适应作战能力的参考架构》

《神经安全型有人–无人协同：面向认知自适应作战能力的参考架构》

专知会员服务

19+阅读 · 6月16日

《执行无人机蜂群任务：智能体增强大语言模型推理赋能无人机物联网》

《执行无人机蜂群任务：智能体增强大语言模型推理赋能无人机物联网》

专知会员服务

14+阅读 · 5月12日

【CMU博士论文】观看、预测、行动：机器人学习遇上网络视频

【CMU博士论文】观看、预测、行动：机器人学习遇上网络视频

专知会员服务

15+阅读 · 2025年5月23日

【CVPR2025】CrayonRobo：面向机器人操作的以对象为中心的提示驱动视觉-语言-动作模型

【CVPR2025】CrayonRobo：面向机器人操作的以对象为中心的提示驱动视觉-语言-动作模型

专知会员服务

11+阅读 · 2025年5月6日

《基于人机交互界面的大规模蜂群指挥与控制》

《基于人机交互界面的大规模蜂群指挥与控制》

专知会员服务

64+阅读 · 2024年5月1日

【牛津大学博士论文】面向对象的生成模型在机器人感知与行动中的应用，148页pdf

【牛津大学博士论文】面向对象的生成模型在机器人感知与行动中的应用，148页pdf

专知会员服务

22+阅读 · 2024年2月13日

《Swarm-GPT：将大型语言模型与无人机蜂群编排设计的安全运动规划相结合》最新论文

《Swarm-GPT：将大型语言模型与无人机蜂群编排设计的安全运动规划相结合》最新论文

专知会员服务

105+阅读 · 2024年1月20日

《结合机器人行为以实现安全、智能的执行》

《结合机器人行为以实现安全、智能的执行》

专知会员服务

17+阅读 · 2023年7月4日

《集群机器人中自组织任务分配的全局到局部设计》2022最新12页论文，布鲁塞尔自由大学等

《集群机器人中自组织任务分配的全局到局部设计》2022最新12页论文，布鲁塞尔自由大学等

专知会员服务

52+阅读 · 2022年11月14日

《行为与认知机器人学》，241页pdf

《行为与认知机器人学》，241页pdf

专知会员服务

55+阅读 · 2021年4月11日

热门VIP内容

开通专知VIP会员享更多权益服务

隐身技术前沿综述：物理机理、工程实践与战略展望

《以机反机：基于无人机载麦克风的空中周界入侵检测》

《美国空军B-2“幽灵”隐身轰炸机系统工程案例研究》117页

《多变海洋环境下无人水面艇与自主水下机器人对接的最优路径规划》

相关资讯

【集群机器人】《考虑敌手的多智能体系统协同任务分配与运动规划》2022最新226页博士论文，密歇根大学

【集群机器人】《考虑敌手的多智能体系统协同任务分配与运动规划》2022最新226页博士论文，密歇根大学

专知

30+阅读 · 2022年11月23日

推荐！《用机器学习发掘反综合防空系统（IADS）的蜂群自主行为》【博士论文】2022最新325页论文

推荐！《用机器学习发掘反综合防空系统（IADS）的蜂群自主行为》【博士论文】2022最新325页论文

专知

28+阅读 · 2022年10月22日

【干货书】《Transformers 机器学习:深度探究》，284页pdf

【干货书】《Transformers 机器学习:深度探究》，284页pdf

专知

72+阅读 · 2022年4月21日

NLP大牛Thomas Wolf等新书《Transformer自然语言处理》，466页pdf及代码

NLP大牛Thomas Wolf等新书《Transformer自然语言处理》，466页pdf及代码

专知

36+阅读 · 2022年2月7日

【2022新书】Transformer自然语言处理：构建语言应用

【2022新书】Transformer自然语言处理：构建语言应用

专知

38+阅读 · 2022年1月31日

【Manning新书】自然语言处理实战:深度学习应用，337页pdf

【Manning新书】自然语言处理实战:深度学习应用，337页pdf

专知

24+阅读 · 2021年11月20日

【干货书】用Python进行深思熟虑的机器学习, 216页pdf，Thoughtful ML with Python

【干货书】用Python进行深思熟虑的机器学习, 216页pdf，Thoughtful ML with Python

专知

44+阅读 · 2020年4月4日

一文看懂自然语言生成 - NLG（6个实现步骤+3个典型应用）

一文看懂自然语言生成 - NLG（6个实现步骤+3个典型应用）

AINLP

11+阅读 · 2019年8月11日

Tensorflow实战系列，手把手教你构建一个Chatbot（博文+视频）

Tensorflow实战系列，手把手教你构建一个Chatbot（博文+视频）

专知

10+阅读 · 2017年12月30日

【下载】Python自然语言处理实战书籍和代码《Natural Language Processing in Action》

【下载】Python自然语言处理实战书籍和代码《Natural Language Processing in Action》

专知

41+阅读 · 2017年12月10日

相关基金

基于三维激光测距的移动机器人室外环境语义地图构建

国家自然科学基金

2+阅读 · 2015年12月31日

基于人机交互的数据驱动式人群行为建模与仿真研究

国家自然科学基金

4+阅读 · 2015年12月31日

空地机器人网络的同时视觉目标定位与分布式运动规划

国家自然科学基金

4+阅读 · 2015年12月31日

面向安全关键系统的时间可预测多核代码生成方法研究

国家自然科学基金

0+阅读 · 2015年12月31日

基于智能空间的云机器人行为知识驱动服务机制研究

国家自然科学基金

3+阅读 · 2015年12月31日

定位系统细胞启发的机器人情景认知地图构建与行为规划研究

国家自然科学基金

3+阅读 · 2015年12月31日

不确定非完整移动机器人基于一致性的分布式编队控制研究

国家自然科学基金

14+阅读 · 2015年12月31日

基于深度学习的特征融合在移动机器人视觉中的场景理解及研究

国家自然科学基金

12+阅读 · 2014年12月31日

强化学习关键技术及其在机器人行为学习中的应用

国家自然科学基金

23+阅读 · 2009年12月31日

基于多智能体强化学习的多机器人系统研究

国家自然科学基金

50+阅读 · 2009年12月31日

相关论文

Decoupled Object-Centric Video Understanding for Generating Robotic Manipulation Commands

Arxiv

0+阅读 · 6月15日

SynManDex: Synthesizing Human-like Dexterous Grasps from Synthetic Human Pre-Grasps

Arxiv

0+阅读 · 6月8日

CLASP: Language-Driven Robot Skill Selection and Composition using Task-Parameterized Learning

Arxiv

0+阅读 · 6月6日

Physics-Informed Modeling and Control of Emergent Behaviors in Robot Swarms

Arxiv

0+阅读 · 6月1日

Learning Structured Robot Policies from Vision-Language Models via Synthetic Neuro-Symbolic Supervision

Arxiv

0+阅读 · 5月15日

HECTOR: Human-centric Hierarchical Coordination and Supervision of Robotic Fleets under Continual Temporal Tasks

Arxiv

0+阅读 · 5月14日

Self-CriTeach: LLM Self-Teaching and Self-Critiquing for Improving Robotic Planning via Automated Domain Generation

Arxiv

0+阅读 · 5月13日

Melding LLM and temporal logic for reliable human-swarm collaboration in complex scenarios

Arxiv

0+阅读 · 5月8日

CommandSwarm: Safety-Aware Natural Language-to-Behavior-Tree Generation for Robotic Swarms

Arxiv

0+阅读 · 5月8日

Commanding Humanoid by Free-form Language: A Large Language Action Model with Unified Motion Vocabulary

Arxiv

0+阅读 · 4月10日

微信扫码咨询专知VIP会员