TextMineX: Data, Evaluation Framework and Ontology-guided LLM Pipeline for Humanitarian Mine Action - 专知论文

会员服务 ·

0

本体 · 数据集 · 知识 · 结构 · 结构化 ·

TextMineX: Data, Evaluation Framework and Ontology-guided LLM Pipeline for Humanitarian Mine Action

翻译：TextMineX：面向人道主义排雷行动的数据集、评估框架与本体引导的大型语言模型流水线

Chenyue Zhou,Gürkan Solmaz,Flavio Cirillo,Kiril Gashteovski,Jonathan Fürst

Humanitarian Mine Action (HMA) addresses the challenge of detecting and removing landmines from conflict regions. Much of the life-saving operational knowledge produced by HMA agencies is buried in unstructured reports, limiting the transferability of information between agencies. To address this issue, we propose TextMineX: the first dataset, evaluation framework and ontology-guided large language model (LLM) pipeline for knowledge extraction from text in the HMA domain. TextMineX structures HMA reports into (subject, relation, object)-triples, thus creating domain-specific knowledge. To ensure real-world relevance, we utilized the dataset from our collaborator Cambodian Mine Action Centre (CMAC). We further introduce a bias-aware evaluation framework that combines human-annotated triples with an LLM-as-Judge protocol to mitigate position bias in reference-free scoring. Our experiments show that ontology-aligned prompts improve extraction accuracy by up to 44.2%, reduce hallucinations by 22.5%, and enhance format adherence by 20.9% compared to baseline models. We publicly release the dataset and code.

翻译：人道主义排雷行动致力于解决冲突地区地雷探测与清除的挑战。排雷机构产生的大量关键操作知识埋藏在非结构化报告中，限制了信息在机构间的可转移性。为解决此问题，我们提出TextMineX：首个面向HMA领域文本知识提取的数据集、评估框架及本体引导的大型语言模型流水线。TextMineX将HMA报告结构化表示为（主体，关系，客体）三元组，从而构建领域特定知识。为确保现实相关性，我们采用了合作方柬埔寨排雷行动中心的数据集。我们进一步提出一种偏差感知评估框架，该框架结合人工标注三元组与LLM-as-Judge协议，以缓解无参考评分中的位置偏差。实验表明，与基线模型相比，本体对齐提示将提取准确率最高提升44.2%，幻觉率降低22.5%，格式遵循度提高20.9%。我们公开发布了数据集与代码。

0

相关内容

《行动路径：运用武器流动数据强化冲突预警》智库报告

《行动路径：运用武器流动数据强化冲突预警》智库报告

专知会员服务

17+阅读 · 2025年4月15日

CMNEE：基于开源中国军事新闻的大规模文档级事件抽取数据集

CMNEE：基于开源中国军事新闻的大规模文档级事件抽取数据集

专知会员服务

48+阅读 · 2024年6月2日

《开发未来水雷——“狂人”（具有自主导航功能的海区拒止雷）》150页报告

《开发未来水雷——“狂人”（具有自主导航功能的海区拒止雷）》150页报告

专知会员服务

42+阅读 · 2024年1月25日

《MiNet：基于深度学习的海军类水雷目标自动识别》2023最新26页技术手册

《MiNet：基于深度学习的海军类水雷目标自动识别》2023最新26页技术手册

专知会员服务

39+阅读 · 2023年10月30日

什么是大模型Red-teaming？大模型安全研究《结构大语言模型红蓝对抗》（含下载）

什么是大模型Red-teaming？大模型安全研究《结构大语言模型红蓝对抗》（含下载）

专知会员服务

55+阅读 · 2023年5月1日

【AAAI2023】DPText-DETR: 基于动态点query的场景文本检测，更高更快更鲁棒

【AAAI2023】DPText-DETR: 基于动态点query的场景文本检测，更高更快更鲁棒

专知会员服务

17+阅读 · 2023年1月23日

【系统工程顶点报告】《基于建模和仿真以识别攻击性拒止水雷的关键性能驱动因素和行为响应》美国海军研究生院132页报告

【系统工程顶点报告】《基于建模和仿真以识别攻击性拒止水雷的关键性能驱动因素和行为响应》美国海军研究生院132页报告

专知会员服务

62+阅读 · 2022年9月20日

中科院宗成庆老师新书《文本数据挖掘》，韩家炜作序，363页pdf阐述文本数据挖掘的理论模型、实现算法和相关应用

中科院宗成庆老师新书《文本数据挖掘》，韩家炜作序，363页pdf阐述文本数据挖掘的理论模型、实现算法和相关应用

专知会员服务

189+阅读 · 2021年6月1日

【KDD2020】通用文档预训练模型LayoutLM：文档结构信息和视觉信息进行建模，让模型在预训练阶段进行多模态对齐。

【KDD2020】通用文档预训练模型LayoutLM：文档结构信息和视觉信息进行建模，让模型在预训练阶段进行多模态对齐。

专知会员服务

32+阅读 · 2020年8月23日

【ICLR2020 预训练的百科全书】弱监督的知识-预训练的语言模型（PRETRAINED ENCYCLOPEDIA: WEAKLY SUPERVISED KNOWLEDGE-PRETRAINED LANGUAGE MODEL）

【ICLR2020 预训练的百科全书】弱监督的知识-预训练的语言模型（PRETRAINED ENCYCLOPEDIA: WEAKLY SUPERVISED KNOWLEDGE-PRETRAINED LANGUAGE MODEL）

专知会员服务

25+阅读 · 2019年12月26日

【复旦大学】最新《预训练语言模型》2020综述论文大全，50+PTMs分类体系，25页pdf205篇参考文献

【复旦大学】最新《预训练语言模型》2020综述论文大全，50+PTMs分类体系，25页pdf205篇参考文献

专知

22+阅读 · 2020年3月19日

中山大学发布最新《图对抗机器学习》2020综述论文，带你全面了解40+种攻防对抗学习方法

中山大学发布最新《图对抗机器学习》2020综述论文，带你全面了解40+种攻防对抗学习方法

专知

15+阅读 · 2020年3月13日

论文浅尝 | 探索将预训练语言模型用于事件抽取和事件生成

论文浅尝 | 探索将预训练语言模型用于事件抽取和事件生成

开放知识图谱

26+阅读 · 2019年11月8日

论文浅尝 | Doc2EDAG：一种针对中文金融事件抽取的端到端文档级框架

论文浅尝 | Doc2EDAG：一种针对中文金融事件抽取的端到端文档级框架

开放知识图谱

35+阅读 · 2019年10月7日

【泡泡图灵智库】ContextDesc：用跨模态上下文增强的局部描述子

【泡泡图灵智库】ContextDesc：用跨模态上下文增强的局部描述子

泡泡机器人SLAM

34+阅读 · 2019年9月18日

【泡泡图灵智库】Detect-SLAM：目标检测和SLAM相互收益

【泡泡图灵智库】Detect-SLAM：目标检测和SLAM相互收益

泡泡机器人SLAM

14+阅读 · 2019年6月28日

简单高效的Bert中文文本分类模型开发和部署

简单高效的Bert中文文本分类模型开发和部署

AINLP

49+阅读 · 2019年6月6日

Github 项目推荐 | 包含文本数据的免费 / 公共领域的 NLP 数据集

Github 项目推荐 | 包含文本数据的免费 / 公共领域的 NLP 数据集

AI研习社

12+阅读 · 2018年4月10日

推荐｜上交大推出Texygen：文本生成模型的基准测试平台

推荐｜上交大推出Texygen：文本生成模型的基准测试平台

全球人工智能

15+阅读 · 2018年2月8日

TextInfoExp:自然语言处理相关实验（基于sougou数据集）

TextInfoExp:自然语言处理相关实验（基于sougou数据集）

全球人工智能

12+阅读 · 2017年11月12日

抗噪、抗假频叠前地震数据插值方法研究

国家自然科学基金

1+阅读 · 2016年12月31日

突发灾难环境下混合式移动社会网络的消息分发机制研究

国家自然科学基金

0+阅读 · 2015年12月31日

基于在线社会媒体数据的疾病传播过程中人类行为变化机制与模型研究

国家自然科学基金

0+阅读 · 2015年12月31日

超宽带生命探测雷达多观测点数据关联处理方法研究

国家自然科学基金

0+阅读 · 2015年12月31日

顾及扫描上下文的预测与判决相结合的点云在线分类方法

国家自然科学基金

0+阅读 · 2015年12月31日

多标记文本数据流分类方法研究

国家自然科学基金

3+阅读 · 2015年12月31日

基于文本模式的海量电能质量数据自动分析技术研究

国家自然科学基金

0+阅读 · 2014年12月31日

复杂地震环境下多源遥感影像引力智能优化分类模型与算法研究

国家自然科学基金

0+阅读 · 2014年12月31日

基于元胞自动机的城市洪水-人群疏散耦合建模方法

国家自然科学基金

0+阅读 · 2014年12月31日

行为轨迹数据高性能时空聚类及社会分析

国家自然科学基金

2+阅读 · 2014年12月31日

RANT: Ant-Inspired Multi-Robot Rainforest Exploration Using Particle Filter Localisation and Virtual Pheromone Coordination

Arxiv

0+阅读 · 2月10日

Large Language Models for Geolocation Extraction in Humanitarian Crisis Response

Arxiv

0+阅读 · 2月9日

GuardReasoner-Omni: A Reasoning-based Multi-modal Guardrail for Text, Image, and Video

Arxiv

0+阅读 · 2月3日

GeoResponder: Towards Building Geospatial LLMs for Time-Critical Disaster Response

Arxiv

0+阅读 · 2月3日

GRAB: An LLM-Inspired Sequence-First Click-Through Rate Prediction Modeling Paradigm

Arxiv

0+阅读 · 2月3日

StefaLand: An Efficient Geoscience Foundation Model That Improves Dynamic Land-Surface Predictions

Arxiv

0+阅读 · 2月2日

MineInsight: A Multi-sensor Dataset for Humanitarian Demining Robotics in Off-Road Environments

Arxiv

0+阅读 · 2月2日

TextMineX: Data, Evaluation Framework and Ontology-guided LLM Pipeline for Humanitarian Mine Action

Arxiv

0+阅读 · 1月21日

HUMANLLM: Benchmarking and Reinforcing LLM Anthropomorphism via Human Cognitive Patterns

Arxiv

0+阅读 · 1月15日

TerraFormer: Automated Infrastructure-as-Code with LLMs Fine-Tuned via Policy-Guided Verifier Feedback

Arxiv

0+阅读 · 1月13日

VIP会员

文章信息

相关主题

最新内容

ICML 2026 Spotlight | SmoothSMoE：解析稀疏 MoE 路由不连续

ICML 2026 Spotlight | SmoothSMoE：解析稀疏 MoE 路由不连续

专知会员服务

0+阅读 · 今天14:40

综述 | 周期表视角下的大模型推理：范式、方法与失败模式

综述 | 周期表视角下的大模型推理：范式、方法与失败模式

专知会员服务

0+阅读 · 今天14:36

《廉价自杀式无人机战争的军事战略影响：乌克兰和伊朗案例研究》

《廉价自杀式无人机战争的军事战略影响：乌克兰和伊朗案例研究》

专知会员服务

7+阅读 · 今天2:06

《面向反无人机作战的联邦式可解释射频–光电/红外情报融合：边缘人工智能优化、电子战韧性及分布式监视验证》

《面向反无人机作战的联邦式可解释射频–光电/红外情报融合：边缘人工智能优化、电子战韧性及分布式监视验证》

专知会员服务

5+阅读 · 今天1:37

ICML 2026 | FR3D：解耦自车运动的未来动态三维重建世界模型

ICML 2026 | FR3D：解耦自车运动的未来动态三维重建世界模型

专知会员服务

3+阅读 · 6月17日

【伯克利博士论文】迈向可扩展与自我演进的大语言模型智能体

【伯克利博士论文】迈向可扩展与自我演进的大语言模型智能体

专知会员服务

5+阅读 · 6月17日

学习数据的几何：形状空间分析数学综述

学习数据的几何：形状空间分析数学综述

专知会员服务

4+阅读 · 6月17日

《现代防空系统综述：架构、传感器、拦截器及新兴威胁环境对基础设施受限防御环境的影响》2026最新长综述

《现代防空系统综述：架构、传感器、拦截器及新兴威胁环境对基础设施受限防御环境的影响》2026最新长综述

专知会员服务

7+阅读 · 6月17日

定向能反无人机系统最新发展动态

定向能反无人机系统最新发展动态

专知会员服务

7+阅读 · 6月17日

从燃煤战舰到算法战争：水面指挥的永恒要求

从燃煤战舰到算法战争：水面指挥的永恒要求

专知会员服务

4+阅读 · 6月17日

《短程弹道再入飞行器拦截时间中的一项异常现象》

《短程弹道再入飞行器拦截时间中的一项异常现象》

专知会员服务

6+阅读 · 6月17日

《基于回归方法与任务上下文的对抗环境动态战术网络报文优先级排序》

《基于回归方法与任务上下文的对抗环境动态战术网络报文优先级排序》

专知会员服务

6+阅读 · 6月17日

美智库《战术级指挥控制的迫切要求：构建弹性机动式指挥控制网络》报告

美智库《战术级指挥控制的迫切要求：构建弹性机动式指挥控制网络》报告

专知会员服务

5+阅读 · 6月17日

《韩国国防政策与军备出口：韩国安全与国防政策如何塑造其国防工业与军备出口格局》最新100页报告

《韩国国防政策与军备出口：韩国安全与国防政策如何塑造其国防工业与军备出口格局》最新100页报告

专知会员服务

4+阅读 · 6月17日

ICML 2026 | VOTP：用视频基础模型与最优传输，让离线偏好强化学习只需少量反馈

ICML 2026 | VOTP：用视频基础模型与最优传输，让离线偏好强化学习只需少量反馈

专知会员服务

6+阅读 · 6月16日

相关VIP内容

《行动路径：运用武器流动数据强化冲突预警》智库报告

《行动路径：运用武器流动数据强化冲突预警》智库报告

专知会员服务

17+阅读 · 2025年4月15日

CMNEE：基于开源中国军事新闻的大规模文档级事件抽取数据集

CMNEE：基于开源中国军事新闻的大规模文档级事件抽取数据集

专知会员服务

48+阅读 · 2024年6月2日

《开发未来水雷——“狂人”（具有自主导航功能的海区拒止雷）》150页报告

《开发未来水雷——“狂人”（具有自主导航功能的海区拒止雷）》150页报告

专知会员服务

42+阅读 · 2024年1月25日

《MiNet：基于深度学习的海军类水雷目标自动识别》2023最新26页技术手册

《MiNet：基于深度学习的海军类水雷目标自动识别》2023最新26页技术手册

专知会员服务

39+阅读 · 2023年10月30日

什么是大模型Red-teaming？大模型安全研究《结构大语言模型红蓝对抗》（含下载）

什么是大模型Red-teaming？大模型安全研究《结构大语言模型红蓝对抗》（含下载）

专知会员服务

55+阅读 · 2023年5月1日

【AAAI2023】DPText-DETR: 基于动态点query的场景文本检测，更高更快更鲁棒

【AAAI2023】DPText-DETR: 基于动态点query的场景文本检测，更高更快更鲁棒

专知会员服务

17+阅读 · 2023年1月23日

【系统工程顶点报告】《基于建模和仿真以识别攻击性拒止水雷的关键性能驱动因素和行为响应》美国海军研究生院132页报告

【系统工程顶点报告】《基于建模和仿真以识别攻击性拒止水雷的关键性能驱动因素和行为响应》美国海军研究生院132页报告

专知会员服务

62+阅读 · 2022年9月20日

中科院宗成庆老师新书《文本数据挖掘》，韩家炜作序，363页pdf阐述文本数据挖掘的理论模型、实现算法和相关应用

中科院宗成庆老师新书《文本数据挖掘》，韩家炜作序，363页pdf阐述文本数据挖掘的理论模型、实现算法和相关应用

专知会员服务

189+阅读 · 2021年6月1日

【KDD2020】通用文档预训练模型LayoutLM：文档结构信息和视觉信息进行建模，让模型在预训练阶段进行多模态对齐。

【KDD2020】通用文档预训练模型LayoutLM：文档结构信息和视觉信息进行建模，让模型在预训练阶段进行多模态对齐。

专知会员服务

32+阅读 · 2020年8月23日

【ICLR2020 预训练的百科全书】弱监督的知识-预训练的语言模型（PRETRAINED ENCYCLOPEDIA: WEAKLY SUPERVISED KNOWLEDGE-PRETRAINED LANGUAGE MODEL）

【ICLR2020 预训练的百科全书】弱监督的知识-预训练的语言模型（PRETRAINED ENCYCLOPEDIA: WEAKLY SUPERVISED KNOWLEDGE-PRETRAINED LANGUAGE MODEL）

专知会员服务

25+阅读 · 2019年12月26日

热门VIP内容

开通专知VIP会员享更多权益服务

综述 | 周期表视角下的大模型推理：范式、方法与失败模式

《面向反无人机作战的联邦式可解释射频–光电/红外情报融合：边缘人工智能优化、电子战韧性及分布式监视验证》

ICML 2026 Spotlight | SmoothSMoE：解析稀疏 MoE 路由不连续

《廉价自杀式无人机战争的军事战略影响：乌克兰和伊朗案例研究》

相关资讯

【复旦大学】最新《预训练语言模型》2020综述论文大全，50+PTMs分类体系，25页pdf205篇参考文献

【复旦大学】最新《预训练语言模型》2020综述论文大全，50+PTMs分类体系，25页pdf205篇参考文献

专知

22+阅读 · 2020年3月19日

中山大学发布最新《图对抗机器学习》2020综述论文，带你全面了解40+种攻防对抗学习方法

中山大学发布最新《图对抗机器学习》2020综述论文，带你全面了解40+种攻防对抗学习方法

专知

15+阅读 · 2020年3月13日

论文浅尝 | 探索将预训练语言模型用于事件抽取和事件生成

论文浅尝 | 探索将预训练语言模型用于事件抽取和事件生成

开放知识图谱

26+阅读 · 2019年11月8日

论文浅尝 | Doc2EDAG：一种针对中文金融事件抽取的端到端文档级框架

论文浅尝 | Doc2EDAG：一种针对中文金融事件抽取的端到端文档级框架

开放知识图谱

35+阅读 · 2019年10月7日

【泡泡图灵智库】ContextDesc：用跨模态上下文增强的局部描述子

【泡泡图灵智库】ContextDesc：用跨模态上下文增强的局部描述子

泡泡机器人SLAM

34+阅读 · 2019年9月18日

【泡泡图灵智库】Detect-SLAM：目标检测和SLAM相互收益

【泡泡图灵智库】Detect-SLAM：目标检测和SLAM相互收益

泡泡机器人SLAM

14+阅读 · 2019年6月28日

简单高效的Bert中文文本分类模型开发和部署

简单高效的Bert中文文本分类模型开发和部署

AINLP

49+阅读 · 2019年6月6日

Github 项目推荐 | 包含文本数据的免费 / 公共领域的 NLP 数据集

Github 项目推荐 | 包含文本数据的免费 / 公共领域的 NLP 数据集

AI研习社

12+阅读 · 2018年4月10日

推荐｜上交大推出Texygen：文本生成模型的基准测试平台

推荐｜上交大推出Texygen：文本生成模型的基准测试平台

全球人工智能

15+阅读 · 2018年2月8日

TextInfoExp:自然语言处理相关实验（基于sougou数据集）

TextInfoExp:自然语言处理相关实验（基于sougou数据集）

全球人工智能

12+阅读 · 2017年11月12日

相关论文

RANT: Ant-Inspired Multi-Robot Rainforest Exploration Using Particle Filter Localisation and Virtual Pheromone Coordination

Arxiv

0+阅读 · 2月10日

Large Language Models for Geolocation Extraction in Humanitarian Crisis Response

Arxiv

0+阅读 · 2月9日

GuardReasoner-Omni: A Reasoning-based Multi-modal Guardrail for Text, Image, and Video

Arxiv

0+阅读 · 2月3日

GeoResponder: Towards Building Geospatial LLMs for Time-Critical Disaster Response

Arxiv

0+阅读 · 2月3日

GRAB: An LLM-Inspired Sequence-First Click-Through Rate Prediction Modeling Paradigm

Arxiv

0+阅读 · 2月3日

StefaLand: An Efficient Geoscience Foundation Model That Improves Dynamic Land-Surface Predictions

Arxiv

0+阅读 · 2月2日

MineInsight: A Multi-sensor Dataset for Humanitarian Demining Robotics in Off-Road Environments

Arxiv

0+阅读 · 2月2日

TextMineX: Data, Evaluation Framework and Ontology-guided LLM Pipeline for Humanitarian Mine Action

Arxiv

0+阅读 · 1月21日

HUMANLLM: Benchmarking and Reinforcing LLM Anthropomorphism via Human Cognitive Patterns

Arxiv

0+阅读 · 1月15日

TerraFormer: Automated Infrastructure-as-Code with LLMs Fine-Tuned via Policy-Guided Verifier Feedback

Arxiv

0+阅读 · 1月13日

相关基金

抗噪、抗假频叠前地震数据插值方法研究

国家自然科学基金

1+阅读 · 2016年12月31日

突发灾难环境下混合式移动社会网络的消息分发机制研究

国家自然科学基金

0+阅读 · 2015年12月31日

基于在线社会媒体数据的疾病传播过程中人类行为变化机制与模型研究

国家自然科学基金

0+阅读 · 2015年12月31日

超宽带生命探测雷达多观测点数据关联处理方法研究

国家自然科学基金

0+阅读 · 2015年12月31日

顾及扫描上下文的预测与判决相结合的点云在线分类方法

国家自然科学基金

0+阅读 · 2015年12月31日

多标记文本数据流分类方法研究

国家自然科学基金

3+阅读 · 2015年12月31日

基于文本模式的海量电能质量数据自动分析技术研究

国家自然科学基金

0+阅读 · 2014年12月31日

复杂地震环境下多源遥感影像引力智能优化分类模型与算法研究

国家自然科学基金

0+阅读 · 2014年12月31日

基于元胞自动机的城市洪水-人群疏散耦合建模方法

国家自然科学基金

0+阅读 · 2014年12月31日

行为轨迹数据高性能时空聚类及社会分析

国家自然科学基金

2+阅读 · 2014年12月31日

微信扫码咨询专知VIP会员