FARM: Few-shot Adaptive Malware Family Classification under Concept Drift - 专知论文

会员服务 ·

0

样本 · 软件 · 自适应 · 概念漂移 · 潜在 ·

FARM: Few-shot Adaptive Malware Family Classification under Concept Drift

翻译：FARM：概念漂移下的少样本自适应恶意软件家族分类

Numan Halit Guldemir,Oluwafemi Olukoya,Jesús Martínez-del-Rincón

from arxiv, This work has been submitted to the IEEE for possible publication

Malware classification models often face performance degradation due to concept drift, arising from evolving threat landscapes and the emergence of novel malware families. This paper presents FARM (Few-shot Adaptive Recognition of Malware), a framework designed to detect and adapt to both covariate and label drift in Windows Portable Executable (PE) malware classification. FARM leverages a triplet autoencoder to project samples into a discriminative latent space, enabling unsupervised drift detection via DBSCAN clustering and dynamic thresholding. For rapid adaptation, it employs few-shot learning using prototype-based classification, requiring only a handful of labeled samples. FARM also supports full retraining when enough drifted samples accumulate, updating the latent space for long-term integration. Experiments on the BenchMFC dataset demonstrate that FARM improves classification performance under covariate drift by 5.6\%, and achieves an average F1 score of 0.85 on unseen malware families using only few-shot adaptation, which further increases to 0.94 after retraining. These results highlight FARM's robustness and adaptability in dynamic malware detection environments under limited supervision.

翻译：恶意软件分类模型常因威胁环境演变及新型恶意软件家族出现导致的概念漂移而面临性能退化。本文提出FARM（恶意软件少样本自适应识别）框架，旨在检测并适应Windows可移植可执行（PE）恶意软件分类中的协变量漂移与标签漂移。FARM利用三元组自编码器将样本映射至判别性潜在空间，通过DBSCAN聚类与动态阈值实现无监督漂移检测。为快速适应，该框架采用基于原型分类的少样本学习，仅需少量标注样本。当积累足够漂移样本时，FARM支持通过全量重训练更新潜在空间以实现长期整合。在BenchMFC数据集上的实验表明，FARM将协变量漂移下的分类性能提升5.6%，仅通过少样本适应即在未见恶意软件家族上获得0.85的平均F1分数，重训练后进一步提升至0.94。这些结果凸显了FARM在有限监督条件下动态恶意软件检测环境中的鲁棒性与自适应能力。

0

相关内容

《分布式机器人群体聚类：增加抵御恶意伪装攻击的能力》

《分布式机器人群体聚类：增加抵御恶意伪装攻击的能力》

专知会员服务

28+阅读 · 2023年11月6日

《H4rm0ny：用于规避恶意软件生成和检测的多智能体学习的竞争性两人零和马尔可夫博弈》2022最新12页论文，加拿大国防研究与发展部

《H4rm0ny：用于规避恶意软件生成和检测的多智能体学习的竞争性两人零和马尔可夫博弈》2022最新12页论文，加拿大国防研究与发展部

专知会员服务

26+阅读 · 2022年10月26日

NTU最新《广义分布外OOD检测》综述论文，20页pdf阐述离群/异常/新类/开集/分布外检测的异同

NTU最新《广义分布外OOD检测》综述论文，20页pdf阐述离群/异常/新类/开集/分布外检测的异同

专知会员服务

29+阅读 · 2021年10月26日

复旦大学邱锡鹏等《自然语言处理范式迁移综述》论文，详述7大NLP范式：分类、匹配、SeqLab, MRC, Seq2Seq等

专知会员服务

54+阅读 · 2021年9月29日

【KDD2021】知识增强领域自适应的少样本关系分类

专知会员服务

38+阅读 · 2021年9月15日

恶意文档检测研究综述

专知会员服务

19+阅读 · 2021年6月10日

【Mila】通用表示Transformer少样本图像分类

【Mila】通用表示Transformer少样本图像分类

专知会员服务

33+阅读 · 2020年9月7日

【华南理工大学】无监督多类域自适应:理论、算法和实践，Unsupervised Multi-Class DA

专知会员服务

28+阅读 · 2020年3月2日

【华南理工大学】无监督多类域自适应:理论、算法和实践，Unsupervised Multi-Class Domain Adaptation: Theory, Algorithms, and Practice

【华南理工大学】无监督多类域自适应:理论、算法和实践，Unsupervised Multi-Class Domain Adaptation: Theory, Algorithms, and Practice

专知会员服务

32+阅读 · 2020年2月26日

【O'Reilly TensorFlow Conference 2019】恶意软件检测（Generative malware outbreak detection），Sean Park | Trend Micro

【O'Reilly TensorFlow Conference 2019】恶意软件检测（Generative malware outbreak detection），Sean Park | Trend Micro

专知会员服务

15+阅读 · 2019年11月13日

浅析Faiss在推荐系统中的应用及原理

浅析Faiss在推荐系统中的应用及原理

凡人机器学习

11+阅读 · 2020年5月5日

推荐系统之矩阵分解家族

推荐系统之矩阵分解家族

图与推荐

13+阅读 · 2020年3月28日

TheFatRat 一款简易后门工具

TheFatRat 一款简易后门工具

黑白之道

36+阅读 · 2019年10月23日

【资源】领域自适应相关论文、代码分享

【资源】领域自适应相关论文、代码分享

专知

32+阅读 · 2019年10月12日

通过Termux打造免root安卓渗透工具

通过Termux打造免root安卓渗透工具

黑客技术与网络安全

16+阅读 · 2019年8月16日

小样本学习（Few-shot Learning）综述

小样本学习（Few-shot Learning）综述

云栖社区

22+阅读 · 2019年4月6日

Spooftooph - 用于欺骗或克隆蓝牙设备的自动工具

Spooftooph - 用于欺骗或克隆蓝牙设备的自动工具

黑白之道

17+阅读 · 2019年2月27日

React Native 分包哪家强？看这文就够了！

React Native 分包哪家强？看这文就够了！

程序人生

13+阅读 · 2019年1月16日

Github 项目推荐 | 农业知识图谱(KG)：农业领域的信息检索，命名实体识别

Github 项目推荐 | 农业知识图谱(KG)：农业领域的信息检索，命名实体识别

AI研习社

55+阅读 · 2018年4月9日

Kaggle 恶意评论(toxic comment classification)分类 top 1 %方案

Kaggle 恶意评论(toxic comment classification)分类 top 1 %方案

AI研习社

11+阅读 · 2018年4月1日

面向移动互联网流量的行为特征和自适应分类方法研究

国家自然科学基金

1+阅读 · 2015年12月31日

面向用户体验的无线异构软件定义网络资源管理研究

国家自然科学基金

2+阅读 · 2015年12月31日

面向应用商店的移动智能终端恶意软件检测关键技术研究

国家自然科学基金

1+阅读 · 2015年12月31日

基于海量软件片段比对的恶意代码检测方法研究

国家自然科学基金

2+阅读 · 2015年12月31日

多标记文本数据流分类方法研究

国家自然科学基金

3+阅读 · 2015年12月31日

基于软件定义无线网络的虚拟多径攻击检测与防御技术研究

国家自然科学基金

1+阅读 · 2015年12月31日

模糊认知集群优化的聚类算法

国家自然科学基金

9+阅读 · 2015年12月31日

基于自学习对比度视觉注意模型和自适应深度特征的无分类目标检测

国家自然科学基金

2+阅读 · 2015年12月31日

基于RFID异常事件检测和转移信用模型的热带农产品可视化智能防伪新方法及案例研究

国家自然科学基金

0+阅读 · 2014年12月31日

抗干扰的农作物种植模式自动提取方法

国家自然科学基金

0+阅读 · 2014年12月31日

Detecting and Explaining Malware Family Evolution Using Rule-Based Drift Analysis

Arxiv

0+阅读 · 2月3日

FOCA: Multimodal Malware Classification via Hyperbolic Cross-Attention

Arxiv

0+阅读 · 1月25日

FARM: Field-Aware Resolution Model for Intelligent Trigger-Action Automation

Arxiv

0+阅读 · 1月22日

On the Reliability and Stability of Selective Methods in Malware Classification Tasks

Arxiv

0+阅读 · 1月21日

SERM: Self-Evolving Relevance Model with Agent-Driven Learning from Massive Query Streams

Arxiv

0+阅读 · 1月14日

AgriAgent: Contract-Driven Planning and Capability-Aware Tool Orchestration in Real-World Agriculture

Arxiv

0+阅读 · 1月13日

FairRF: Multi-Objective Search for Single and Intersectional Software Fairness

Arxiv

0+阅读 · 1月12日

CHASE: LLM Agents for Dissecting Malicious PyPI Packages

Arxiv

0+阅读 · 1月11日

BIDO: An Out-Of-Distribution Resistant Image-based Malware Detector

Arxiv

0+阅读 · 1月8日

MeLeMaD: Adaptive Malware Detection via Chunk-wise Feature Selection and Meta-Learning

Arxiv

0+阅读 · 2025年12月30日

VIP会员

文章信息

相关主题

最新内容

《美陆军条例：陆军指挥政策（2026版）》

《美陆军条例：陆军指挥政策（2026版）》

专知会员服务

5+阅读 · 今天8:10

《提升美军全域城市作战训练最佳实践的案例研究》366页

《提升美军全域城市作战训练最佳实践的案例研究》366页

专知会员服务

6+阅读 · 今天8:06

《军用自主人工智能系统的治理与安全》

《军用自主人工智能系统的治理与安全》

专知会员服务

4+阅读 · 今天8:02

美海军数字作战负责人：如何利用数据快速生成战斗力

美海军数字作战负责人：如何利用数据快速生成战斗力

专知会员服务

3+阅读 · 今天7:32

《COOL模型（行动循环圈）：军事领导体系中的战役层级变革流程》

《COOL模型（行动循环圈）：军事领导体系中的战役层级变革流程》

专知会员服务

10+阅读 · 4月20日

《系统簇式多域作战规划范畴论框架》

《系统簇式多域作战规划范畴论框架》

专知会员服务

7+阅读 · 4月20日

《美国防部指令6130.03，第2卷服役医疗标准：保留》

《美国防部指令6130.03，第2卷服役医疗标准：保留》

专知会员服务

5+阅读 · 4月20日

《美国防部指令6130.03，第1卷服役医疗标准：任命、征募或征召》

《美国防部指令6130.03，第1卷服役医疗标准：任命、征募或征召》

专知会员服务

3+阅读 · 4月20日

美空军“战场机载通信节点（BACN）”：美以对伊空战行动中隐形却关键的一环

美空军“战场机载通信节点（BACN）”：美以对伊空战行动中隐形却关键的一环

专知会员服务

7+阅读 · 4月20日

【CMU博士论文】面向非结构化环境下医疗急救的具身人工智能

【CMU博士论文】面向非结构化环境下医疗急救的具身人工智能

专知会员服务

3+阅读 · 4月20日

高效视频扩散模型：进展与挑战

高效视频扩散模型：进展与挑战

专知会员服务

3+阅读 · 4月20日

乌克兰前线的五项创新

乌克兰前线的五项创新

专知会员服务

7+阅读 · 4月20日

军事通信系统与设备的技术演进综述

军事通信系统与设备的技术演进综述

专知会员服务

6+阅读 · 4月20日

《北约 AI手册：作战人员的实用考量》（2026最新64页）

《北约 AI手册：作战人员的实用考量》（2026最新64页）

专知会员服务

11+阅读 · 4月20日

《北约标准：医疗评估手册》174页

《北约标准：医疗评估手册》174页

专知会员服务

5+阅读 · 4月20日

相关VIP内容

《分布式机器人群体聚类：增加抵御恶意伪装攻击的能力》

《分布式机器人群体聚类：增加抵御恶意伪装攻击的能力》

专知会员服务

28+阅读 · 2023年11月6日

《H4rm0ny：用于规避恶意软件生成和检测的多智能体学习的竞争性两人零和马尔可夫博弈》2022最新12页论文，加拿大国防研究与发展部

《H4rm0ny：用于规避恶意软件生成和检测的多智能体学习的竞争性两人零和马尔可夫博弈》2022最新12页论文，加拿大国防研究与发展部

专知会员服务

26+阅读 · 2022年10月26日

NTU最新《广义分布外OOD检测》综述论文，20页pdf阐述离群/异常/新类/开集/分布外检测的异同

NTU最新《广义分布外OOD检测》综述论文，20页pdf阐述离群/异常/新类/开集/分布外检测的异同

专知会员服务

29+阅读 · 2021年10月26日

复旦大学邱锡鹏等《自然语言处理范式迁移综述》论文，详述7大NLP范式：分类、匹配、SeqLab, MRC, Seq2Seq等

专知会员服务

54+阅读 · 2021年9月29日

【KDD2021】知识增强领域自适应的少样本关系分类

专知会员服务

38+阅读 · 2021年9月15日

恶意文档检测研究综述

专知会员服务

19+阅读 · 2021年6月10日

【Mila】通用表示Transformer少样本图像分类

【Mila】通用表示Transformer少样本图像分类

专知会员服务

33+阅读 · 2020年9月7日

【华南理工大学】无监督多类域自适应:理论、算法和实践，Unsupervised Multi-Class DA

专知会员服务

28+阅读 · 2020年3月2日

【华南理工大学】无监督多类域自适应:理论、算法和实践，Unsupervised Multi-Class Domain Adaptation: Theory, Algorithms, and Practice

【华南理工大学】无监督多类域自适应:理论、算法和实践，Unsupervised Multi-Class Domain Adaptation: Theory, Algorithms, and Practice

专知会员服务

32+阅读 · 2020年2月26日

【O'Reilly TensorFlow Conference 2019】恶意软件检测（Generative malware outbreak detection），Sean Park | Trend Micro

【O'Reilly TensorFlow Conference 2019】恶意软件检测（Generative malware outbreak detection），Sean Park | Trend Micro

专知会员服务

15+阅读 · 2019年11月13日

热门VIP内容

开通专知VIP会员享更多权益服务

《提升美军全域城市作战训练最佳实践的案例研究》366页

美海军数字作战负责人：如何利用数据快速生成战斗力

《美陆军条例：陆军指挥政策（2026版）》

《军用自主人工智能系统的治理与安全》

相关资讯

浅析Faiss在推荐系统中的应用及原理

浅析Faiss在推荐系统中的应用及原理

凡人机器学习

11+阅读 · 2020年5月5日

推荐系统之矩阵分解家族

推荐系统之矩阵分解家族

图与推荐

13+阅读 · 2020年3月28日

TheFatRat 一款简易后门工具

TheFatRat 一款简易后门工具

黑白之道

36+阅读 · 2019年10月23日

【资源】领域自适应相关论文、代码分享

【资源】领域自适应相关论文、代码分享

专知

32+阅读 · 2019年10月12日

通过Termux打造免root安卓渗透工具

通过Termux打造免root安卓渗透工具

黑客技术与网络安全

16+阅读 · 2019年8月16日

小样本学习（Few-shot Learning）综述

小样本学习（Few-shot Learning）综述

云栖社区

22+阅读 · 2019年4月6日

Spooftooph - 用于欺骗或克隆蓝牙设备的自动工具

Spooftooph - 用于欺骗或克隆蓝牙设备的自动工具

黑白之道

17+阅读 · 2019年2月27日

React Native 分包哪家强？看这文就够了！

React Native 分包哪家强？看这文就够了！

程序人生

13+阅读 · 2019年1月16日

Github 项目推荐 | 农业知识图谱(KG)：农业领域的信息检索，命名实体识别

Github 项目推荐 | 农业知识图谱(KG)：农业领域的信息检索，命名实体识别

AI研习社

55+阅读 · 2018年4月9日

Kaggle 恶意评论(toxic comment classification)分类 top 1 %方案

Kaggle 恶意评论(toxic comment classification)分类 top 1 %方案

AI研习社

11+阅读 · 2018年4月1日

相关论文

Detecting and Explaining Malware Family Evolution Using Rule-Based Drift Analysis

Arxiv

0+阅读 · 2月3日

FOCA: Multimodal Malware Classification via Hyperbolic Cross-Attention

Arxiv

0+阅读 · 1月25日

FARM: Field-Aware Resolution Model for Intelligent Trigger-Action Automation

Arxiv

0+阅读 · 1月22日

On the Reliability and Stability of Selective Methods in Malware Classification Tasks

Arxiv

0+阅读 · 1月21日

SERM: Self-Evolving Relevance Model with Agent-Driven Learning from Massive Query Streams

Arxiv

0+阅读 · 1月14日

AgriAgent: Contract-Driven Planning and Capability-Aware Tool Orchestration in Real-World Agriculture

Arxiv

0+阅读 · 1月13日

FairRF: Multi-Objective Search for Single and Intersectional Software Fairness

Arxiv

0+阅读 · 1月12日

CHASE: LLM Agents for Dissecting Malicious PyPI Packages

Arxiv

0+阅读 · 1月11日

BIDO: An Out-Of-Distribution Resistant Image-based Malware Detector

Arxiv

0+阅读 · 1月8日

MeLeMaD: Adaptive Malware Detection via Chunk-wise Feature Selection and Meta-Learning

Arxiv

0+阅读 · 2025年12月30日

相关基金

面向移动互联网流量的行为特征和自适应分类方法研究

国家自然科学基金

1+阅读 · 2015年12月31日

面向用户体验的无线异构软件定义网络资源管理研究

国家自然科学基金

2+阅读 · 2015年12月31日

面向应用商店的移动智能终端恶意软件检测关键技术研究

国家自然科学基金

1+阅读 · 2015年12月31日

基于海量软件片段比对的恶意代码检测方法研究

国家自然科学基金

2+阅读 · 2015年12月31日

多标记文本数据流分类方法研究

国家自然科学基金

3+阅读 · 2015年12月31日

基于软件定义无线网络的虚拟多径攻击检测与防御技术研究

国家自然科学基金

1+阅读 · 2015年12月31日

模糊认知集群优化的聚类算法

国家自然科学基金

9+阅读 · 2015年12月31日

基于自学习对比度视觉注意模型和自适应深度特征的无分类目标检测

国家自然科学基金

2+阅读 · 2015年12月31日

基于RFID异常事件检测和转移信用模型的热带农产品可视化智能防伪新方法及案例研究

国家自然科学基金

0+阅读 · 2014年12月31日

抗干扰的农作物种植模式自动提取方法

国家自然科学基金

0+阅读 · 2014年12月31日

微信扫码咨询专知VIP会员