EEG-FM-Bench: A Comprehensive Benchmark for the Systematic Evaluation of EEG Foundation Models - 专知论文

会员服务 ·

0

FM · 基准 · 分析 · 系统 · 脑电 ·

EEG-FM-Bench: A Comprehensive Benchmark for the Systematic Evaluation of EEG Foundation Models

翻译：EEG-FM-Bench：用于系统评估脑电图基础模型的综合基准

Wei Xiong,Jiangtong Li,Jie Li,Kun Zhu,Changjun Jiang

from arxiv, 35 pages, 40 figures

Electroencephalography foundation models (EEG-FMs) have advanced brain signal analysis, but the lack of standardized evaluation benchmarks impedes model comparison and scientific progress. Current evaluations rely on inconsistent protocols that render cross-model comparisons unreliable, while a lack of diagnostic analyses obscures the internal mechanisms driving transfer efficiency and scaling behaviors. To address this, we introduce \textbf{EEG-FM-Bench}, a unified system for the standardized evaluation of EEG-FMs. The benchmark integrates 14 datasets across 10 paradigms and incorporates diverse experimental settings, including multiple fine-tuning strategies, task organizations, and classifier configurations, supported by tools for gradient and representation analysis. Our experiments and analysis reveal several critical insights: (1) multi-task learning acts as a critical regularizer to mitigate overfitting in data-scarce EEG contexts; (2) pre-training efficiency is currently limited by gradient conflicts between reconstruction objectives and downstream tasks; (3) model scaling deviates from typical laws, as compact architectures with domain-specific inductive biases consistently outperform significantly larger models. This benchmark enables fair comparison and reproducible analysis, shifting the field from fragmented results to interpretable advances. Code is available at https://github.com/xw1216/EEG-FM-Bench.

翻译：脑电图基础模型（EEG-FMs）推动了脑信号分析的发展，但缺乏标准化的评估基准阻碍了模型比较与科学进展。当前的评估依赖于不一致的协议，导致跨模型比较不可靠，同时诊断分析的缺失也掩盖了驱动迁移效率与缩放行为的内部机制。为解决此问题，我们引入了 \textbf{EEG-FM-Bench}，一个用于标准化评估 EEG-FMs 的统一系统。该基准整合了涵盖 10 种范式的 14 个数据集，并纳入了多样化的实验设置，包括多种微调策略、任务组织方式和分类器配置，并辅以梯度和表征分析工具支持。我们的实验与分析揭示了若干关键发现：（1）多任务学习作为一种关键的正则化器，可缓解数据稀缺的 EEG 场景中的过拟合；（2）当前预训练效率受限于重构目标与下游任务之间的梯度冲突；（3）模型缩放行为偏离典型规律，具有领域特定归纳偏置的紧凑架构持续显著优于大得多的模型。此基准支持公平比较与可复现分析，推动该领域从零散的结果转向可解释的进展。代码发布于 https://github.com/xw1216/EEG-FM-Bench。

0

相关内容

FM 2019是正式方法欧洲（FME）组织的系列国际研讨会中的第23次，该协会是一个独立的协会，旨在促进软件开发正式方法的使用和研究。官网链接：http://formalmethods2019.inesctec.pt/?page_id=565

图基础模型中的分布外（Out-of-Distribution）泛化研究

图基础模型中的分布外（Out-of-Distribution）泛化研究

专知会员服务

12+阅读 · 1月31日

【CMU博士论文】利用信息论工具进行基础模型分析

【CMU博士论文】利用信息论工具进行基础模型分析

专知会员服务

19+阅读 · 2025年8月31日

大语言模型基准综述

大语言模型基准综述

专知会员服务

27+阅读 · 2025年8月22日

基于 Transformer 的脑电解码综述询问 ChatGPT

基于 Transformer 的脑电解码综述询问 ChatGPT

专知会员服务

12+阅读 · 2025年7月6日

大模型与医疗如何结合？上交大等最新《计算医疗健康中的以数据为中心的基础模型》综述

大模型与医疗如何结合？上交大等最新《计算医疗健康中的以数据为中心的基础模型》综述

专知会员服务

70+阅读 · 2024年1月8日

GNN如何可解释？悉尼科大最新《可解释图神经网络研究》综述，全面阐述可解释GNN的方法与评价指标

GNN如何可解释？悉尼科大最新《可解释图神经网络研究》综述，全面阐述可解释GNN的方法与评价指标

专知会员服务

112+阅读 · 2022年7月28日

100页！IEEE标准协会《脑机接口神经技术标准路线图》

100页！IEEE标准协会《脑机接口神经技术标准路线图》

专知会员服务

35+阅读 · 2022年2月13日

到底什么是GNN？《图神经网络理论基础》这份DeepMind大牛Petar讲授，附96页ppt与视频

到底什么是GNN？《图神经网络理论基础》这份DeepMind大牛Petar讲授，附96页ppt与视频

专知会员服务

87+阅读 · 2021年2月26日

【KDD2020】通过对比子图对大脑网络的可解释分类，Explainable Classification of Brain Networks via Contrast Subgraphs

【KDD2020】通过对比子图对大脑网络的可解释分类，Explainable Classification of Brain Networks via Contrast Subgraphs

专知会员服务

21+阅读 · 2020年6月11日

【IJCAI 2019 Tutorials】基于概率图模型的医疗决策分析（Medical decision analysis with probabilistic graphical models）

【IJCAI 2019 Tutorials】基于概率图模型的医疗决策分析（Medical decision analysis with probabilistic graphical models）

专知会员服务

46+阅读 · 2019年8月10日

【加州理工】什么是模仿学习(Imitation Learning（模仿学习), 这62页ppt带你了解进展，附下载

【加州理工】什么是模仿学习(Imitation Learning（模仿学习), 这62页ppt带你了解进展，附下载

专知

21+阅读 · 2019年11月14日

图神经网络GNN最新理论进展和应用探索，附报告下载

图神经网络GNN最新理论进展和应用探索，附报告下载

专知

70+阅读 · 2019年8月25日

超越标准 GNN ！DeepMind、谷歌提出图匹配网络| ICML最新论文

超越标准 GNN ！DeepMind、谷歌提出图匹配网络| ICML最新论文

新智元

20+阅读 · 2019年5月6日

神经网络图的简介（基本概念，DeepWalk以及GraphSage算法）

神经网络图的简介（基本概念，DeepWalk以及GraphSage算法）

AI研习社

12+阅读 · 2019年3月5日

掌握图神经网络GNN基本，看这篇文章就够了

掌握图神经网络GNN基本，看这篇文章就够了

新智元

164+阅读 · 2019年2月14日

DeepMind无监督表示学习重大突破：语音、图像、文本、强化学习全能冠军！

DeepMind无监督表示学习重大突破：语音、图像、文本、强化学习全能冠军！

新智元

12+阅读 · 2018年7月13日

【机器学习基本理论】详解最大似然估计（MLE）、最大后验概率估计（MAP），以及贝叶斯公式的理解

【机器学习基本理论】详解最大似然估计（MLE）、最大后验概率估计（MAP），以及贝叶斯公式的理解

机器学习研究会

19+阅读 · 2018年3月11日

代码+实战：TensorFlow Estimator of Deep CTR —— DeepFM/NFM/AFM/FNN/PNN

代码+实战：TensorFlow Estimator of Deep CTR —— DeepFM/NFM/AFM/FNN/PNN

AI研习社

14+阅读 · 2018年2月17日

【AAAI专题】论文分享：以生物可塑性为核心的类脑脉冲神经网络

【AAAI专题】论文分享：以生物可塑性为核心的类脑脉冲神经网络

中国科学院自动化研究所

15+阅读 · 2018年1月23日

自然语言处理中的Attention Model：是什么及为什么

自然语言处理中的Attention Model：是什么及为什么

新智元

11+阅读 · 2017年7月13日

基于同步EEG-fMRI多模态神经影像融合的谎言神经机制研究

国家自然科学基金

0+阅读 · 2017年12月31日

脑电信号中肌电噪声去除的新探索

国家自然科学基金

1+阅读 · 2015年12月31日

用于痫样脑电在线检测的gm-C小波滤波器实现理论与方法研究

国家自然科学基金

0+阅读 · 2015年12月31日

功能磁共振成像无监督模式分析方法及应用

国家自然科学基金

3+阅读 · 2015年12月31日

大脑地形连接组图的张量研究

国家自然科学基金

0+阅读 · 2015年12月31日

用于癫痫发作预测的脑电特征深度学习研究

国家自然科学基金

3+阅读 · 2015年12月31日

基于脑电网络分析的脑卒中患者言语认知康复评估方法研究

国家自然科学基金

1+阅读 · 2015年12月31日

阈下情绪启动影响正常人及分裂型特质个体情绪判断的神经机制

国家自然科学基金

0+阅读 · 2015年12月31日

新型统计模型在精神疾病的基因、脑影像和行为数据整合中的应用

国家自然科学基金

0+阅读 · 2014年12月31日

大脑影像标准化的优化模型与算法研究

国家自然科学基金

0+阅读 · 2014年12月31日

SpecMoE: Spectral Mixture-of-Experts Foundation Model for Cross-Species EEG Decoding

Arxiv

0+阅读 · 3月17日

Balancing Interpretability and Performance in Motor Imagery EEG Classification: A Comparative Study of ANFIS-FBCSP-PSO and EEGNet

Arxiv

0+阅读 · 3月9日

Hierarchic-EEG2Text: Assessing EEG-To-Text Decoding across Hierarchical Abstraction Levels

Arxiv

0+阅读 · 2月24日

Diffusion-Guided Pretraining for Brain Graph Foundation Models

Arxiv

0+阅读 · 2月19日

EEG2GAIT: A Hierarchical Graph Convolutional Network for EEG-based Gait Decoding

Arxiv

0+阅读 · 2月12日

ADRD-Bench: A Preliminary LLM Benchmark for Alzheimer's Disease and Related Dementias

Arxiv

0+阅读 · 2月12日

NeuroRVQ: Multi-Scale EEG Tokenization for Generative Large Brainwave Models

Arxiv

0+阅读 · 2月10日

EEG Foundation Models: Progresses, Benchmarking, and Open Problems

Arxiv

0+阅读 · 2月5日

LEAD: An EEG Foundation Model for Alzheimer's Disease Detection

Arxiv

0+阅读 · 2月1日

Inter- and Intra-Subject Variability in EEG: A Systematic Survey

Arxiv

0+阅读 · 2月1日

VIP会员

文章信息

相关主题

最新内容

ICML 2026 | 演化选择的因果建模

ICML 2026 | 演化选择的因果建模

专知会员服务

0+阅读 · 今天15:45

综述｜学习式3D表征最新进展与趋势

综述｜学习式3D表征最新进展与趋势

专知会员服务

1+阅读 · 今天15:37

《武器作战效能分析：基于虚拟构造仿真大数据与深度学习的初步见解》

《武器作战效能分析：基于虚拟构造仿真大数据与深度学习的初步见解》

专知会员服务

4+阅读 · 今天14:53

《自主巡飞弹药系统量子逻辑框架：一种基于不确定模糊集的方法》

《自主巡飞弹药系统量子逻辑框架：一种基于不确定模糊集的方法》

专知会员服务

3+阅读 · 今天14:47

人工智能重塑威慑：算法优势的兴起

人工智能重塑威慑：算法优势的兴起

专知会员服务

3+阅读 · 今天14:27

【博士论文】基于物理结构与贝叶斯不确定性的可靠神经网络

【博士论文】基于物理结构与贝叶斯不确定性的可靠神经网络

专知会员服务

10+阅读 · 6月4日

AgentOps综述：智能体系统运维框架

AgentOps综述：智能体系统运维框架

专知会员服务

14+阅读 · 6月4日

《美陆军最新条令：兵力防护》

《美陆军最新条令：兵力防护》

专知会员服务

9+阅读 · 6月4日

《军用物联网：架构、应用、挑战与现代战争中的战略意义》

《军用物联网：架构、应用、挑战与现代战争中的战略意义》

专知会员服务

8+阅读 · 6月4日

《人工智能的挑战：算法战的想象与现实》

《人工智能的挑战：算法战的想象与现实》

专知会员服务

11+阅读 · 6月4日

《自适应智能：融合数字孪生精准性与人工智能预见力，实现实时决策》

《自适应智能：融合数字孪生精准性与人工智能预见力，实现实时决策》

专知会员服务

13+阅读 · 6月4日

首场人工智能战争：Maven如何重塑武装冲突

首场人工智能战争：Maven如何重塑武装冲突

专知会员服务

7+阅读 · 6月4日

【博士论文】抽象信息论与安全奖励学习的数学发展

【博士论文】抽象信息论与安全奖励学习的数学发展

专知会员服务

9+阅读 · 6月3日

综述 | 机器人操作世界模型：预测、行动接口与学习生命周期

综述 | 机器人操作世界模型：预测、行动接口与学习生命周期

专知会员服务

6+阅读 · 6月3日

《推进军事决策支持：运用强化学习驱动仿真的稳健作战计划验证》

《推进军事决策支持：运用强化学习驱动仿真的稳健作战计划验证》

专知会员服务

13+阅读 · 6月3日

相关VIP内容

图基础模型中的分布外（Out-of-Distribution）泛化研究

图基础模型中的分布外（Out-of-Distribution）泛化研究

专知会员服务

12+阅读 · 1月31日

【CMU博士论文】利用信息论工具进行基础模型分析

【CMU博士论文】利用信息论工具进行基础模型分析

专知会员服务

19+阅读 · 2025年8月31日

大语言模型基准综述

大语言模型基准综述

专知会员服务

27+阅读 · 2025年8月22日

基于 Transformer 的脑电解码综述询问 ChatGPT

基于 Transformer 的脑电解码综述询问 ChatGPT

专知会员服务

12+阅读 · 2025年7月6日

大模型与医疗如何结合？上交大等最新《计算医疗健康中的以数据为中心的基础模型》综述

大模型与医疗如何结合？上交大等最新《计算医疗健康中的以数据为中心的基础模型》综述

专知会员服务

70+阅读 · 2024年1月8日

GNN如何可解释？悉尼科大最新《可解释图神经网络研究》综述，全面阐述可解释GNN的方法与评价指标

GNN如何可解释？悉尼科大最新《可解释图神经网络研究》综述，全面阐述可解释GNN的方法与评价指标

专知会员服务

112+阅读 · 2022年7月28日

100页！IEEE标准协会《脑机接口神经技术标准路线图》

100页！IEEE标准协会《脑机接口神经技术标准路线图》

专知会员服务

35+阅读 · 2022年2月13日

到底什么是GNN？《图神经网络理论基础》这份DeepMind大牛Petar讲授，附96页ppt与视频

到底什么是GNN？《图神经网络理论基础》这份DeepMind大牛Petar讲授，附96页ppt与视频

专知会员服务

87+阅读 · 2021年2月26日

【KDD2020】通过对比子图对大脑网络的可解释分类，Explainable Classification of Brain Networks via Contrast Subgraphs

【KDD2020】通过对比子图对大脑网络的可解释分类，Explainable Classification of Brain Networks via Contrast Subgraphs

专知会员服务

21+阅读 · 2020年6月11日

【IJCAI 2019 Tutorials】基于概率图模型的医疗决策分析（Medical decision analysis with probabilistic graphical models）

【IJCAI 2019 Tutorials】基于概率图模型的医疗决策分析（Medical decision analysis with probabilistic graphical models）

专知会员服务

46+阅读 · 2019年8月10日

热门VIP内容

开通专知VIP会员享更多权益服务

综述｜学习式3D表征最新进展与趋势

《自主巡飞弹药系统量子逻辑框架：一种基于不确定模糊集的方法》

ICML 2026 | 演化选择的因果建模

《武器作战效能分析：基于虚拟构造仿真大数据与深度学习的初步见解》

相关资讯

【加州理工】什么是模仿学习(Imitation Learning（模仿学习), 这62页ppt带你了解进展，附下载

【加州理工】什么是模仿学习(Imitation Learning（模仿学习), 这62页ppt带你了解进展，附下载

专知

21+阅读 · 2019年11月14日

图神经网络GNN最新理论进展和应用探索，附报告下载

图神经网络GNN最新理论进展和应用探索，附报告下载

专知

70+阅读 · 2019年8月25日

超越标准 GNN ！DeepMind、谷歌提出图匹配网络| ICML最新论文

超越标准 GNN ！DeepMind、谷歌提出图匹配网络| ICML最新论文

新智元

20+阅读 · 2019年5月6日

神经网络图的简介（基本概念，DeepWalk以及GraphSage算法）

神经网络图的简介（基本概念，DeepWalk以及GraphSage算法）

AI研习社

12+阅读 · 2019年3月5日

掌握图神经网络GNN基本，看这篇文章就够了

掌握图神经网络GNN基本，看这篇文章就够了

新智元

164+阅读 · 2019年2月14日

DeepMind无监督表示学习重大突破：语音、图像、文本、强化学习全能冠军！

DeepMind无监督表示学习重大突破：语音、图像、文本、强化学习全能冠军！

新智元

12+阅读 · 2018年7月13日

【机器学习基本理论】详解最大似然估计（MLE）、最大后验概率估计（MAP），以及贝叶斯公式的理解

【机器学习基本理论】详解最大似然估计（MLE）、最大后验概率估计（MAP），以及贝叶斯公式的理解

机器学习研究会

19+阅读 · 2018年3月11日

代码+实战：TensorFlow Estimator of Deep CTR —— DeepFM/NFM/AFM/FNN/PNN

代码+实战：TensorFlow Estimator of Deep CTR —— DeepFM/NFM/AFM/FNN/PNN

AI研习社

14+阅读 · 2018年2月17日

【AAAI专题】论文分享：以生物可塑性为核心的类脑脉冲神经网络

【AAAI专题】论文分享：以生物可塑性为核心的类脑脉冲神经网络

中国科学院自动化研究所

15+阅读 · 2018年1月23日

自然语言处理中的Attention Model：是什么及为什么

自然语言处理中的Attention Model：是什么及为什么

新智元

11+阅读 · 2017年7月13日

相关论文

SpecMoE: Spectral Mixture-of-Experts Foundation Model for Cross-Species EEG Decoding

Arxiv

0+阅读 · 3月17日

Balancing Interpretability and Performance in Motor Imagery EEG Classification: A Comparative Study of ANFIS-FBCSP-PSO and EEGNet

Arxiv

0+阅读 · 3月9日

Hierarchic-EEG2Text: Assessing EEG-To-Text Decoding across Hierarchical Abstraction Levels

Arxiv

0+阅读 · 2月24日

Diffusion-Guided Pretraining for Brain Graph Foundation Models

Arxiv

0+阅读 · 2月19日

EEG2GAIT: A Hierarchical Graph Convolutional Network for EEG-based Gait Decoding

Arxiv

0+阅读 · 2月12日

ADRD-Bench: A Preliminary LLM Benchmark for Alzheimer's Disease and Related Dementias

Arxiv

0+阅读 · 2月12日

NeuroRVQ: Multi-Scale EEG Tokenization for Generative Large Brainwave Models

Arxiv

0+阅读 · 2月10日

EEG Foundation Models: Progresses, Benchmarking, and Open Problems

Arxiv

0+阅读 · 2月5日

LEAD: An EEG Foundation Model for Alzheimer's Disease Detection

Arxiv

0+阅读 · 2月1日

Inter- and Intra-Subject Variability in EEG: A Systematic Survey

Arxiv

0+阅读 · 2月1日

相关基金

基于同步EEG-fMRI多模态神经影像融合的谎言神经机制研究

国家自然科学基金

0+阅读 · 2017年12月31日

脑电信号中肌电噪声去除的新探索

国家自然科学基金

1+阅读 · 2015年12月31日

用于痫样脑电在线检测的gm-C小波滤波器实现理论与方法研究

国家自然科学基金

0+阅读 · 2015年12月31日

功能磁共振成像无监督模式分析方法及应用

国家自然科学基金

3+阅读 · 2015年12月31日

大脑地形连接组图的张量研究

国家自然科学基金

0+阅读 · 2015年12月31日

用于癫痫发作预测的脑电特征深度学习研究

国家自然科学基金

3+阅读 · 2015年12月31日

基于脑电网络分析的脑卒中患者言语认知康复评估方法研究

国家自然科学基金

1+阅读 · 2015年12月31日

阈下情绪启动影响正常人及分裂型特质个体情绪判断的神经机制

国家自然科学基金

0+阅读 · 2015年12月31日

新型统计模型在精神疾病的基因、脑影像和行为数据整合中的应用

国家自然科学基金

0+阅读 · 2014年12月31日

大脑影像标准化的优化模型与算法研究

国家自然科学基金

0+阅读 · 2014年12月31日

微信扫码咨询专知VIP会员