Position: Evaluation of ECG Representations Must Be Fixed - 专知论文

会员服务 ·

0

心电 · 数据集 · 基准 · 结构 · 结构性 ·

Position: Evaluation of ECG Representations Must Be Fixed

翻译：立场：心电图表征评估方法亟待修正

Zachary Berger,Daniel Prakah-Asante,John Guttag,Collin M. Stultz

from arxiv, Project website at https://ecgfix.csail.mit.edu/

This position paper argues that current benchmarking practice in 12-lead ECG representation learning must be fixed to ensure progress is reliable and aligned with clinically meaningful objectives. The field has largely converged on three public multi-label benchmarks (PTB-XL, CPSC2018, CSN) dominated by arrhythmia and waveform-morphology labels, even though the ECG is known to encode substantially broader clinical information. We argue that downstream evaluation should expand to include an assessment of structural heart disease and patient-level forecasting, in addition to other evolving ECG-related endpoints, as relevant clinical targets. Next, we outline evaluation best practices for multi-label, imbalanced settings, and show that when they are applied, the literature's current conclusion about which representations perform best is altered. Furthermore, we demonstrate the surprising result that a randomly initialized encoder with linear evaluation matches state-of-the-art pre-training on many tasks. This motivates the use of a random encoder as a reasonable baseline model. We substantiate our observations with an empirical evaluation of three representative ECG pre-training approaches across six evaluation settings: the three standard benchmarks, a structural disease dataset, hemodynamic inference, and patient forecasting.

翻译：本立场论文指出，当前12导联心电图表征学习的基准测试实践必须修正，以确保研究进展的可靠性并与临床意义目标保持一致。该领域目前主要集中于三个公开多标签基准数据集（PTB-XL、CPSC2018、CSN），这些数据集以心律失常和波形形态标签为主导，尽管已知心电图编码的临床信息范围远不止于此。我们认为，下游评估应扩展到包含结构性心脏病评估和患者层面预测，以及其他不断发展的心电图相关终点指标，作为相关的临床目标。接着，我们概述了多标签不平衡场景下的评估最佳实践，并证明当应用这些实践时，文献中关于何种表征性能最佳的现有结论会发生改变。此外，我们展示了一个令人惊讶的结果：随机初始化的编码器配合线性评估，在许多任务上可匹配最先进的预训练方法。这促使我们将随机编码器作为合理的基线模型。我们通过对三种代表性心电图预训练方法在六种评估场景下的实证评估来证实这些观察：三个标准基准数据集、一个结构性心脏病数据集、血流动力学推理以及患者预测。

0

相关内容

从监督微调SFT到强化微调RFT，逐渐补齐推理模型的技术拼图

从监督微调SFT到强化微调RFT，逐渐补齐推理模型的技术拼图

专知会员服务

28+阅读 · 2024年12月7日

适配还是提示？微软最新《通用大模型是否超过专业领域微调大模型》论文，GPT-4多种策略提示超越医学大模型

适配还是提示？微软最新《通用大模型是否超过专业领域微调大模型》论文，GPT-4多种策略提示超越医学大模型

专知会员服务

59+阅读 · 2023年12月3日

遥感目标检测进展如何？西电等最新《深度学习遥感目标检测》综述，涵盖300多篇文献详述五大类型技术

遥感目标检测进展如何？西电等最新《深度学习遥感目标检测》综述，涵盖300多篇文献详述五大类型技术

专知会员服务

55+阅读 · 2023年9月15日

弹药异常检测《使用机器学习进行缺陷表征》最佳论文，MODSIM World 2023

弹药异常检测《使用机器学习进行缺陷表征》最佳论文，MODSIM World 2023

专知会员服务

37+阅读 · 2023年7月22日

北大获奖，清华、人大等提名，ICLR 2023杰出论文奖出炉

北大获奖，清华、人大等提名，ICLR 2023杰出论文奖出炉

专知会员服务

20+阅读 · 2023年3月24日

AAAI 2022 | 在图像级弱监督语义分割这项CV难题上，字节跳动做到了性能显著提升

AAAI 2022 | 在图像级弱监督语义分割这项CV难题上，字节跳动做到了性能显著提升

专知会员服务

19+阅读 · 2022年1月7日

基于图的异常检测，94页ppt

专知会员服务

78+阅读 · 2021年9月27日

【论文推荐】不同图像域弱监督语义分割的综合分析，A Comprehensive Analysis of Weakly-Supervised Semantic Segmentation in Different Image Domains

【论文推荐】不同图像域弱监督语义分割的综合分析，A Comprehensive Analysis of Weakly-Supervised Semantic Segmentation in Different Image Domains

专知会员服务

28+阅读 · 2019年12月27日

基于图的word2vec负采样( GNEG:Graph-Based Negative Sampling for word2vec)

基于图的word2vec负采样( GNEG:Graph-Based Negative Sampling for word2vec)

专知会员服务

40+阅读 · 2019年11月23日

Aspect-Oriented Syntax Network for Aspect-Based Sentiment Analysis，中山大学数据科学与计算机学院权小军教授，第八届全国社会媒体处理大会SMP2019

Aspect-Oriented Syntax Network for Aspect-Based Sentiment Analysis，中山大学数据科学与计算机学院权小军教授，第八届全国社会媒体处理大会SMP2019

专知会员服务

19+阅读 · 2019年10月22日

做目标检测，这6篇就够了：CVPR 2020目标检测论文盘点

做目标检测，这6篇就够了：CVPR 2020目标检测论文盘点

机器之心

23+阅读 · 2020年7月27日

预训练语言模型关系图+必读论文列表，清华荣誉出品

预训练语言模型关系图+必读论文列表，清华荣誉出品

机器之心

18+阅读 · 2019年10月11日

最新必读【预训练语言模型(BERT/XLNet等)】论文，Google/微软/华为ICLR2020提交论文

最新必读【预训练语言模型(BERT/XLNet等)】论文，Google/微软/华为ICLR2020提交论文

专知

36+阅读 · 2019年9月29日

《知识图谱标准化白皮书》发布，200页pdf，中国电子技术标准化研究院主编

《知识图谱标准化白皮书》发布，200页pdf，中国电子技术标准化研究院主编

专知

53+阅读 · 2019年9月16日

西北工业大学发布最新遥感图像目标检测综述论文和Benchmark，带你全面了解遥感图像检测方法

西北工业大学发布最新遥感图像目标检测综述论文和Benchmark，带你全面了解遥感图像检测方法

专知

23+阅读 · 2019年9月5日

从锚点到关键点，最新的目标检测方法发展趋势

从锚点到关键点，最新的目标检测方法发展趋势

计算机视觉life

17+阅读 · 2019年8月20日

最新最权威《深度学习显著目标检测综述》论文代码数据发布，带你全面了解显著目标检测方法

最新最权威《深度学习显著目标检测综述》论文代码数据发布，带你全面了解显著目标检测方法

专知

79+阅读 · 2019年4月24日

数据标注术语和规范国家标准出炉,你的写法符合规范么?

数据标注术语和规范国家标准出炉,你的写法符合规范么?

专知

17+阅读 · 2019年3月21日

放弃 RNN/LSTM 吧，因为真的不好用！望周知~

放弃 RNN/LSTM 吧，因为真的不好用！望周知~

人工智能头条

19+阅读 · 2018年4月24日

【论文推荐】最新5篇目标检测相关论文——显著目标检测、弱监督One-Shot检测、多框检测器、携带物体检测、假彩色图像检测

【论文推荐】最新5篇目标检测相关论文——显著目标检测、弱监督One-Shot检测、多框检测器、携带物体检测、假彩色图像检测

专知

74+阅读 · 2018年1月16日

冠状动脉粥样硬化进展预测创新技术研究

国家自然科学基金

0+阅读 · 2015年12月31日

基于范数熵的冠状动脉狭窄心音研究

国家自然科学基金

0+阅读 · 2015年12月31日

补体C3a在心肌梗死后心脏重塑中的作用机制研究

国家自然科学基金

0+阅读 · 2015年12月31日

基于生存树的急性心肌梗死早期预警及其多生理参数建模

国家自然科学基金

0+阅读 · 2015年12月31日

可与MPSoC高度融合的片上自主测试-自主修复关键技术研究：针对自然、人为可靠性威胁

国家自然科学基金

0+阅读 · 2015年12月31日

MR成像检测动脉粥样硬化及心肌缺血梗死组织中Tenascin-C蛋白表达的实验研究

国家自然科学基金

0+阅读 · 2014年12月31日

人类左心室3D重构及相关流固耦问题的数值方法研究

国家自然科学基金

0+阅读 · 2014年12月31日

GDF1及GDF3介导的Nodal信号通路相关基因的突变与非综合征型先天性心脏病的相关性研究

国家自然科学基金

0+阅读 · 2014年12月31日

心肌β１肾上腺素受体表达异质性及其影响血压的机制研究

国家自然科学基金

0+阅读 · 2014年12月31日

RR间期和QT间期动力学特性联合分析用于心脏自主神经状态评估的研究

国家自然科学基金

0+阅读 · 2014年12月31日

SignalMC-MED: A Multimodal Benchmark for Evaluating Biosignal Foundation Models on Single-Lead ECG and PPG

Arxiv

0+阅读 · 3月10日

Learning Clinical Representations Under Systematic Distribution Shift

Arxiv

0+阅读 · 3月7日

When correcting for regression to the mean is worse than no correction at all

Arxiv

0+阅读 · 2月28日

Don't stop me now: Rethinking Validation Criteria for Model Parameter Selection

Arxiv

0+阅读 · 2月25日

CG-DMER: Hybrid Contrastive-Generative Framework for Disentangled Multimodal ECG Representation Learning

Arxiv

0+阅读 · 2月24日

Position: General Alignment Has Hit a Ceiling; Edge Alignment Must Be Taken Seriously

Arxiv

0+阅读 · 2月23日

Fine-tuning an ECG Foundation Model to Predict Coronary CT Angiography Outcomes

Arxiv

0+阅读 · 2月8日

PTB-XL-Image-17K: A Large-Scale Synthetic ECG Image Dataset with Comprehensive Ground Truth for Deep Learning-Based Digitization

Arxiv

0+阅读 · 2月7日

Verification and Identification in ECG biometric on large-scale

Arxiv

0+阅读 · 2月4日

ECG-R1: Protocol-Guided and Modality-Agnostic MLLM for Reliable ECG Interpretation

Arxiv

0+阅读 · 2月4日

VIP会员

文章信息

相关主题

最新内容

ICML 2026 教程 | 数值优化理论还重要吗？

ICML 2026 教程 | 数值优化理论还重要吗？

专知会员服务

2+阅读 · 今天11:09

ICM 2026 | 陶哲轩：人工智能时代的数学

ICM 2026 | 陶哲轩：人工智能时代的数学

专知会员服务

1+阅读 · 今天11:05

《面向可扩展高韧性无人机集群网络的速度感知分层通信框架》

《面向可扩展高韧性无人机集群网络的速度感知分层通信框架》

专知会员服务

4+阅读 · 今天2:54

《面向概率推理的可定制战术引擎及其在军事任务规划中的应用》

《面向概率推理的可定制战术引擎及其在军事任务规划中的应用》

专知会员服务

6+阅读 · 今天2:47

《先进防空系统选型战略框架：基于巴基斯坦的实证启示》

《先进防空系统选型战略框架：基于巴基斯坦的实证启示》

专知会员服务

5+阅读 · 今天2:40

《反无人机交战场景下的战斗归零研究》

《反无人机交战场景下的战斗归零研究》

专知会员服务

4+阅读 · 今天2:34

霍尔木兹与不对称作战时代：水雷、无人系统与海军力量的重新定义

霍尔木兹与不对称作战时代：水雷、无人系统与海军力量的重新定义

专知会员服务

3+阅读 · 今天2:12

博士论文 | 用代码结构感知方法推进代码大模型

博士论文 | 用代码结构感知方法推进代码大模型

专知会员服务

4+阅读 · 7月25日

综述 | 遥感多模态大模型：领域专用还是通用模型？

综述 | 遥感多模态大模型：领域专用还是通用模型？

专知会员服务

4+阅读 · 7月25日

《面向指挥控制训练与实时北约兼容数据分发的战术模拟器》

《面向指挥控制训练与实时北约兼容数据分发的战术模拟器》

专知会员服务

4+阅读 · 7月25日

《决策模型比较研究》

《决策模型比较研究》

专知会员服务

11+阅读 · 7月25日

全球军事与武器工业中的人工智能：应用、方法与影响（万字长文）

全球军事与武器工业中的人工智能：应用、方法与影响（万字长文）

专知会员服务

7+阅读 · 7月25日

《美军水下战与海床战概述及本地实施》

《美军水下战与海床战概述及本地实施》

专知会员服务

6+阅读 · 7月25日

面向未来冲突推进陆军情报体制改革

面向未来冲突推进陆军情报体制改革

专知会员服务

5+阅读 · 7月25日

人工智能赋能无人机：俄乌冲突案例及其深远影响（万字长文）

人工智能赋能无人机：俄乌冲突案例及其深远影响（万字长文）

专知会员服务

6+阅读 · 7月25日

相关VIP内容

从监督微调SFT到强化微调RFT，逐渐补齐推理模型的技术拼图

从监督微调SFT到强化微调RFT，逐渐补齐推理模型的技术拼图

专知会员服务

28+阅读 · 2024年12月7日

适配还是提示？微软最新《通用大模型是否超过专业领域微调大模型》论文，GPT-4多种策略提示超越医学大模型

适配还是提示？微软最新《通用大模型是否超过专业领域微调大模型》论文，GPT-4多种策略提示超越医学大模型

专知会员服务

59+阅读 · 2023年12月3日

遥感目标检测进展如何？西电等最新《深度学习遥感目标检测》综述，涵盖300多篇文献详述五大类型技术

遥感目标检测进展如何？西电等最新《深度学习遥感目标检测》综述，涵盖300多篇文献详述五大类型技术

专知会员服务

55+阅读 · 2023年9月15日

弹药异常检测《使用机器学习进行缺陷表征》最佳论文，MODSIM World 2023

弹药异常检测《使用机器学习进行缺陷表征》最佳论文，MODSIM World 2023

专知会员服务

37+阅读 · 2023年7月22日

北大获奖，清华、人大等提名，ICLR 2023杰出论文奖出炉

北大获奖，清华、人大等提名，ICLR 2023杰出论文奖出炉

专知会员服务

20+阅读 · 2023年3月24日

AAAI 2022 | 在图像级弱监督语义分割这项CV难题上，字节跳动做到了性能显著提升

AAAI 2022 | 在图像级弱监督语义分割这项CV难题上，字节跳动做到了性能显著提升

专知会员服务

19+阅读 · 2022年1月7日

基于图的异常检测，94页ppt

专知会员服务

78+阅读 · 2021年9月27日

【论文推荐】不同图像域弱监督语义分割的综合分析，A Comprehensive Analysis of Weakly-Supervised Semantic Segmentation in Different Image Domains

【论文推荐】不同图像域弱监督语义分割的综合分析，A Comprehensive Analysis of Weakly-Supervised Semantic Segmentation in Different Image Domains

专知会员服务

28+阅读 · 2019年12月27日

基于图的word2vec负采样( GNEG:Graph-Based Negative Sampling for word2vec)

基于图的word2vec负采样( GNEG:Graph-Based Negative Sampling for word2vec)

专知会员服务

40+阅读 · 2019年11月23日

Aspect-Oriented Syntax Network for Aspect-Based Sentiment Analysis，中山大学数据科学与计算机学院权小军教授，第八届全国社会媒体处理大会SMP2019

Aspect-Oriented Syntax Network for Aspect-Based Sentiment Analysis，中山大学数据科学与计算机学院权小军教授，第八届全国社会媒体处理大会SMP2019

专知会员服务

19+阅读 · 2019年10月22日

热门VIP内容

开通专知VIP会员享更多权益服务

ICM 2026 | 陶哲轩：人工智能时代的数学

《面向概率推理的可定制战术引擎及其在军事任务规划中的应用》

ICML 2026 教程 | 数值优化理论还重要吗？

《面向可扩展高韧性无人机集群网络的速度感知分层通信框架》

相关资讯

做目标检测，这6篇就够了：CVPR 2020目标检测论文盘点

做目标检测，这6篇就够了：CVPR 2020目标检测论文盘点

机器之心

23+阅读 · 2020年7月27日

预训练语言模型关系图+必读论文列表，清华荣誉出品

预训练语言模型关系图+必读论文列表，清华荣誉出品

机器之心

18+阅读 · 2019年10月11日

最新必读【预训练语言模型(BERT/XLNet等)】论文，Google/微软/华为ICLR2020提交论文

最新必读【预训练语言模型(BERT/XLNet等)】论文，Google/微软/华为ICLR2020提交论文

专知

36+阅读 · 2019年9月29日

《知识图谱标准化白皮书》发布，200页pdf，中国电子技术标准化研究院主编

《知识图谱标准化白皮书》发布，200页pdf，中国电子技术标准化研究院主编

专知

53+阅读 · 2019年9月16日

西北工业大学发布最新遥感图像目标检测综述论文和Benchmark，带你全面了解遥感图像检测方法

西北工业大学发布最新遥感图像目标检测综述论文和Benchmark，带你全面了解遥感图像检测方法

专知

23+阅读 · 2019年9月5日

从锚点到关键点，最新的目标检测方法发展趋势

从锚点到关键点，最新的目标检测方法发展趋势

计算机视觉life

17+阅读 · 2019年8月20日

最新最权威《深度学习显著目标检测综述》论文代码数据发布，带你全面了解显著目标检测方法

最新最权威《深度学习显著目标检测综述》论文代码数据发布，带你全面了解显著目标检测方法

专知

79+阅读 · 2019年4月24日

数据标注术语和规范国家标准出炉,你的写法符合规范么?

数据标注术语和规范国家标准出炉,你的写法符合规范么?

专知

17+阅读 · 2019年3月21日

放弃 RNN/LSTM 吧，因为真的不好用！望周知~

放弃 RNN/LSTM 吧，因为真的不好用！望周知~

人工智能头条

19+阅读 · 2018年4月24日

【论文推荐】最新5篇目标检测相关论文——显著目标检测、弱监督One-Shot检测、多框检测器、携带物体检测、假彩色图像检测

【论文推荐】最新5篇目标检测相关论文——显著目标检测、弱监督One-Shot检测、多框检测器、携带物体检测、假彩色图像检测

专知

74+阅读 · 2018年1月16日

相关论文

SignalMC-MED: A Multimodal Benchmark for Evaluating Biosignal Foundation Models on Single-Lead ECG and PPG

Arxiv

0+阅读 · 3月10日

Learning Clinical Representations Under Systematic Distribution Shift

Arxiv

0+阅读 · 3月7日

When correcting for regression to the mean is worse than no correction at all

Arxiv

0+阅读 · 2月28日

Don't stop me now: Rethinking Validation Criteria for Model Parameter Selection

Arxiv

0+阅读 · 2月25日

CG-DMER: Hybrid Contrastive-Generative Framework for Disentangled Multimodal ECG Representation Learning

Arxiv

0+阅读 · 2月24日

Position: General Alignment Has Hit a Ceiling; Edge Alignment Must Be Taken Seriously

Arxiv

0+阅读 · 2月23日

Fine-tuning an ECG Foundation Model to Predict Coronary CT Angiography Outcomes

Arxiv

0+阅读 · 2月8日

PTB-XL-Image-17K: A Large-Scale Synthetic ECG Image Dataset with Comprehensive Ground Truth for Deep Learning-Based Digitization

Arxiv

0+阅读 · 2月7日

Verification and Identification in ECG biometric on large-scale

Arxiv

0+阅读 · 2月4日

ECG-R1: Protocol-Guided and Modality-Agnostic MLLM for Reliable ECG Interpretation

Arxiv

0+阅读 · 2月4日

相关基金

冠状动脉粥样硬化进展预测创新技术研究

国家自然科学基金

0+阅读 · 2015年12月31日

基于范数熵的冠状动脉狭窄心音研究

国家自然科学基金

0+阅读 · 2015年12月31日

补体C3a在心肌梗死后心脏重塑中的作用机制研究

国家自然科学基金

0+阅读 · 2015年12月31日

基于生存树的急性心肌梗死早期预警及其多生理参数建模

国家自然科学基金

0+阅读 · 2015年12月31日

可与MPSoC高度融合的片上自主测试-自主修复关键技术研究：针对自然、人为可靠性威胁

国家自然科学基金

0+阅读 · 2015年12月31日

MR成像检测动脉粥样硬化及心肌缺血梗死组织中Tenascin-C蛋白表达的实验研究

国家自然科学基金

0+阅读 · 2014年12月31日

人类左心室3D重构及相关流固耦问题的数值方法研究

国家自然科学基金

0+阅读 · 2014年12月31日

GDF1及GDF3介导的Nodal信号通路相关基因的突变与非综合征型先天性心脏病的相关性研究

国家自然科学基金

0+阅读 · 2014年12月31日

心肌β１肾上腺素受体表达异质性及其影响血压的机制研究

国家自然科学基金

0+阅读 · 2014年12月31日

RR间期和QT间期动力学特性联合分析用于心脏自主神经状态评估的研究

国家自然科学基金

0+阅读 · 2014年12月31日

微信扫码咨询专知VIP会员