Despite being resource-intensive to train, 3D convolutional neural networks (CNNs) have been the standard approach to classify CT and MRI scans. Recent work suggests that deep multiple instance learning (MIL) may be a more efficient alternative for 3D brain scans, especially when the pre-trained image encoder used to embed each 2D slice is frozen and only the pooling operation and classifier are trained. In this paper, we provide a systematic comparison of simple MIL, attention-based MIL, 3D CNNs, and 3D ViTs across three CT and four MRI datasets, including two large datasets of at least 10,000 scans. Our goal is to help resource-constrained practitioners understand which neural networks work well for 3D neuroimages and why. We further compare design choices for attention-based MIL, including different encoders, pooling operations, and architectural orderings. We find that simple mean pooling MIL, without any learnable attention, matches or outperforms recent MIL or 3D CNN alternatives on 4 of 6 moderate-sized tasks. This baseline remains competitive on two large datasets while being 25x faster to train. To explain mean pooling's success, we examine per-slice attention quality and a semi-synthetic dataset where we can derive the best possible classifier via a Bayes estimator. This analysis reveals the limits of existing MIL approaches and suggests routes for future improvements.


翻译:尽管训练成本高昂,三维卷积神经网络(3D CNN)仍是CT和MRI影像分类的标准方法。近期研究表明,深度多实例学习(MIL)可能是处理三维脑部扫描的更高效替代方案,尤其当用于嵌入每个二维切片的预训练图像编码器被冻结,仅训练池化操作与分类器时。本文在三个CT数据集和四个MRI数据集(含两个至少包含10,000次扫描的大型数据集)上,系统比较了简单MIL、基于注意力的MIL、3D CNN及3D ViT。我们的目标在于帮助资源受限的研究者理解哪些神经网络适用于三维神经影像及其原因。进一步地,我们对比了基于注意力的MIL的设计选择,包括不同编码器、池化操作及架构顺序。研究发现,在6个中等规模任务中的4个任务上,无需可学习注意力的简单均值池化MIL可达到甚至超越现有MIL或3D CNN方法的性能。该基线方法在两个大型数据集上仍具竞争力,且训练速度提升了25倍。为解释均值池化的成功机理,我们分析了逐切片注意力质量,并构造了一个可通过贝叶斯估计推导最优分类器的半合成数据集。该分析揭示了现有MIL方法的局限性,并为未来改进提供了方向。

0
下载
关闭预览

相关内容

数据集,又称为资料集、数据集合或资料集合,是一种由数据所组成的集合。
Data set(或dataset)是一个数据的集合,通常以表格形式出现。每一列代表一个特定变量。每一行都对应于某一成员的数据集的问题。它列出的价值观为每一个变量,如身高和体重的一个物体或价值的随机数。每个数值被称为数据资料。对应于行数,该数据集的数据可能包括一个或多个成员。
【ACMMM2024】处理医疗图像分类中类增量学习的失衡问题
专知会员服务
18+阅读 · 2024年7月21日
【斯坦福博士论文】多维神经影像分析,194页pdf
专知会员服务
22+阅读 · 2024年6月21日
深度学习中卷积的综述:应用、挑战和未来趋势
专知会员服务
38+阅读 · 2024年3月22日
图像分类的深度卷积神经网络模型综述
专知会员服务
57+阅读 · 2021年10月29日
深度学习与医学图像分析
人工智能前沿讲习班
40+阅读 · 2019年6月8日
牛逼哄哄的图卷积神经网络将带来哪些机遇?
计算机视觉life
49+阅读 · 2019年3月25日
卷积神经网络(CNN)学习笔记1:基础入门
黑龙江大学自然语言处理实验室
14+阅读 · 2016年6月16日
国家自然科学基金
5+阅读 · 2015年12月31日
国家自然科学基金
3+阅读 · 2015年12月31日
国家自然科学基金
4+阅读 · 2015年12月31日
国家自然科学基金
0+阅读 · 2015年12月31日
国家自然科学基金
0+阅读 · 2015年12月31日
国家自然科学基金
0+阅读 · 2015年12月31日
国家自然科学基金
2+阅读 · 2015年12月31日
国家自然科学基金
4+阅读 · 2014年12月31日
国家自然科学基金
13+阅读 · 2014年12月31日
国家自然科学基金
3+阅读 · 2014年12月31日
Arxiv
13+阅读 · 2023年2月7日
Arxiv
37+阅读 · 2021年9月28日
Arxiv
32+阅读 · 2021年3月29日
VIP会员
最新内容
学习数据的几何:形状空间分析数学综述
专知会员服务
7+阅读 · 6月17日
定向能反无人机系统最新发展动态
专知会员服务
8+阅读 · 6月17日
从燃煤战舰到算法战争:水面指挥的永恒要求
专知会员服务
6+阅读 · 6月17日
相关基金
国家自然科学基金
5+阅读 · 2015年12月31日
国家自然科学基金
3+阅读 · 2015年12月31日
国家自然科学基金
4+阅读 · 2015年12月31日
国家自然科学基金
0+阅读 · 2015年12月31日
国家自然科学基金
0+阅读 · 2015年12月31日
国家自然科学基金
0+阅读 · 2015年12月31日
国家自然科学基金
2+阅读 · 2015年12月31日
国家自然科学基金
4+阅读 · 2014年12月31日
国家自然科学基金
13+阅读 · 2014年12月31日
国家自然科学基金
3+阅读 · 2014年12月31日
Top
微信扫码咨询专知VIP会员