THUNDER：图块级组织病理学图像理解基准 (THUNDER: Tile-level Histopathology image UNDERstanding benchmark) - 专知论文

会员服务 ·

0

基准 · 病理 · 基准测试 · 鲁棒 · 组织病理学 ·

THUNDER: Tile-level Histopathology image UNDERstanding benchmark

翻译：THUNDER：图块级组织病理学图像理解基准

Pierre Marza,Leo Fillioux,Sofiène Boutaj,Kunal Mahatha,Christian Desrosiers,Pablo Piantanida,Jose Dolz,Stergios Christodoulidis,Maria Vakalopoulou

from arxiv, Accepted at NeurIPS 2025 Datasets and Benchmarks Track (Spotlight)

Progress in a research field can be hard to assess, in particular when many concurrent methods are proposed in a short period of time. This is the case in digital pathology, where many foundation models have been released recently to serve as feature extractors for tile-level images, being used in a variety of downstream tasks, both for tile- and slide-level problems. Benchmarking available methods then becomes paramount to get a clearer view of the research landscape. In particular, in critical domains such as healthcare, a benchmark should not only focus on evaluating downstream performance, but also provide insights about the main differences between methods, and importantly, further consider uncertainty and robustness to ensure a reliable usage of proposed models. For these reasons, we introduce THUNDER, a tile-level benchmark for digital pathology foundation models, allowing for efficient comparison of many models on diverse datasets with a series of downstream tasks, studying their feature spaces and assessing the robustness and uncertainty of predictions informed by their embeddings. THUNDER is a fast, easy-to-use, dynamic benchmark that can already support a large variety of state-of-the-art foundation, as well as local user-defined models for direct tile-based comparison. In this paper, we provide a comprehensive comparison of 23 foundation models on 16 different datasets covering diverse tasks, feature analysis, and robustness. The code for THUNDER is publicly available at https://github.com/MICS-Lab/thunder.

翻译：研究领域的进展往往难以评估，尤其是在短时间内涌现出多种并行方法的情况下。数字病理学领域便是如此，近期发布了众多基础模型作为图块级图像的特征提取器，广泛应用于各类下游任务，涵盖图块级和玻片级问题。因此，对现有方法进行基准测试对于厘清研究格局至关重要。尤其在医疗等关键领域，基准测试不仅应关注下游性能评估，还需揭示方法间的核心差异，并进一步考量不确定性与鲁棒性，以确保所提模型的可靠应用。基于此，我们推出THUNDER——一个面向数字病理学基础模型的图块级基准测试框架。该框架支持在多样化数据集上通过系列下游任务高效比较多种模型，研究其特征空间，并基于嵌入向量评估预测的鲁棒性与不确定性。THUNDER作为快速、易用的动态基准平台，目前已兼容大量前沿基础模型及用户自定义本地模型，支持直接的图块级对比研究。本文通过对23个基础模型在16个不同数据集上进行综合比较，涵盖多类任务、特征分析与鲁棒性评估。THUNDER的代码已公开于https://github.com/MICS-Lab/thunder。

0

相关内容

【博士论文】结合图像与文本以提升医学图像理解

【博士论文】结合图像与文本以提升医学图像理解

专知会员服务

30+阅读 · 2025年3月1日

适配还是提示？微软最新《通用大模型是否超过专业领域微调大模型》论文，GPT-4多种策略提示超越医学大模型

适配还是提示？微软最新《通用大模型是否超过专业领域微调大模型》论文，GPT-4多种策略提示超越医学大模型

专知会员服务

59+阅读 · 2023年12月3日

【NeuralPS2023】Quilt-1M:组织病理学的一百万张图像-文本对

【NeuralPS2023】Quilt-1M:组织病理学的一百万张图像-文本对

专知会员服务

19+阅读 · 2023年10月4日

【普林斯顿博士论文】结构化生物医学数据的概率模型，130页pdf

【普林斯顿博士论文】结构化生物医学数据的概率模型，130页pdf

专知会员服务

24+阅读 · 2023年3月12日

上海市数字医学创新中心：2022中国智慧数字病理行业发展白皮书（附报告），56页pdf

上海市数字医学创新中心：2022中国智慧数字病理行业发展白皮书（附报告），56页pdf

专知会员服务

45+阅读 · 2023年1月30日

《深度学习医学图像配准》综述进展

《深度学习医学图像配准》综述进展

专知会员服务

49+阅读 · 2022年5月9日

南京大学医学院最新《Transformer医学图像处理应用》综述论文，涵盖120多种Transformers方法及在医疗临床应用

南京大学医学院最新《Transformer医学图像处理应用》综述论文，涵盖120多种Transformers方法及在医疗临床应用

专知会员服务

124+阅读 · 2022年3月4日

【滑铁卢大学】医学图像分析中可解释的深度学习模型，18页pdf

【滑铁卢大学】医学图像分析中可解释的深度学习模型，18页pdf

专知会员服务

121+阅读 · 2020年5月31日

数字病理学中的生成性对抗网络:趋势和未来潜力的综述 Generative Adversarial Networks in Digital Pathology: A Survey on Trends and Future Potential

数字病理学中的生成性对抗网络:趋势和未来潜力的综述 Generative Adversarial Networks in Digital Pathology: A Survey on Trends and Future Potential

专知会员服务

19+阅读 · 2020年5月1日

近期必读的7篇【医学图像分割】相关论文和代码（CVPR、AAAI）

近期必读的7篇【医学图像分割】相关论文和代码（CVPR、AAAI）

专知会员服务

41+阅读 · 2020年1月10日

「深度学习医学图像关键点检测」最新2022研究综述

「深度学习医学图像关键点检测」最新2022研究综述

专知

16+阅读 · 2022年4月10日

(KDD'21) 异构图神经网络到底哪家强？清华、微软、阿里、中科院等推出HGB基准！

(KDD'21) 异构图神经网络到底哪家强？清华、微软、阿里、中科院等推出HGB基准！

学术头条

13+阅读 · 2021年11月9日

DeepReg：开源深度学习医学图像配准工具包

DeepReg：开源深度学习医学图像配准工具包

专知

35+阅读 · 2020年8月29日

美国埃默里大学医学院发布最新「医学图像配准深度学习」综述论文

美国埃默里大学医学院发布最新「医学图像配准深度学习」综述论文

专知

15+阅读 · 2020年1月7日

西北工业大学发布最新遥感图像目标检测综述论文和Benchmark，带你全面了解遥感图像检测方法

西北工业大学发布最新遥感图像目标检测综述论文和Benchmark，带你全面了解遥感图像检测方法

专知

23+阅读 · 2019年9月5日

病理图像的全景分割

病理图像的全景分割

人工智能前沿讲习班

16+阅读 · 2019年6月1日

近期必读的7篇【医学图像分割】相关论文和代码（CVPR、AAAI）

近期必读的7篇【医学图像分割】相关论文和代码（CVPR、AAAI）

专知

81+阅读 · 2019年4月30日

大讲堂 | 基于医疗知识的疾病诊断预测

大讲堂 | 基于医疗知识的疾病诊断预测

AI科技评论

10+阅读 · 2019年1月22日

一文读懂目标检测：R-CNN、Fast R-CNN、Faster R-CNN、YOLO、SSD

一文读懂目标检测：R-CNN、Fast R-CNN、Faster R-CNN、YOLO、SSD

七月在线实验室

11+阅读 · 2018年7月18日

【前沿】自动从CT医疗影像中生成诊断报告，卡内基梅隆大学CMU邢波教授团队最新基于深度学习的医疗影像研究成果

【前沿】自动从CT医疗影像中生成诊断报告，卡内基梅隆大学CMU邢波教授团队最新基于深度学习的医疗影像研究成果

专知

18+阅读 · 2017年11月24日

天元数学交流项目图像处理中的数学理论及方法研讨会

国家自然科学基金

9+阅读 · 2017年12月31日

面向特征提取的低秩与稀疏图嵌入理论与算法研究

国家自然科学基金

1+阅读 · 2015年12月31日

基于皮肤毛囊光学相干层析（OCT）成像的三维断层生物特征识别新方法

国家自然科学基金

1+阅读 · 2015年12月31日

面向在线检索的医学影像多特征降维方法研究

国家自然科学基金

0+阅读 · 2015年12月31日

基于深度神经网络的雷达目标高分辨距离像稳健识别方法

国家自然科学基金

6+阅读 · 2015年12月31日

基于荧光纳米簇的“关开”型FRET传感器用于血清中多种肿瘤标志物同时检测

国家自然科学基金

0+阅读 · 2015年12月31日

基于磁共振动态增强灌注成像的肝癌血管生成拟态图像纹理特征提取与定量

国家自然科学基金

0+阅读 · 2015年12月31日

一种乳腺癌分子特异性手术导航成像方法

国家自然科学基金

1+阅读 · 2015年12月31日

基于图像属性和深度学习的大规模物体检测研究与应用

国家自然科学基金

1+阅读 · 2015年12月31日

基于诊疗一体化智能纳米探针的影像导航的肿瘤光热治疗研究

国家自然科学基金

0+阅读 · 2014年12月31日

PathoScribe: Transforming Pathology Data into a Living Library with a Unified LLM-Driven Framework for Semantic Retrieval and Clinical Integration

Arxiv

0+阅读 · 3月11日

PathoScribe: Transforming Pathology Data into a Living Library with a Unified LLM-Driven Framework for Semantic Retrieval and Clinical Integration

Arxiv

0+阅读 · 3月9日

BRIGHT: A Collaborative Generalist-Specialist Foundation Model for Breast Pathology

Arxiv

0+阅读 · 3月3日

Histopathology Image Normalization via Latent Manifold Compaction

Arxiv

0+阅读 · 2月27日

PatchDenoiser: Parameter-efficient multi-scale patch learning and fusion denoiser for medical images

Arxiv

0+阅读 · 2月25日

LeafNet: A Large-Scale Dataset and Comprehensive Benchmark for Foundational Vision-Language Understanding of Plant Diseases

Arxiv

0+阅读 · 2月20日

CT-Bench: A Benchmark for Multimodal Lesion Understanding in Computed Tomography

Arxiv

0+阅读 · 2月19日

CT-Bench: A Benchmark for Multimodal Lesion Understanding in Computed Tomography

Arxiv

0+阅读 · 2月16日

MEmilio -- A high performance Modular EpideMIcs simuLatIOn software for multi-scale and comparative simulations of infectious disease dynamics

Arxiv

0+阅读 · 2月11日

StainNet: Scaling Self-Supervised Foundation Models on Immunohistochemistry and Special Stains for Computational Pathology

Arxiv

0+阅读 · 2月4日

VIP会员

文章信息

相关主题

组织病理学

最新内容

《面向大语言模型引导规划、Bandit算法驱动探索与多智能体导航的分层决策问题研究》180页

《面向大语言模型引导规划、Bandit算法驱动探索与多智能体导航的分层决策问题研究》180页

专知会员服务

0+阅读 · 22分钟前

《自动化战略情报管控》

《自动化战略情报管控》

专知会员服务

0+阅读 · 25分钟前

《反无人机蜂群技术研究：基于小队策略构建大规模无人机防御》

《反无人机蜂群技术研究：基于小队策略构建大规模无人机防御》

专知会员服务

0+阅读 · 33分钟前

得失评估：审视对伊朗战争的轨迹（简报）

得失评估：审视对伊朗战争的轨迹（简报）

专知会员服务

0+阅读 · 37分钟前

【CMU博士论文】迈向可解释机器学习的理论基础

【CMU博士论文】迈向可解释机器学习的理论基础

专知会员服务

0+阅读 · 今天12:23

CVPR 2026 | HulluEdit：基于正交子空间编辑的多模态大语言模型幻觉缓解框架

CVPR 2026 | HulluEdit：基于正交子空间编辑的多模态大语言模型幻觉缓解框架

专知会员服务

0+阅读 · 今天12:21

无人机视觉语言导航：研究进展、挑战与技术路线图

无人机视觉语言导航：研究进展、挑战与技术路线图

专知会员服务

0+阅读 · 今天12:13

《基于强化学习的反无人机蜂群拦截优先级排序》

《基于强化学习的反无人机蜂群拦截优先级排序》

专知会员服务

7+阅读 · 今天8:20

乌克兰反无人机方案“天穹哨兵”解析：一款人工智能驱动的近程防空系统

乌克兰反无人机方案“天穹哨兵”解析：一款人工智能驱动的近程防空系统

专知会员服务

2+阅读 · 今天7:30

美军2026条令《指挥官装甲装备维护技能测试计划》

美军2026条令《指挥官装甲装备维护技能测试计划》

专知会员服务

5+阅读 · 今天7:28

《俄罗斯构建服务于人工智能驱动自主性的主权无人机生态系统》（2026报告）

《俄罗斯构建服务于人工智能驱动自主性的主权无人机生态系统》（2026报告）

专知会员服务

6+阅读 · 今天3:09

2026年俄罗斯新型喷气动力无人机Geran-5的技术规格

2026年俄罗斯新型喷气动力无人机Geran-5的技术规格

专知会员服务

3+阅读 · 今天2:50

基于数据优化的人机协同与机器人僚机

基于数据优化的人机协同与机器人僚机

专知会员服务

4+阅读 · 今天2:08

美太空军发布两份聚焦2040年规划的文件：《2040年未来作战环境》和《2040年目标部队》（附文件）

美太空军发布两份聚焦2040年规划的文件：《2040年未来作战环境》和《2040年目标部队》（附文件）

专知会员服务

13+阅读 · 今天1:51

《为码头高价值舰艇提供反无人机系统防御方案研究》80页

《为码头高价值舰艇提供反无人机系统防御方案研究》80页

专知会员服务

8+阅读 · 4月15日

相关VIP内容

【博士论文】结合图像与文本以提升医学图像理解

【博士论文】结合图像与文本以提升医学图像理解

专知会员服务

30+阅读 · 2025年3月1日

适配还是提示？微软最新《通用大模型是否超过专业领域微调大模型》论文，GPT-4多种策略提示超越医学大模型

适配还是提示？微软最新《通用大模型是否超过专业领域微调大模型》论文，GPT-4多种策略提示超越医学大模型

专知会员服务

59+阅读 · 2023年12月3日

【NeuralPS2023】Quilt-1M:组织病理学的一百万张图像-文本对

【NeuralPS2023】Quilt-1M:组织病理学的一百万张图像-文本对

专知会员服务

19+阅读 · 2023年10月4日

【普林斯顿博士论文】结构化生物医学数据的概率模型，130页pdf

【普林斯顿博士论文】结构化生物医学数据的概率模型，130页pdf

专知会员服务

24+阅读 · 2023年3月12日

上海市数字医学创新中心：2022中国智慧数字病理行业发展白皮书（附报告），56页pdf

上海市数字医学创新中心：2022中国智慧数字病理行业发展白皮书（附报告），56页pdf

专知会员服务

45+阅读 · 2023年1月30日

《深度学习医学图像配准》综述进展

《深度学习医学图像配准》综述进展

专知会员服务

49+阅读 · 2022年5月9日

南京大学医学院最新《Transformer医学图像处理应用》综述论文，涵盖120多种Transformers方法及在医疗临床应用

南京大学医学院最新《Transformer医学图像处理应用》综述论文，涵盖120多种Transformers方法及在医疗临床应用

专知会员服务

124+阅读 · 2022年3月4日

【滑铁卢大学】医学图像分析中可解释的深度学习模型，18页pdf

【滑铁卢大学】医学图像分析中可解释的深度学习模型，18页pdf

专知会员服务

121+阅读 · 2020年5月31日

数字病理学中的生成性对抗网络:趋势和未来潜力的综述 Generative Adversarial Networks in Digital Pathology: A Survey on Trends and Future Potential

数字病理学中的生成性对抗网络:趋势和未来潜力的综述 Generative Adversarial Networks in Digital Pathology: A Survey on Trends and Future Potential

专知会员服务

19+阅读 · 2020年5月1日

近期必读的7篇【医学图像分割】相关论文和代码（CVPR、AAAI）

近期必读的7篇【医学图像分割】相关论文和代码（CVPR、AAAI）

专知会员服务

41+阅读 · 2020年1月10日

热门VIP内容

开通专知VIP会员享更多权益服务

《自动化战略情报管控》

得失评估：审视对伊朗战争的轨迹（简报）

《面向大语言模型引导规划、Bandit算法驱动探索与多智能体导航的分层决策问题研究》180页

《反无人机蜂群技术研究：基于小队策略构建大规模无人机防御》

相关资讯

「深度学习医学图像关键点检测」最新2022研究综述

「深度学习医学图像关键点检测」最新2022研究综述

专知

16+阅读 · 2022年4月10日

(KDD'21) 异构图神经网络到底哪家强？清华、微软、阿里、中科院等推出HGB基准！

(KDD'21) 异构图神经网络到底哪家强？清华、微软、阿里、中科院等推出HGB基准！

学术头条

13+阅读 · 2021年11月9日

DeepReg：开源深度学习医学图像配准工具包

DeepReg：开源深度学习医学图像配准工具包

专知

35+阅读 · 2020年8月29日

美国埃默里大学医学院发布最新「医学图像配准深度学习」综述论文

美国埃默里大学医学院发布最新「医学图像配准深度学习」综述论文

专知

15+阅读 · 2020年1月7日

西北工业大学发布最新遥感图像目标检测综述论文和Benchmark，带你全面了解遥感图像检测方法

西北工业大学发布最新遥感图像目标检测综述论文和Benchmark，带你全面了解遥感图像检测方法

专知

23+阅读 · 2019年9月5日

病理图像的全景分割

病理图像的全景分割

人工智能前沿讲习班

16+阅读 · 2019年6月1日

近期必读的7篇【医学图像分割】相关论文和代码（CVPR、AAAI）

近期必读的7篇【医学图像分割】相关论文和代码（CVPR、AAAI）

专知

81+阅读 · 2019年4月30日

大讲堂 | 基于医疗知识的疾病诊断预测

大讲堂 | 基于医疗知识的疾病诊断预测

AI科技评论

10+阅读 · 2019年1月22日

一文读懂目标检测：R-CNN、Fast R-CNN、Faster R-CNN、YOLO、SSD

一文读懂目标检测：R-CNN、Fast R-CNN、Faster R-CNN、YOLO、SSD

七月在线实验室

11+阅读 · 2018年7月18日

【前沿】自动从CT医疗影像中生成诊断报告，卡内基梅隆大学CMU邢波教授团队最新基于深度学习的医疗影像研究成果

【前沿】自动从CT医疗影像中生成诊断报告，卡内基梅隆大学CMU邢波教授团队最新基于深度学习的医疗影像研究成果

专知

18+阅读 · 2017年11月24日

相关论文

PathoScribe: Transforming Pathology Data into a Living Library with a Unified LLM-Driven Framework for Semantic Retrieval and Clinical Integration

Arxiv

0+阅读 · 3月11日

PathoScribe: Transforming Pathology Data into a Living Library with a Unified LLM-Driven Framework for Semantic Retrieval and Clinical Integration

Arxiv

0+阅读 · 3月9日

BRIGHT: A Collaborative Generalist-Specialist Foundation Model for Breast Pathology

Arxiv

0+阅读 · 3月3日

Histopathology Image Normalization via Latent Manifold Compaction

Arxiv

0+阅读 · 2月27日

PatchDenoiser: Parameter-efficient multi-scale patch learning and fusion denoiser for medical images

Arxiv

0+阅读 · 2月25日

LeafNet: A Large-Scale Dataset and Comprehensive Benchmark for Foundational Vision-Language Understanding of Plant Diseases

Arxiv

0+阅读 · 2月20日

CT-Bench: A Benchmark for Multimodal Lesion Understanding in Computed Tomography

Arxiv

0+阅读 · 2月19日

CT-Bench: A Benchmark for Multimodal Lesion Understanding in Computed Tomography

Arxiv

0+阅读 · 2月16日

MEmilio -- A high performance Modular EpideMIcs simuLatIOn software for multi-scale and comparative simulations of infectious disease dynamics

Arxiv

0+阅读 · 2月11日

StainNet: Scaling Self-Supervised Foundation Models on Immunohistochemistry and Special Stains for Computational Pathology

Arxiv

0+阅读 · 2月4日

相关基金

天元数学交流项目图像处理中的数学理论及方法研讨会

国家自然科学基金

9+阅读 · 2017年12月31日

面向特征提取的低秩与稀疏图嵌入理论与算法研究

国家自然科学基金

1+阅读 · 2015年12月31日

基于皮肤毛囊光学相干层析（OCT）成像的三维断层生物特征识别新方法

国家自然科学基金

1+阅读 · 2015年12月31日

面向在线检索的医学影像多特征降维方法研究

国家自然科学基金

0+阅读 · 2015年12月31日

基于深度神经网络的雷达目标高分辨距离像稳健识别方法

国家自然科学基金

6+阅读 · 2015年12月31日

基于荧光纳米簇的“关开”型FRET传感器用于血清中多种肿瘤标志物同时检测

国家自然科学基金

0+阅读 · 2015年12月31日

基于磁共振动态增强灌注成像的肝癌血管生成拟态图像纹理特征提取与定量

国家自然科学基金

0+阅读 · 2015年12月31日

一种乳腺癌分子特异性手术导航成像方法

国家自然科学基金

1+阅读 · 2015年12月31日

基于图像属性和深度学习的大规模物体检测研究与应用

国家自然科学基金

1+阅读 · 2015年12月31日

基于诊疗一体化智能纳米探针的影像导航的肿瘤光热治疗研究

国家自然科学基金

0+阅读 · 2014年12月31日

微信扫码咨询专知VIP会员