LeMat-GenBench：晶体生成模型的统一评估框架 (LeMat-GenBench: A Unified Evaluation Framework for Crystal Generative Models) - 专知论文

会员服务 ·

0

生成模型 · 学习模型 · 基准 · 机器学习模型 · 材料生成 ·

LeMat-GenBench: A Unified Evaluation Framework for Crystal Generative Models

翻译：LeMat-GenBench：晶体生成模型的统一评估框架

Siddharth Betala,Samuel P. Gleason,Ali Ramlaoui,Andy Xu,Georgia Channing,Daniel Levy,Clémentine Fourrier,Nikita Kazeev,Chaitanya K. Joshi,Sékou-Oumar Kaba,Félix Therrien,Alex Hernandez-Garcia,Rocío Mercado,N. M. Anoop Krishnan,Alexandre Duval

from arxiv, 46 pages, 17 figures, 16 tables

Generative machine learning (ML) models hold great promise for accelerating materials discovery through the inverse design of inorganic crystals, enabling an unprecedented exploration of chemical space. Yet, the lack of standardized evaluation frameworks makes it challenging to evaluate, compare, and further develop these ML models meaningfully. In this work, we introduce LeMat-GenBench, a unified benchmark for generative models of crystalline materials, supported by a set of evaluation metrics designed to better inform model development and downstream applications. We release both an open-source evaluation suite and a public leaderboard on Hugging Face, and benchmark 12 recent generative models. Results reveal that an increase in stability leads to a decrease in novelty and diversity on average, with no model excelling across all dimensions. Altogether, LeMat-GenBench establishes a reproducible and extensible foundation for fair model comparison and aims to guide the development of more reliable, discovery-oriented generative models for crystalline materials.

翻译：生成式机器学习模型在通过无机晶体的逆向设计加速材料发现方面具有巨大潜力，能够实现对化学空间前所未有的探索。然而，由于缺乏标准化的评估框架，难以对这些机器学习模型进行有意义的评估、比较和进一步开发。在本工作中，我们提出了LeMat-GenBench，这是一个用于晶体材料生成模型的统一基准，并辅以一套旨在更好地指导模型开发和下游应用的评估指标。我们发布了开源评估套件和Hugging Face上的公共排行榜，并对12个近期提出的生成模型进行了基准测试。结果表明，稳定性的提升平均会导致新颖性和多样性的下降，且没有模型在所有维度上都表现出色。总而言之，LeMat-GenBench为公平的模型比较建立了一个可复现且可扩展的基础，旨在指导开发更可靠、面向发现的晶体材料生成模型。

0

相关内容

生成模型

在机器学习中，生成模型可以用来直接对数据建模（例如根据某个变量的概率密度函数进行数据采样），也可以用来建立变量间的条件概率分布。条件概率分布可以由生成模型根据贝叶斯定理形成。

《SysEngBench：评估系统工程中大型语言模型的新基准》美海军最新报告

《SysEngBench：评估系统工程中大型语言模型的新基准》美海军最新报告

专知会员服务

50+阅读 · 2024年6月30日

Meta-Transformer：多模态学习的统一框架

Meta-Transformer：多模态学习的统一框架

专知会员服务

59+阅读 · 2023年7月21日

【港科大博士论文】生成模型的统计和结构特性，338页pdf

【港科大博士论文】生成模型的统计和结构特性，338页pdf

专知会员服务

48+阅读 · 2022年12月20日

Nat. Mach. Intel. | 一种用于分子相互作用和分子性质预测自动图学习方法

Nat. Mach. Intel. | 一种用于分子相互作用和分子性质预测自动图学习方法

专知会员服务

20+阅读 · 2022年6月25日

【Cell】可扩展深度图神经网络的高性能材料性能预测

【Cell】可扩展深度图神经网络的高性能材料性能预测

专知会员服务

18+阅读 · 2022年5月4日

【ICLR2022】MIT最新论文《用于分子生成的数据高效图文法学习》，用图文法生成新分子，Data-Efficient Graph Grammar Learning for Molecular Generation

【ICLR2022】MIT最新论文《用于分子生成的数据高效图文法学习》，用图文法生成新分子，Data-Efficient Graph Grammar Learning for Molecular Generation

专知会员服务

14+阅读 · 2022年4月10日

【论文推荐】一种用于逆合成预测的图到图框架，A Graph to Graphs Framework for Retrosynthesis Prediction

【论文推荐】一种用于逆合成预测的图到图框架，A Graph to Graphs Framework for Retrosynthesis Prediction

专知会员服务

12+阅读 · 2020年4月1日

【DeepMind】PolyGen: 一种三维网格的自回归生成模型，PolyGen: An Autoregressive Generative Model of 3D Meshes

【DeepMind】PolyGen: 一种三维网格的自回归生成模型，PolyGen: An Autoregressive Generative Model of 3D Meshes

专知会员服务

37+阅读 · 2020年2月27日

【MIT】生成模型提出的分子的可合成性，48页pdf,The Synthesizability of Molecules Proposed by Generative Models

【MIT】生成模型提出的分子的可合成性，48页pdf,The Synthesizability of Molecules Proposed by Generative Models

专知会员服务

28+阅读 · 2020年2月20日

TensorFlow Lite指南实战《TensorFlow Lite A primer》，附48页PPT

TensorFlow Lite指南实战《TensorFlow Lite A primer》，附48页PPT

专知会员服务

70+阅读 · 2020年1月17日

ChatGPT大模型如何做科学研究? CMU提出《大模型智能体系统》，高推理展现出大型语言模型的新兴自主科学研究能力

ChatGPT大模型如何做科学研究? CMU提出《大模型智能体系统》，高推理展现出大型语言模型的新兴自主科学研究能力

专知

17+阅读 · 2023年4月12日

最新《深度生成式模型进展》视频报告，43页ppt，斯坦福Aditya Grover

最新《深度生成式模型进展》视频报告，43页ppt，斯坦福Aditya Grover

专知

13+阅读 · 2020年8月9日

GAN新书《生成式深度学习》Generative Deep Learning，附379页全文PDF

GAN新书《生成式深度学习》Generative Deep Learning，附379页全文PDF

专知

96+阅读 · 2019年9月30日

这个项目火了！各种深度学习架构，模型和技巧的集合

这个项目火了！各种深度学习架构，模型和技巧的集合

大数据技术

14+阅读 · 2019年6月13日

集多种半监督学习范式为一体，谷歌新研究提出新型半监督方法 MixMatch

集多种半监督学习范式为一体，谷歌新研究提出新型半监督方法 MixMatch

机器之心

11+阅读 · 2019年6月3日

Keras作者推荐的Github项目，基于TensorFlow2的生成式模型合集

Keras作者推荐的Github项目，基于TensorFlow2的生成式模型合集

专知

15+阅读 · 2019年5月17日

【学界】极端图像压缩的生成对抗网络，可生成低码率的高质量图像

【学界】极端图像压缩的生成对抗网络，可生成低码率的高质量图像

GAN生成式对抗网络

10+阅读 · 2018年4月25日

推荐｜上交大推出Texygen：文本生成模型的基准测试平台

推荐｜上交大推出Texygen：文本生成模型的基准测试平台

全球人工智能

15+阅读 · 2018年2月8日

【论文】所见所想所真，对抗学习GAN提升跨模态检索效果！阿里巴巴AI Labs等团队最新工作

【论文】所见所想所真，对抗学习GAN提升跨模态检索效果！阿里巴巴AI Labs等团队最新工作

专知

12+阅读 · 2017年12月21日

在TensorFlow中对比两大生成模型：VAE与GAN

在TensorFlow中对比两大生成模型：VAE与GAN

机器之心

12+阅读 · 2017年10月23日

功能导向晶态材料的结构设计和可控制备

国家自然科学基金

0+阅读 · 2017年6月30日

多功能自旋交叉分子晶体的设计与构筑

国家自然科学基金

0+阅读 · 2016年12月31日

高指数晶面结构贵金属纳米颗粒超晶格的模板辅助自组装与光学性能

国家自然科学基金

0+阅读 · 2015年12月31日

基于磁性金属有机骨架材料的低丰度蛋白/肽段高效选择分离分析新方法研究

国家自然科学基金

0+阅读 · 2015年12月31日

结合同步辐射实验和第一性原理的理论对半晶化过程中的晶体结构,电子结构和热力学性质进行研究

国家自然科学基金

0+阅读 · 2015年12月31日

金属有机框架（MOFs）材料的构筑、纳米化及光学性能研究

国家自然科学基金

0+阅读 · 2015年12月31日

力-磁-热循环载荷作用下Ni-Mn-Ga单晶材料变形理论及机理

国家自然科学基金

0+阅读 · 2015年12月31日

基于磁性金属的多组元复合纳米晶的形成机制、界面结构及其磁学和光学特性研究

国家自然科学基金

0+阅读 · 2014年12月31日

M-B-O-X(M:碱金属或碱土金属；X：卤素）体系中非线性光学材料的探索与性能研究

国家自然科学基金

0+阅读 · 2014年12月31日

一维半导体异质纳米结构的瞬态光学特性及光传输调控研究

国家自然科学基金

0+阅读 · 2014年12月31日

Fourier Transformers for Latent Crystallographic Diffusion and Generative Modeling

Arxiv

0+阅读 · 2月12日

GENIUS: Generative Fluid Intelligence Evaluation Suite

Arxiv

0+阅读 · 2月11日

HypoBench: Towards Systematic and Principled Benchmarking for Hypothesis Generation

Arxiv

0+阅读 · 2月10日

GEBench: Benchmarking Image Generation Models as GUI Environments

Arxiv

0+阅读 · 2月10日

RxnBench: A Multimodal Benchmark for Evaluating Large Language Models on Chemical Reaction Understanding from Scientific Literature

Arxiv

0+阅读 · 1月28日

SpecBridge: Bridging Mass Spectrometry and Molecular Representations via Cross-Modal Alignment

Arxiv

0+阅读 · 1月23日

RxnBench: A Multimodal Benchmark for Evaluating Large Language Models on Chemical Reaction Understanding from Scientific Literature

Arxiv

0+阅读 · 1月20日

GraphBench: Next-generation graph learning benchmarking

Arxiv

0+阅读 · 1月18日

LaM-SLidE: Latent Space Modeling of Spatial Dynamical Systems via Linked Entities

Arxiv

0+阅读 · 1月15日

SlidesGen-Bench: Evaluating Slides Generation via Computational and Quantitative Metrics

Arxiv

0+阅读 · 1月14日

VIP会员

文章信息

相关主题

机器学习模型

最新内容

美国与以色列如何在攻击伊朗中使用人工智能

美国与以色列如何在攻击伊朗中使用人工智能

专知会员服务

2+阅读 · 今天16:20

《面向大语言模型引导规划、Bandit算法驱动探索与多智能体导航的分层决策问题研究》180页

《面向大语言模型引导规划、Bandit算法驱动探索与多智能体导航的分层决策问题研究》180页

专知会员服务

3+阅读 · 今天14:34

《自动化战略情报管控》

《自动化战略情报管控》

专知会员服务

1+阅读 · 今天14:31

《反无人机蜂群技术研究：基于小队策略构建大规模无人机防御》

《反无人机蜂群技术研究：基于小队策略构建大规模无人机防御》

专知会员服务

3+阅读 · 今天14:23

得失评估：审视对伊朗战争的轨迹（简报）

得失评估：审视对伊朗战争的轨迹（简报）

专知会员服务

2+阅读 · 今天14:19

【CMU博士论文】迈向可解释机器学习的理论基础

【CMU博士论文】迈向可解释机器学习的理论基础

专知会员服务

2+阅读 · 今天12:23

CVPR 2026 | HulluEdit：基于正交子空间编辑的多模态大语言模型幻觉缓解框架

CVPR 2026 | HulluEdit：基于正交子空间编辑的多模态大语言模型幻觉缓解框架

专知会员服务

2+阅读 · 今天12:21

无人机视觉语言导航：研究进展、挑战与技术路线图

无人机视觉语言导航：研究进展、挑战与技术路线图

专知会员服务

2+阅读 · 今天12:13

《基于强化学习的反无人机蜂群拦截优先级排序》

《基于强化学习的反无人机蜂群拦截优先级排序》

专知会员服务

8+阅读 · 今天8:20

乌克兰反无人机方案“天穹哨兵”解析：一款人工智能驱动的近程防空系统

乌克兰反无人机方案“天穹哨兵”解析：一款人工智能驱动的近程防空系统

专知会员服务

3+阅读 · 今天7:30

美军2026条令《指挥官装甲装备维护技能测试计划》

美军2026条令《指挥官装甲装备维护技能测试计划》

专知会员服务

6+阅读 · 今天7:28

《俄罗斯构建服务于人工智能驱动自主性的主权无人机生态系统》（2026报告）

《俄罗斯构建服务于人工智能驱动自主性的主权无人机生态系统》（2026报告）

专知会员服务

7+阅读 · 今天3:09

2026年俄罗斯新型喷气动力无人机Geran-5的技术规格

2026年俄罗斯新型喷气动力无人机Geran-5的技术规格

专知会员服务

4+阅读 · 今天2:50

基于数据优化的人机协同与机器人僚机

基于数据优化的人机协同与机器人僚机

专知会员服务

6+阅读 · 今天2:08

美太空军发布两份聚焦2040年规划的文件：《2040年未来作战环境》和《2040年目标部队》（附文件）

美太空军发布两份聚焦2040年规划的文件：《2040年未来作战环境》和《2040年目标部队》（附文件）

专知会员服务

14+阅读 · 今天1:51

相关VIP内容

《SysEngBench：评估系统工程中大型语言模型的新基准》美海军最新报告

《SysEngBench：评估系统工程中大型语言模型的新基准》美海军最新报告

专知会员服务

50+阅读 · 2024年6月30日

Meta-Transformer：多模态学习的统一框架

Meta-Transformer：多模态学习的统一框架

专知会员服务

59+阅读 · 2023年7月21日

【港科大博士论文】生成模型的统计和结构特性，338页pdf

【港科大博士论文】生成模型的统计和结构特性，338页pdf

专知会员服务

48+阅读 · 2022年12月20日

Nat. Mach. Intel. | 一种用于分子相互作用和分子性质预测自动图学习方法

Nat. Mach. Intel. | 一种用于分子相互作用和分子性质预测自动图学习方法

专知会员服务

20+阅读 · 2022年6月25日

【Cell】可扩展深度图神经网络的高性能材料性能预测

【Cell】可扩展深度图神经网络的高性能材料性能预测

专知会员服务

18+阅读 · 2022年5月4日

【ICLR2022】MIT最新论文《用于分子生成的数据高效图文法学习》，用图文法生成新分子，Data-Efficient Graph Grammar Learning for Molecular Generation

【ICLR2022】MIT最新论文《用于分子生成的数据高效图文法学习》，用图文法生成新分子，Data-Efficient Graph Grammar Learning for Molecular Generation

专知会员服务

14+阅读 · 2022年4月10日

【论文推荐】一种用于逆合成预测的图到图框架，A Graph to Graphs Framework for Retrosynthesis Prediction

【论文推荐】一种用于逆合成预测的图到图框架，A Graph to Graphs Framework for Retrosynthesis Prediction

专知会员服务

12+阅读 · 2020年4月1日

【DeepMind】PolyGen: 一种三维网格的自回归生成模型，PolyGen: An Autoregressive Generative Model of 3D Meshes

【DeepMind】PolyGen: 一种三维网格的自回归生成模型，PolyGen: An Autoregressive Generative Model of 3D Meshes

专知会员服务

37+阅读 · 2020年2月27日

【MIT】生成模型提出的分子的可合成性，48页pdf,The Synthesizability of Molecules Proposed by Generative Models

【MIT】生成模型提出的分子的可合成性，48页pdf,The Synthesizability of Molecules Proposed by Generative Models

专知会员服务

28+阅读 · 2020年2月20日

TensorFlow Lite指南实战《TensorFlow Lite A primer》，附48页PPT

TensorFlow Lite指南实战《TensorFlow Lite A primer》，附48页PPT

专知会员服务

70+阅读 · 2020年1月17日

热门VIP内容

开通专知VIP会员享更多权益服务

《面向大语言模型引导规划、Bandit算法驱动探索与多智能体导航的分层决策问题研究》180页

《反无人机蜂群技术研究：基于小队策略构建大规模无人机防御》

美国与以色列如何在攻击伊朗中使用人工智能

《自动化战略情报管控》

相关资讯

ChatGPT大模型如何做科学研究? CMU提出《大模型智能体系统》，高推理展现出大型语言模型的新兴自主科学研究能力

ChatGPT大模型如何做科学研究? CMU提出《大模型智能体系统》，高推理展现出大型语言模型的新兴自主科学研究能力

专知

17+阅读 · 2023年4月12日

最新《深度生成式模型进展》视频报告，43页ppt，斯坦福Aditya Grover

最新《深度生成式模型进展》视频报告，43页ppt，斯坦福Aditya Grover

专知

13+阅读 · 2020年8月9日

GAN新书《生成式深度学习》Generative Deep Learning，附379页全文PDF

GAN新书《生成式深度学习》Generative Deep Learning，附379页全文PDF

专知

96+阅读 · 2019年9月30日

这个项目火了！各种深度学习架构，模型和技巧的集合

这个项目火了！各种深度学习架构，模型和技巧的集合

大数据技术

14+阅读 · 2019年6月13日

集多种半监督学习范式为一体，谷歌新研究提出新型半监督方法 MixMatch

集多种半监督学习范式为一体，谷歌新研究提出新型半监督方法 MixMatch

机器之心

11+阅读 · 2019年6月3日

Keras作者推荐的Github项目，基于TensorFlow2的生成式模型合集

Keras作者推荐的Github项目，基于TensorFlow2的生成式模型合集

专知

15+阅读 · 2019年5月17日

【学界】极端图像压缩的生成对抗网络，可生成低码率的高质量图像

【学界】极端图像压缩的生成对抗网络，可生成低码率的高质量图像

GAN生成式对抗网络

10+阅读 · 2018年4月25日

推荐｜上交大推出Texygen：文本生成模型的基准测试平台

推荐｜上交大推出Texygen：文本生成模型的基准测试平台

全球人工智能

15+阅读 · 2018年2月8日

【论文】所见所想所真，对抗学习GAN提升跨模态检索效果！阿里巴巴AI Labs等团队最新工作

【论文】所见所想所真，对抗学习GAN提升跨模态检索效果！阿里巴巴AI Labs等团队最新工作

专知

12+阅读 · 2017年12月21日

在TensorFlow中对比两大生成模型：VAE与GAN

在TensorFlow中对比两大生成模型：VAE与GAN

机器之心

12+阅读 · 2017年10月23日

相关论文

Fourier Transformers for Latent Crystallographic Diffusion and Generative Modeling

Arxiv

0+阅读 · 2月12日

GENIUS: Generative Fluid Intelligence Evaluation Suite

Arxiv

0+阅读 · 2月11日

HypoBench: Towards Systematic and Principled Benchmarking for Hypothesis Generation

Arxiv

0+阅读 · 2月10日

GEBench: Benchmarking Image Generation Models as GUI Environments

Arxiv

0+阅读 · 2月10日

RxnBench: A Multimodal Benchmark for Evaluating Large Language Models on Chemical Reaction Understanding from Scientific Literature

Arxiv

0+阅读 · 1月28日

SpecBridge: Bridging Mass Spectrometry and Molecular Representations via Cross-Modal Alignment

Arxiv

0+阅读 · 1月23日

RxnBench: A Multimodal Benchmark for Evaluating Large Language Models on Chemical Reaction Understanding from Scientific Literature

Arxiv

0+阅读 · 1月20日

GraphBench: Next-generation graph learning benchmarking

Arxiv

0+阅读 · 1月18日

LaM-SLidE: Latent Space Modeling of Spatial Dynamical Systems via Linked Entities

Arxiv

0+阅读 · 1月15日

SlidesGen-Bench: Evaluating Slides Generation via Computational and Quantitative Metrics

Arxiv

0+阅读 · 1月14日

相关基金

功能导向晶态材料的结构设计和可控制备

国家自然科学基金

0+阅读 · 2017年6月30日

多功能自旋交叉分子晶体的设计与构筑

国家自然科学基金

0+阅读 · 2016年12月31日

高指数晶面结构贵金属纳米颗粒超晶格的模板辅助自组装与光学性能

国家自然科学基金

0+阅读 · 2015年12月31日

基于磁性金属有机骨架材料的低丰度蛋白/肽段高效选择分离分析新方法研究

国家自然科学基金

0+阅读 · 2015年12月31日

结合同步辐射实验和第一性原理的理论对半晶化过程中的晶体结构,电子结构和热力学性质进行研究

国家自然科学基金

0+阅读 · 2015年12月31日

金属有机框架（MOFs）材料的构筑、纳米化及光学性能研究

国家自然科学基金

0+阅读 · 2015年12月31日

力-磁-热循环载荷作用下Ni-Mn-Ga单晶材料变形理论及机理

国家自然科学基金

0+阅读 · 2015年12月31日

基于磁性金属的多组元复合纳米晶的形成机制、界面结构及其磁学和光学特性研究

国家自然科学基金

0+阅读 · 2014年12月31日

M-B-O-X(M:碱金属或碱土金属；X：卤素）体系中非线性光学材料的探索与性能研究

国家自然科学基金

0+阅读 · 2014年12月31日

一维半导体异质纳米结构的瞬态光学特性及光传输调控研究

国家自然科学基金

0+阅读 · 2014年12月31日

微信扫码咨询专知VIP会员