Motif Diversity in Human Liver ChIP-seq Data Using MAP-Elites - 专知论文

会员服务 ·

0

多样性 · ChIP-Seq · 生物 · 算法 · 分析 ·

Motif Diversity in Human Liver ChIP-seq Data Using MAP-Elites

翻译：基于MAP-Elites算法的人类肝脏ChIP-seq数据基序多样性分析

Alejandro Medina,Mary Lauren Benton

from arxiv, Under review for a conference companion paper

Motif discovery is a core problem in computational biology, traditionally formulated as a likelihood optimization task that returns a single dominant motif from a DNA sequence dataset. However, regulatory sequence data admit multiple plausible motif explanations, reflecting underlying biological heterogeneity. In this work, we frame motif discovery as a quality-diversity problem and apply the MAP-Elites algorithm to evolve position weight matrix motifs under a likelihood-based fitness objective while explicitly preserving diversity across biologically meaningful dimensions. We evaluate MAP-Elites using three complementary behavioral characterizations that capture trade-offs between motif specificity, compositional structure, coverage, and robustness. Experiments on human CTCF liver ChIP-seq data aligned to the human reference genome compare MAP-Elites against a standard motif discovery tool, MEME, under matched evaluation criteria across stratified dataset subsets. Results show that MAP-Elites recovers multiple high-quality motif variants with fitness comparable to MEME's strongest solutions while revealing structured diversity obscured by single-solution approaches.

翻译：基序发现是计算生物学中的一个核心问题，传统上被表述为一种似然优化任务，旨在从DNA序列数据集中返回单个主导基序。然而，调控序列数据允许多种合理的基序解释，这反映了潜在的生物学异质性。在本工作中，我们将基序发现构建为一个质量-多样性优化问题，并应用MAP-Elites算法，在基于似然的适应度目标下进化位置权重矩阵基序，同时明确地在具有生物学意义的维度上保持多样性。我们使用三种互补的行为特征来评估MAP-Elites，这些特征捕捉了基序特异性、组成结构、覆盖度和鲁棒性之间的权衡。在人类CTCF肝脏ChIP-seq数据（比对至人类参考基因组）上的实验，将MAP-Elites与标准基序发现工具MEME进行了比较，评估基于分层数据集子集在匹配的评估标准下进行。结果表明，MAP-Elites能够恢复多种高质量基序变体，其适应度与MEME的最优解相当，同时揭示了被单解方法所掩盖的结构化多样性。

0

相关内容

多样性

【博士论文】通过新算法与技术实现快速、准确、高效的实时基因组分析

【博士论文】通过新算法与技术实现快速、准确、高效的实时基因组分析

专知会员服务

11+阅读 · 2025年3月13日

【CMU博士论文】统计基因网络研究进展

【CMU博士论文】统计基因网络研究进展

专知会员服务

17+阅读 · 2023年10月4日

深度学习在人类基因组学中的应用：下一代测序数据的综述

深度学习在人类基因组学中的应用：下一代测序数据的综述

专知会员服务

17+阅读 · 2023年9月2日

【干货书】计算基因组学，463页pdf

【干货书】计算基因组学，463页pdf

专知会员服务

48+阅读 · 2022年12月30日

【MIT-Krismer Konstantin博士论文】基于功能基因组学的深度学习原理方法与模型，Principled Methods and Models for Deep Learning Based Functional Genomics

【MIT-Krismer Konstantin博士论文】基于功能基因组学的深度学习原理方法与模型，Principled Methods and Models for Deep Learning Based Functional Genomics

专知会员服务

10+阅读 · 2022年4月6日

最新《深度学习序列标记》综述论文，16页pdf134篇参考文献

最新《深度学习序列标记》综述论文，16页pdf134篇参考文献

专知会员服务

41+阅读 · 2020年11月18日

【Java实现遗传算法】162页pdf，Genetic Algorithms in Java Basics

【Java实现遗传算法】162页pdf，Genetic Algorithms in Java Basics

专知会员服务

44+阅读 · 2020年7月19日

【论文强烈推荐】基于卷积神经网络的基因组序列基序的表示学习，Representation learning of genomic sequence motifs with convolutional neural networks

【论文强烈推荐】基于卷积神经网络的基因组序列基序的表示学习，Representation learning of genomic sequence motifs with convolutional neural networks

专知会员服务

12+阅读 · 2019年12月21日

【图机器学习论文】基于深度学习的网络生物学（Deep Learning for Network Biology）

【图机器学习论文】基于深度学习的网络生物学（Deep Learning for Network Biology）

专知会员服务

11+阅读 · 2019年12月16日

【ECML-PKDD 2019】可解释序列分类的背景知识注入（Background Knowledge Injection forInterpretable Sequence Classification）

【ECML-PKDD 2019】可解释序列分类的背景知识注入（Background Knowledge Injection forInterpretable Sequence Classification）

专知会员服务

15+阅读 · 2019年12月3日

【佐治亚理工博士论文】基于策略智能体和有限反馈的序列决策，211页pdf

【佐治亚理工博士论文】基于策略智能体和有限反馈的序列决策，211页pdf

专知

38+阅读 · 2023年4月13日

阿尔伯塔大学博士毕业论文：基于图结构的自然语言处理

阿尔伯塔大学博士毕业论文：基于图结构的自然语言处理

机器之心

15+阅读 · 2020年3月25日

最新最权威《深度学习显著目标检测综述》论文代码数据发布，带你全面了解显著目标检测方法

最新最权威《深度学习显著目标检测综述》论文代码数据发布，带你全面了解显著目标检测方法

专知

79+阅读 · 2019年4月24日

【泡泡图灵智库】MapNet：一种便于动态更新的全局地图存储方法（CVPR）

【泡泡图灵智库】MapNet：一种便于动态更新的全局地图存储方法（CVPR）

泡泡机器人SLAM

11+阅读 · 2018年12月10日

干货 | 基于深度学习的目标检测算法综述

干货 | 基于深度学习的目标检测算法综述

AI科技评论

18+阅读 · 2018年9月1日

博客 | 基于深度学习的目标检测算法综述（二）

博客 | 基于深度学习的目标检测算法综述（二）

AI研习社

11+阅读 · 2018年8月22日

干货 | 基于深度学习的目标检测算法综述（二）

干货 | 基于深度学习的目标检测算法综述（二）

AI科技评论

21+阅读 · 2018年8月20日

干货：基于用户画像的聚类分析

干货：基于用户画像的聚类分析

数据分析

22+阅读 · 2018年5月17日

从传统方法到深度学习，人脸关键点检测方法综述

从传统方法到深度学习，人脸关键点检测方法综述

机器之心

14+阅读 · 2017年12月17日

GAFT：一个使用 Python 实现的遗传算法框架

GAFT：一个使用 Python 实现的遗传算法框架

Python开发者

10+阅读 · 2017年8月1日

微进化机制中群体基因组数据分析的新方法研究

国家自然科学基金

0+阅读 · 2016年12月31日

基于图论方法的DNA序列编码研究

国家自然科学基金

2+阅读 · 2016年12月31日

基于深度学习与超CpG分割的人类全基因组差异甲基化研究

国家自然科学基金

0+阅读 · 2015年12月31日

生物序列大数据集模体发现算法的研究

国家自然科学基金

0+阅读 · 2015年12月31日

基于多生物网络的蛋白质功能预测算法研究

国家自然科学基金

1+阅读 · 2015年12月31日

高通量测序的可计算建模与应用基础算法

国家自然科学基金

1+阅读 · 2015年12月31日

多重排序数据的整合分析

国家自然科学基金

0+阅读 · 2015年12月31日

多源基因表达数据横向整合的统计方法比较

国家自然科学基金

0+阅读 · 2015年12月31日

面向蛋白质分子位点标记的多源特征提取和深度序列学习方法研究

国家自然科学基金

3+阅读 · 2014年12月31日

面向进化基因组学的高通量测序数据流形建模

国家自然科学基金

1+阅读 · 2014年12月31日

INQUIRE-Search: Interactive Discovery in Large-Scale Biodiversity Databases

Arxiv

0+阅读 · 2月17日

Discrete Gene Crossover Accelerates Solution Discovery in Quality-Diversity Algorithms

Arxiv

0+阅读 · 2月14日

Complexity of Sequence-to-Graph Alignment with Co-Linear Chaining

Arxiv

0+阅读 · 2月13日

Sparse group principal component analysis via double thresholding with application to multi-cellular programs

Arxiv

0+阅读 · 2月4日

Preference-Conditioned Gradient Variations for Multi-Objective Quality-Diversity

Arxiv

0+阅读 · 2月2日

Transforming Datasets to Requested Complexity with Projection-based Many-Objective Genetic Algorithm

Arxiv

0+阅读 · 1月29日

SAGe: A Lightweight Algorithm-Architecture Co-Design for Mitigating the Data Preparation Bottleneck in Large-Scale Genome Sequence Analysis

Arxiv

0+阅读 · 1月22日

GENERator: A Long-Context Generative Genomic Foundation Model

Arxiv

0+阅读 · 1月22日

Graphical model-based clustering of categorical data

Arxiv

0+阅读 · 1月21日

Analysis of a Random Local Search Algorithm for Dominating Set

Arxiv

0+阅读 · 1月17日

VIP会员

文章信息

相关主题

最新内容

综述 | 世界动作模型：少做梦，多行动

综述 | 世界动作模型：少做梦，多行动

专知会员服务

0+阅读 · 10分钟前

美以伊冲突：无人机与人工智能的运用

美以伊冲突：无人机与人工智能的运用

专知会员服务

1+阅读 · 22分钟前

《战时图神经网络：整合以色列-伊朗冲突中的网络安全与无人机智能》最新50页文献

《战时图神经网络：整合以色列-伊朗冲突中的网络安全与无人机智能》最新50页文献

专知会员服务

1+阅读 · 33分钟前

《特种部队在透明战场中的生存力》最新报告

《特种部队在透明战场中的生存力》最新报告

专知会员服务

1+阅读 · 42分钟前

《自主无人机蜂群协同与控制系统：人工智能赋能的战场协同与自主任务编排平台》

《自主无人机蜂群协同与控制系统：人工智能赋能的战场协同与自主任务编排平台》

专知会员服务

1+阅读 · 46分钟前

《人工智能生成的零日漏洞：对未来作战的影响》

《人工智能生成的零日漏洞：对未来作战的影响》

专知会员服务

1+阅读 · 50分钟前

《理解伙伴国在防务能力选择中的偏好：探索美国解决方案的替代选择》美智库200页报告

《理解伙伴国在防务能力选择中的偏好：探索美国解决方案的替代选择》美智库200页报告

专知会员服务

1+阅读 · 54分钟前

ICML 2026 | 边界嵌入塑形：用自适应对比学习破解图结构纠缠

ICML 2026 | 边界嵌入塑形：用自适应对比学习破解图结构纠缠

专知会员服务

5+阅读 · 6月22日

综述 | 3D场景图：开放挑战与未来方向

综述 | 3D场景图：开放挑战与未来方向

专知会员服务

8+阅读 · 6月22日

《国防工业6.0：全自主作战系统、量子-人工智能融合与新一代战略威慑》

《国防工业6.0：全自主作战系统、量子-人工智能融合与新一代战略威慑》

专知会员服务

6+阅读 · 6月22日

21世纪的无人机战争

21世纪的无人机战争

专知会员服务

4+阅读 · 6月22日

《伊朗与以色列-美国热战及其对数字技术的影响》

《伊朗与以色列-美国热战及其对数字技术的影响》

专知会员服务

5+阅读 · 6月22日

《量子技术的军事任务技术适配与利用》

《量子技术的军事任务技术适配与利用》

专知会员服务

5+阅读 · 6月22日

《美国陆军军官学校（西点军校）本科生科研中生成式人工智能的使用》

《美国陆军军官学校（西点军校）本科生科研中生成式人工智能的使用》

专知会员服务

8+阅读 · 6月22日

美国从乌克兰无人机战争中学习经验

美国从乌克兰无人机战争中学习经验

专知会员服务

7+阅读 · 6月21日

相关VIP内容

【博士论文】通过新算法与技术实现快速、准确、高效的实时基因组分析

【博士论文】通过新算法与技术实现快速、准确、高效的实时基因组分析

专知会员服务

11+阅读 · 2025年3月13日

【CMU博士论文】统计基因网络研究进展

【CMU博士论文】统计基因网络研究进展

专知会员服务

17+阅读 · 2023年10月4日

深度学习在人类基因组学中的应用：下一代测序数据的综述

深度学习在人类基因组学中的应用：下一代测序数据的综述

专知会员服务

17+阅读 · 2023年9月2日

【干货书】计算基因组学，463页pdf

【干货书】计算基因组学，463页pdf

专知会员服务

48+阅读 · 2022年12月30日

【MIT-Krismer Konstantin博士论文】基于功能基因组学的深度学习原理方法与模型，Principled Methods and Models for Deep Learning Based Functional Genomics

【MIT-Krismer Konstantin博士论文】基于功能基因组学的深度学习原理方法与模型，Principled Methods and Models for Deep Learning Based Functional Genomics

专知会员服务

10+阅读 · 2022年4月6日

最新《深度学习序列标记》综述论文，16页pdf134篇参考文献

最新《深度学习序列标记》综述论文，16页pdf134篇参考文献

专知会员服务

41+阅读 · 2020年11月18日

【Java实现遗传算法】162页pdf，Genetic Algorithms in Java Basics

【Java实现遗传算法】162页pdf，Genetic Algorithms in Java Basics

专知会员服务

44+阅读 · 2020年7月19日

【论文强烈推荐】基于卷积神经网络的基因组序列基序的表示学习，Representation learning of genomic sequence motifs with convolutional neural networks

【论文强烈推荐】基于卷积神经网络的基因组序列基序的表示学习，Representation learning of genomic sequence motifs with convolutional neural networks

专知会员服务

12+阅读 · 2019年12月21日

【图机器学习论文】基于深度学习的网络生物学（Deep Learning for Network Biology）

【图机器学习论文】基于深度学习的网络生物学（Deep Learning for Network Biology）

专知会员服务

11+阅读 · 2019年12月16日

【ECML-PKDD 2019】可解释序列分类的背景知识注入（Background Knowledge Injection forInterpretable Sequence Classification）

【ECML-PKDD 2019】可解释序列分类的背景知识注入（Background Knowledge Injection forInterpretable Sequence Classification）

专知会员服务

15+阅读 · 2019年12月3日

热门VIP内容

开通专知VIP会员享更多权益服务

《战时图神经网络：整合以色列-伊朗冲突中的网络安全与无人机智能》最新50页文献

《自主无人机蜂群协同与控制系统：人工智能赋能的战场协同与自主任务编排平台》

美以伊冲突：无人机与人工智能的运用

《特种部队在透明战场中的生存力》最新报告

相关资讯

【佐治亚理工博士论文】基于策略智能体和有限反馈的序列决策，211页pdf

【佐治亚理工博士论文】基于策略智能体和有限反馈的序列决策，211页pdf

专知

38+阅读 · 2023年4月13日

阿尔伯塔大学博士毕业论文：基于图结构的自然语言处理

阿尔伯塔大学博士毕业论文：基于图结构的自然语言处理

机器之心

15+阅读 · 2020年3月25日

最新最权威《深度学习显著目标检测综述》论文代码数据发布，带你全面了解显著目标检测方法

最新最权威《深度学习显著目标检测综述》论文代码数据发布，带你全面了解显著目标检测方法

专知

79+阅读 · 2019年4月24日

【泡泡图灵智库】MapNet：一种便于动态更新的全局地图存储方法（CVPR）

【泡泡图灵智库】MapNet：一种便于动态更新的全局地图存储方法（CVPR）

泡泡机器人SLAM

11+阅读 · 2018年12月10日

干货 | 基于深度学习的目标检测算法综述

干货 | 基于深度学习的目标检测算法综述

AI科技评论

18+阅读 · 2018年9月1日

博客 | 基于深度学习的目标检测算法综述（二）

博客 | 基于深度学习的目标检测算法综述（二）

AI研习社

11+阅读 · 2018年8月22日

干货 | 基于深度学习的目标检测算法综述（二）

干货 | 基于深度学习的目标检测算法综述（二）

AI科技评论

21+阅读 · 2018年8月20日

干货：基于用户画像的聚类分析

干货：基于用户画像的聚类分析

数据分析

22+阅读 · 2018年5月17日

从传统方法到深度学习，人脸关键点检测方法综述

从传统方法到深度学习，人脸关键点检测方法综述

机器之心

14+阅读 · 2017年12月17日

GAFT：一个使用 Python 实现的遗传算法框架

GAFT：一个使用 Python 实现的遗传算法框架

Python开发者

10+阅读 · 2017年8月1日

相关论文

INQUIRE-Search: Interactive Discovery in Large-Scale Biodiversity Databases

Arxiv

0+阅读 · 2月17日

Discrete Gene Crossover Accelerates Solution Discovery in Quality-Diversity Algorithms

Arxiv

0+阅读 · 2月14日

Complexity of Sequence-to-Graph Alignment with Co-Linear Chaining

Arxiv

0+阅读 · 2月13日

Sparse group principal component analysis via double thresholding with application to multi-cellular programs

Arxiv

0+阅读 · 2月4日

Preference-Conditioned Gradient Variations for Multi-Objective Quality-Diversity

Arxiv

0+阅读 · 2月2日

Transforming Datasets to Requested Complexity with Projection-based Many-Objective Genetic Algorithm

Arxiv

0+阅读 · 1月29日

SAGe: A Lightweight Algorithm-Architecture Co-Design for Mitigating the Data Preparation Bottleneck in Large-Scale Genome Sequence Analysis

Arxiv

0+阅读 · 1月22日

GENERator: A Long-Context Generative Genomic Foundation Model

Arxiv

0+阅读 · 1月22日

Graphical model-based clustering of categorical data

Arxiv

0+阅读 · 1月21日

Analysis of a Random Local Search Algorithm for Dominating Set

Arxiv

0+阅读 · 1月17日

相关基金

微进化机制中群体基因组数据分析的新方法研究

国家自然科学基金

0+阅读 · 2016年12月31日

基于图论方法的DNA序列编码研究

国家自然科学基金

2+阅读 · 2016年12月31日

基于深度学习与超CpG分割的人类全基因组差异甲基化研究

国家自然科学基金

0+阅读 · 2015年12月31日

生物序列大数据集模体发现算法的研究

国家自然科学基金

0+阅读 · 2015年12月31日

基于多生物网络的蛋白质功能预测算法研究

国家自然科学基金

1+阅读 · 2015年12月31日

高通量测序的可计算建模与应用基础算法

国家自然科学基金

1+阅读 · 2015年12月31日

多重排序数据的整合分析

国家自然科学基金

0+阅读 · 2015年12月31日

多源基因表达数据横向整合的统计方法比较

国家自然科学基金

0+阅读 · 2015年12月31日

面向蛋白质分子位点标记的多源特征提取和深度序列学习方法研究

国家自然科学基金

3+阅读 · 2014年12月31日

面向进化基因组学的高通量测序数据流形建模

国家自然科学基金

1+阅读 · 2014年12月31日

微信扫码咨询专知VIP会员