EO-VAE: Towards A Multi-sensor Tokenizer for Earth Observation Data - 专知论文

会员服务 ·

0

变分自编码 · 传感 · 地球 · 传感器 · 多传感器 ·

EO-VAE: Towards A Multi-sensor Tokenizer for Earth Observation Data

翻译：EO-VAE：面向多传感器地球观测数据的标记化模型

Nils Lehmann,Yi Wang,Zhitong Xiong,Xiaoxiang Zhu

State-of-the-art generative image and video models rely heavily on tokenizers that compress high-dimensional inputs into more efficient latent representations. While this paradigm has revolutionized RGB generation, Earth observation (EO) data presents unique challenges due to diverse sensor specifications and variable spectral channels. We propose EO-VAE, a multi-sensor variational autoencoder designed to serve as a foundational tokenizer for the EO domain. Unlike prior approaches that train separate tokenizers for each modality, EO-VAE utilizes a single model to encode and reconstruct flexible channel combinations via dynamic hypernetworks. Our experiments on the TerraMesh dataset demonstrate that EO-VAE achieves superior reconstruction fidelity compared to the TerraMind tokenizers, establishing a robust baseline for latent generative modeling in remote sensing.

翻译：最先进的生成式图像与视频模型高度依赖于标记器，其将高维输入压缩为更高效的潜在表示。尽管这一范式已彻底改变了RGB图像生成领域，但地球观测数据因传感器规格多样与光谱通道可变而面临独特挑战。本文提出EO-VAE——一种专为地球观测领域设计的多传感器变分自编码器基础标记器。与先前为各模态单独训练标记器的方法不同，EO-VAE通过动态超网络，利用单一模型实现对灵活通道组合的编码与重建。在TerraMesh数据集上的实验表明，相较于TerraMind标记器，EO-VAE实现了更优的重建保真度，为遥感领域的潜在生成建模建立了稳健基准。

0

相关内容

变分自编码

变分自编码

遥感领域的智能体AI：基础理论、分类体系与新兴系统

遥感领域的智能体AI：基础理论、分类体系与新兴系统

专知会员服务

29+阅读 · 1月6日

《美陆军虚拟自主导航环境合成数据质量评估工具与技术分析》最新69页报告

《美陆军虚拟自主导航环境合成数据质量评估工具与技术分析》最新69页报告

专知会员服务

27+阅读 · 2025年6月3日

《遥感基础模型研究综述：从视觉到多模态的演进》

《遥感基础模型研究综述：从视觉到多模态的演进》

专知会员服务

18+阅读 · 2025年3月31日

跨多种数据模态的视觉目标跟踪：综述

跨多种数据模态的视觉目标跟踪：综述

专知会员服务

30+阅读 · 2024年12月16日

大模型如何用于遥感？最新《用于遥感与地球观测的基础模型》综述

大模型如何用于遥感？最新《用于遥感与地球观测的基础模型》综述

专知会员服务

34+阅读 · 2024年10月25日

多模态遥感图像配准方法研究综述

多模态遥感图像配准方法研究综述

专知会员服务

19+阅读 · 2024年7月20日

《面向视觉语言地理基础模型》综述

《面向视觉语言地理基础模型》综述

专知会员服务

47+阅读 · 2024年6月15日

中科院空天院等最新《基于深度学习的多模态遥感数据融合》综述论文

中科院空天院等最新《基于深度学习的多模态遥感数据融合》综述论文

专知会员服务

136+阅读 · 2022年5月7日

【NUS-Xavier教授】生成模型VAE与GAN，69页ppt

【NUS-Xavier教授】生成模型VAE与GAN，69页ppt

专知会员服务

75+阅读 · 2022年4月6日

【清华大学】诊断和增强VAE模型，Diagnosing and Enhancing VAE Models

【清华大学】诊断和增强VAE模型，Diagnosing and Enhancing VAE Models

专知会员服务

37+阅读 · 2020年2月27日

《变分自编码器（VAE）导论》93页书册，附PDF下载

《变分自编码器（VAE）导论》93页书册，附PDF下载

专知

61+阅读 · 2019年6月14日

变分自编码器VAE：一步到位的聚类方案

变分自编码器VAE：一步到位的聚类方案

PaperWeekly

25+阅读 · 2018年9月18日

CMU大学76页深度学习课程：变分自编码器（VAE, Variational Autoencoder）

CMU大学76页深度学习课程：变分自编码器（VAE, Variational Autoencoder）

专知

28+阅读 · 2018年8月15日

【论文笔记】对话模型新方法，条件DialogWAE生成多模态回答

【论文笔记】对话模型新方法，条件DialogWAE生成多模态回答

专知

15+阅读 · 2018年6月11日

变分自编码器VAE：原来是这么一回事 | 附开源代码

变分自编码器VAE：原来是这么一回事 | 附开源代码

PaperWeekly

12+阅读 · 2018年3月23日

深度 | 变分自编码器VAE面临的挑战与发展方向

深度 | 变分自编码器VAE面临的挑战与发展方向

机器之心

16+阅读 · 2018年3月21日

在TensorFlow中对比两大生成模型：VAE与GAN

在TensorFlow中对比两大生成模型：VAE与GAN

机器之心

12+阅读 · 2017年10月23日

VAE、GAN、Info-GAN：全解深度学习三大生成模型

VAE、GAN、Info-GAN：全解深度学习三大生成模型

数据派THU

20+阅读 · 2017年9月23日

多图对比看懂GAN与VAE的各种变体|附论文

多图对比看懂GAN与VAE的各种变体|附论文

量子位

13+阅读 · 2017年9月5日

视觉里程计：起源、优势、对比、应用

视觉里程计：起源、优势、对比、应用

计算机视觉life

18+阅读 · 2017年7月17日

多源信息融合的地外天体表面巡视定位方法研究

国家自然科学基金

0+阅读 · 2017年12月31日

基于多元互信息和快速稀疏多核学习的高光谱遥感影像地物分类

国家自然科学基金

0+阅读 · 2015年12月31日

基于对象模型与多点空间统计的高分辨率遥感影像分类策略

国家自然科学基金

4+阅读 · 2015年12月31日

GEO-UAV 双基SAR成像模型与处理方法研究

国家自然科学基金

0+阅读 · 2015年12月31日

基于尺度集的高分辨率遥感影像多尺度分类

国家自然科学基金

0+阅读 · 2015年12月31日

基于DOAS方法的对流层SO2地基星载联合遥感反演研究

国家自然科学基金

0+阅读 · 2015年12月31日

多特征融合与集成学习的城市高分辨率遥感影像变化检测

国家自然科学基金

4+阅读 · 2014年12月31日

形状先验和数据驱动的高分辨遥感影像目标提取

国家自然科学基金

3+阅读 · 2014年12月31日

面向时空变化的GIS数据模型

国家自然科学基金

6+阅读 · 2014年12月31日

语义关联的地理视频数据自适应组织方法

国家自然科学基金

1+阅读 · 2014年12月31日

COP-GEN: Latent Diffusion Transformer for Copernicus Earth Observation Data -- Generation Stochastic by Design

Arxiv

0+阅读 · 3月3日

ReSearch: A Multi-Stage Machine Learning Framework for Earth Science Data Discovery

Arxiv

0+阅读 · 3月2日

EW-DETR: Evolving World Object Detection via Incremental Low-Rank DEtection TRansformer

Arxiv

0+阅读 · 2月24日

EgoScale: Scaling Dexterous Manipulation with Diverse Egocentric Human Data

Arxiv

0+阅读 · 2月18日

OmniEarth-Bench: Towards Holistic Evaluation of Earth's Six Spheres and Cross-Spheres Interactions with Multimodal Observational Earth Data

Arxiv

0+阅读 · 2月15日

OrbitChain: Orchestrating In-orbit Real-time Analytics of Earth Observation Data

Arxiv

0+阅读 · 2月10日

VAO: Validation-Aligned Optimization for Cross-Task Generative Auto-Bidding

Arxiv

0+阅读 · 2月5日

CTTVAE: Latent Space Structuring for Conditional Tabular Data Generation on Imbalanced Datasets

Arxiv

0+阅读 · 2月3日

Thalia: A Global, Multi-Modal Dataset for Volcanic Activity Monitoring

Arxiv

0+阅读 · 2月3日

GEO-Bench-2: From Performance to Capability, Rethinking Evaluation in Geospatial AI

Arxiv

0+阅读 · 2月2日

VIP会员

文章信息

相关主题

变分自编码

最新内容

无人机自主控制与人工智能：系统性综述

无人机自主控制与人工智能：系统性综述

专知会员服务

2+阅读 · 今天7:25

巡飞弹与反无人机系统——现代战场的两大支柱

巡飞弹与反无人机系统——现代战场的两大支柱

专知会员服务

1+阅读 · 今天6:54

《打造“黄金舰队”》57页报告

《打造“黄金舰队”》57页报告

专知会员服务

1+阅读 · 今天6:52

《北约数字教官网络发展路径》128页报告

《北约数字教官网络发展路径》128页报告

专知会员服务

1+阅读 · 今天6:33

ECCV 2026 | MIMFlow：MIM与归一化流统一图像生成

ECCV 2026 | MIMFlow：MIM与归一化流统一图像生成

专知会员服务

6+阅读 · 6月25日

超越自回归边界：扩散模型、世界模型与SSM如何重塑代码智能

超越自回归边界：扩散模型、世界模型与SSM如何重塑代码智能

专知会员服务

5+阅读 · 6月25日

重塑决策优势：美军作战艺术与多域作战中联盟联合全域指挥控制（CJADC2）体系的融合

重塑决策优势：美军作战艺术与多域作战中联盟联合全域指挥控制（CJADC2）体系的融合

专知会员服务

8+阅读 · 6月25日

网状网络及其在军事领域的运用

网状网络及其在军事领域的运用

专知会员服务

7+阅读 · 6月25日

《意识即战场——全球安全体系中认知战的演进：乌克兰构建认知作战体系的展望》

《意识即战场——全球安全体系中认知战的演进：乌克兰构建认知作战体系的展望》

专知会员服务

8+阅读 · 6月25日

无美国参与的欧洲战争方式（万字长文）

无美国参与的欧洲战争方式（万字长文）

专知会员服务

8+阅读 · 6月25日

重构“下一场战争”的制胜理论：超越兰彻斯特方程与现代系统

重构“下一场战争”的制胜理论：超越兰彻斯特方程与现代系统

专知会员服务

9+阅读 · 6月25日

《国防工业中基于模型定义的实施：产品定义数字化转型的战略路径》90页

《国防工业中基于模型定义的实施：产品定义数字化转型的战略路径》90页

专知会员服务

9+阅读 · 6月25日

《国防领域敏感性分析白皮书》

《国防领域敏感性分析白皮书》

专知会员服务

9+阅读 · 6月25日

综述 | 从问答到任务完成：Agent系统与Harness设计

综述 | 从问答到任务完成：Agent系统与Harness设计

专知会员服务

9+阅读 · 6月24日

Agentic RL：框架、实践与长程智能体训练

Agentic RL：框架、实践与长程智能体训练

专知会员服务

10+阅读 · 6月24日

相关VIP内容

遥感领域的智能体AI：基础理论、分类体系与新兴系统

遥感领域的智能体AI：基础理论、分类体系与新兴系统

专知会员服务

29+阅读 · 1月6日

《美陆军虚拟自主导航环境合成数据质量评估工具与技术分析》最新69页报告

《美陆军虚拟自主导航环境合成数据质量评估工具与技术分析》最新69页报告

专知会员服务

27+阅读 · 2025年6月3日

《遥感基础模型研究综述：从视觉到多模态的演进》

《遥感基础模型研究综述：从视觉到多模态的演进》

专知会员服务

18+阅读 · 2025年3月31日

跨多种数据模态的视觉目标跟踪：综述

跨多种数据模态的视觉目标跟踪：综述

专知会员服务

30+阅读 · 2024年12月16日

大模型如何用于遥感？最新《用于遥感与地球观测的基础模型》综述

大模型如何用于遥感？最新《用于遥感与地球观测的基础模型》综述

专知会员服务

34+阅读 · 2024年10月25日

多模态遥感图像配准方法研究综述

多模态遥感图像配准方法研究综述

专知会员服务

19+阅读 · 2024年7月20日

《面向视觉语言地理基础模型》综述

《面向视觉语言地理基础模型》综述

专知会员服务

47+阅读 · 2024年6月15日

中科院空天院等最新《基于深度学习的多模态遥感数据融合》综述论文

中科院空天院等最新《基于深度学习的多模态遥感数据融合》综述论文

专知会员服务

136+阅读 · 2022年5月7日

【NUS-Xavier教授】生成模型VAE与GAN，69页ppt

【NUS-Xavier教授】生成模型VAE与GAN，69页ppt

专知会员服务

75+阅读 · 2022年4月6日

【清华大学】诊断和增强VAE模型，Diagnosing and Enhancing VAE Models

【清华大学】诊断和增强VAE模型，Diagnosing and Enhancing VAE Models

专知会员服务

37+阅读 · 2020年2月27日

热门VIP内容

开通专知VIP会员享更多权益服务

巡飞弹与反无人机系统——现代战场的两大支柱

《北约数字教官网络发展路径》128页报告

无人机自主控制与人工智能：系统性综述

《打造“黄金舰队”》57页报告

相关资讯

《变分自编码器（VAE）导论》93页书册，附PDF下载

《变分自编码器（VAE）导论》93页书册，附PDF下载

专知

61+阅读 · 2019年6月14日

变分自编码器VAE：一步到位的聚类方案

变分自编码器VAE：一步到位的聚类方案

PaperWeekly

25+阅读 · 2018年9月18日

CMU大学76页深度学习课程：变分自编码器（VAE, Variational Autoencoder）

CMU大学76页深度学习课程：变分自编码器（VAE, Variational Autoencoder）

专知

28+阅读 · 2018年8月15日

【论文笔记】对话模型新方法，条件DialogWAE生成多模态回答

【论文笔记】对话模型新方法，条件DialogWAE生成多模态回答

专知

15+阅读 · 2018年6月11日

变分自编码器VAE：原来是这么一回事 | 附开源代码

变分自编码器VAE：原来是这么一回事 | 附开源代码

PaperWeekly

12+阅读 · 2018年3月23日

深度 | 变分自编码器VAE面临的挑战与发展方向

深度 | 变分自编码器VAE面临的挑战与发展方向

机器之心

16+阅读 · 2018年3月21日

在TensorFlow中对比两大生成模型：VAE与GAN

在TensorFlow中对比两大生成模型：VAE与GAN

机器之心

12+阅读 · 2017年10月23日

VAE、GAN、Info-GAN：全解深度学习三大生成模型

VAE、GAN、Info-GAN：全解深度学习三大生成模型

数据派THU

20+阅读 · 2017年9月23日

多图对比看懂GAN与VAE的各种变体|附论文

多图对比看懂GAN与VAE的各种变体|附论文

量子位

13+阅读 · 2017年9月5日

视觉里程计：起源、优势、对比、应用

视觉里程计：起源、优势、对比、应用

计算机视觉life

18+阅读 · 2017年7月17日

相关论文

COP-GEN: Latent Diffusion Transformer for Copernicus Earth Observation Data -- Generation Stochastic by Design

Arxiv

0+阅读 · 3月3日

ReSearch: A Multi-Stage Machine Learning Framework for Earth Science Data Discovery

Arxiv

0+阅读 · 3月2日

EW-DETR: Evolving World Object Detection via Incremental Low-Rank DEtection TRansformer

Arxiv

0+阅读 · 2月24日

EgoScale: Scaling Dexterous Manipulation with Diverse Egocentric Human Data

Arxiv

0+阅读 · 2月18日

OmniEarth-Bench: Towards Holistic Evaluation of Earth's Six Spheres and Cross-Spheres Interactions with Multimodal Observational Earth Data

Arxiv

0+阅读 · 2月15日

OrbitChain: Orchestrating In-orbit Real-time Analytics of Earth Observation Data

Arxiv

0+阅读 · 2月10日

VAO: Validation-Aligned Optimization for Cross-Task Generative Auto-Bidding

Arxiv

0+阅读 · 2月5日

CTTVAE: Latent Space Structuring for Conditional Tabular Data Generation on Imbalanced Datasets

Arxiv

0+阅读 · 2月3日

Thalia: A Global, Multi-Modal Dataset for Volcanic Activity Monitoring

Arxiv

0+阅读 · 2月3日

GEO-Bench-2: From Performance to Capability, Rethinking Evaluation in Geospatial AI

Arxiv

0+阅读 · 2月2日

相关基金

多源信息融合的地外天体表面巡视定位方法研究

国家自然科学基金

0+阅读 · 2017年12月31日

基于多元互信息和快速稀疏多核学习的高光谱遥感影像地物分类

国家自然科学基金

0+阅读 · 2015年12月31日

基于对象模型与多点空间统计的高分辨率遥感影像分类策略

国家自然科学基金

4+阅读 · 2015年12月31日

GEO-UAV 双基SAR成像模型与处理方法研究

国家自然科学基金

0+阅读 · 2015年12月31日

基于尺度集的高分辨率遥感影像多尺度分类

国家自然科学基金

0+阅读 · 2015年12月31日

基于DOAS方法的对流层SO2地基星载联合遥感反演研究

国家自然科学基金

0+阅读 · 2015年12月31日

多特征融合与集成学习的城市高分辨率遥感影像变化检测

国家自然科学基金

4+阅读 · 2014年12月31日

形状先验和数据驱动的高分辨遥感影像目标提取

国家自然科学基金

3+阅读 · 2014年12月31日

面向时空变化的GIS数据模型

国家自然科学基金

6+阅读 · 2014年12月31日

语义关联的地理视频数据自适应组织方法

国家自然科学基金

1+阅读 · 2014年12月31日

微信扫码咨询专知VIP会员