HydroGEM: A Self Supervised Zero Shot Hybrid TCN Transformer Foundation Model for Continental Scale Streamflow Quality Control - 专知论文

会员服务 ·

0

质量控制 · 监督 · 样本 · 混合 · TCN ·

HydroGEM: A Self Supervised Zero Shot Hybrid TCN Transformer Foundation Model for Continental Scale Streamflow Quality Control

翻译：HydroGEM：一种用于大陆尺度径流质量控制的自我监督零样本混合TCN Transformer基础模型

Ijaz Ul Haq,Byung Suk Lee,Julia N. Perdrial,David Baude

from arxiv, Supplementary materials, datasets, and implementation code will be made publicly available upon acceptance for publication in a peer-reviewed journal

Real-time streamflow monitoring networks generate millions of observations annually, yet maintaining data quality across thousands of remote sensors remains labor-intensive. We introduce HydroGEM (Hydrological Generalizable Encoder for Monitoring), a foundation model for continental-scale streamflow quality control. HydroGEM uses two-stage training: self-supervised pretraining on 6.03 million sequences from 3,724 USGS stations learns hydrological representations, followed by fine-tuning with synthetic anomalies for detection and reconstruction. A hybrid TCN-Transformer architecture (14.2M parameters) captures local temporal patterns and long-range dependencies, while hierarchical normalization handles six orders of magnitude in discharge. On held-out synthetic tests comprising 799 stations with 18 expert-validated anomaly types, HydroGEM achieves F1 = 0.792 for detection and 68.7% reconstruction-error reduction, a 36.3% improvement over existing methods. Zero-shot transfer to 100 Environment and Climate Change Canada stations yields F1 = 0.586, exceeding all baselines and demonstrating cross-national generalization. The model maintains consistent detection across correction magnitudes and aligns with operational seasonal patterns. HydroGEM is designed for human-in-the-loop workflows - outputs are quality control suggestions requiring expert review, not autonomous corrections.

翻译：实时径流监测网络每年产生数百万条观测数据，然而在数千个远程传感器之间保持数据质量仍然是一项劳动密集型任务。我们提出了HydroGEM（水文通用监测编码器），一种用于大陆尺度径流质量控制的基础模型。HydroGEM采用两阶段训练：首先在来自3,724个美国地质调查局（USGS）站点的603万条序列上进行自监督预训练，以学习水文表征；随后使用合成异常数据进行微调，用于异常检测与重建。该模型采用混合TCN-Transformer架构（1420万参数），能够捕捉局部时间模式和长程依赖关系，同时通过分层归一化处理六个数量级的流量变化。在包含799个站点、18种专家验证异常类型的保留合成测试集上，HydroGEM实现了F1分数=0.792的检测性能，重建误差降低了68.7%，较现有方法提升36.3%。在100个加拿大环境与气候变化部（ECCC）站点上的零样本迁移测试获得F1分数=0.586，超越所有基线方法，展现了跨国泛化能力。该模型在不同校正幅度下保持稳定的检测性能，并与实际业务中的季节性规律相符。HydroGEM专为人机协同工作流设计——其输出为需要专家审核的质量控制建议，而非自主校正。

0

相关内容

质量控制

《用于水文建模应用的美国空军全球空陆天气开发模型数据流程：GALWEM采集系统v1.0与v2.0概述》最新报告

《用于水文建模应用的美国空军全球空陆天气开发模型数据流程：GALWEM采集系统v1.0与v2.0概述》最新报告

专知会员服务

16+阅读 · 2025年12月27日

大模型+自动驾驶=？普渡大学等最新《自动驾驶领域多模态大型语言模型》综述

大模型+自动驾驶=？普渡大学等最新《自动驾驶领域多模态大型语言模型》综述

专知会员服务

76+阅读 · 2023年11月27日

Meta-Transformer：多模态学习的统一框架

Meta-Transformer：多模态学习的统一框架

专知会员服务

59+阅读 · 2023年7月21日

《人类系统集成 (HSI) 度量贸易空间探索环境 (HMTee) 》美陆军研究实验室2022最新36页技术报告

《人类系统集成 (HSI) 度量贸易空间探索环境 (HMTee) 》美陆军研究实验室2022最新36页技术报告

专知会员服务

14+阅读 · 2022年12月12日

不可错过！首门《自监督学习统计模型》课程！霍普金斯Daniel Khashabi讲授

不可错过！首门《自监督学习统计模型》课程！霍普金斯Daniel Khashabi讲授

专知会员服务

24+阅读 · 2022年9月30日

中科院空天院等最新《基于深度学习的多模态遥感数据融合》综述论文

中科院空天院等最新《基于深度学习的多模态遥感数据融合》综述论文

专知会员服务

136+阅读 · 2022年5月7日

Nature. Mach. Intell. |军事科学院<基于图神经网络技术的转录因子调控网络建模>

Nature. Mach. Intell. |军事科学院<基于图神经网络技术的转录因子调控网络建模>

专知会员服务

12+阅读 · 2022年4月21日

【Google AI】多模态瓶颈Transformer(MBT):一种新的模态融合模型，Multimodal Bottleneck Transformer (MBT): A New Model for Modality Fusion

【Google AI】多模态瓶颈Transformer(MBT):一种新的模态融合模型，Multimodal Bottleneck Transformer (MBT): A New Model for Modality Fusion

专知会员服务

57+阅读 · 2022年3月20日

【Google】多模态Transformer视频检索，Multi-modal Transformer

【Google】多模态Transformer视频检索，Multi-modal Transformer

专知会员服务

103+阅读 · 2020年7月22日

网络流量监测与分析大数据综述，A Survey on Big Data for Network Traffic Monitoring and Analysis

网络流量监测与分析大数据综述，A Survey on Big Data for Network Traffic Monitoring and Analysis

专知会员服务

65+阅读 · 2020年3月5日

【Manning新书】MLOps工程规模化，344页pdf

【Manning新书】MLOps工程规模化，344页pdf

专知

24+阅读 · 2022年5月4日

【干货书】MLOps是什么？MLOps实战：操作机器学习模型，461页pdf

【干货书】MLOps是什么？MLOps实战：操作机器学习模型，461页pdf

专知

15+阅读 · 2022年2月16日

Transformer模型-深度学习自然语言处理，17页ppt

Transformer模型-深度学习自然语言处理，17页ppt

专知

14+阅读 · 2020年8月30日

最强NLP预训练模型库PyTorch-Transformers正式开源！支持6个预训练框架，27个预训练模型

最强NLP预训练模型库PyTorch-Transformers正式开源！支持6个预训练框架，27个预训练模型

AI前线

12+阅读 · 2019年7月22日

谷歌EfficientNet缩放模型，PyTorch实现登热榜

谷歌EfficientNet缩放模型，PyTorch实现登热榜

机器学习算法与Python学习

11+阅读 · 2019年6月4日

集多种半监督学习范式为一体，谷歌新研究提出新型半监督方法 MixMatch

集多种半监督学习范式为一体，谷歌新研究提出新型半监督方法 MixMatch

机器之心

11+阅读 · 2019年6月3日

加入Transformer-XL，这个PyTorch包能调用各种NLP预训练模型

加入Transformer-XL，这个PyTorch包能调用各种NLP预训练模型

机器之心

15+阅读 · 2019年2月13日

谷歌、CMU重磅论文：Transformer升级版，评估速度提升超1800倍！

谷歌、CMU重磅论文：Transformer升级版，评估速度提升超1800倍！

新智元

11+阅读 · 2019年1月12日

【泡泡图灵智库】HSfM: 混合运动恢复结构（CVPR）

【泡泡图灵智库】HSfM: 混合运动恢复结构（CVPR）

泡泡机器人SLAM

11+阅读 · 2018年12月13日

基于位置注意力机制模型和带标签数据来提升槽填充（EMNLP outstanding paper）

基于位置注意力机制模型和带标签数据来提升槽填充（EMNLP outstanding paper）

科技创新与创业

17+阅读 · 2017年11月17日

动态不确定性条件下基于混杂约束满足问题的水下移动传感器网络节点自定位方法研究

国家自然科学基金

3+阅读 · 2015年12月31日

基于多时相遥感影像的亚像元级地表水变化监测研究

国家自然科学基金

0+阅读 · 2015年12月31日

土壤湿度遥感产品时空无缝融合方法研究

国家自然科学基金

0+阅读 · 2015年12月31日

h型信息网络测度的机理与实证研究

国家自然科学基金

0+阅读 · 2015年12月31日

基于模型预测的AUV三维轨迹跟踪控制研究

国家自然科学基金

1+阅读 · 2015年12月31日

复杂流体下微弯型科氏质量流量计驱动控制、信号处理和误差修正方法研究与实现

国家自然科学基金

0+阅读 · 2015年12月31日

利用GPS观测资料反演高时空分辨率局部地表质量变化的方法研究

国家自然科学基金

0+阅读 · 2015年12月31日

卫星重力测量反演高精度高分辨率局部地表质量变化的方法研究

国家自然科学基金

0+阅读 · 2014年12月31日

基于多源遥感数据的陆地上空高时空分辨率大气水汽反演研究

国家自然科学基金

0+阅读 · 2014年12月31日

基于本体论的海洋流动场时空数据建模与可视化

国家自然科学基金

0+阅读 · 2014年12月31日

StefaLand: An Efficient Geoscience Foundation Model That Improves Dynamic Land-Surface Predictions

Arxiv

0+阅读 · 2月2日

Ocean Current-Harnessing Stage-Gated MPC: Monotone Cost Shaping and Speed-to-Fly for Energy-Efficient AUV Navigation

Arxiv

0+阅读 · 1月31日

StreamSense: Streaming Social Task Detection with Selective Vision-Language Model Routing

Arxiv

0+阅读 · 1月30日

HydroSense: A Dual-Microcontroller IoT Framework for Real-Time Multi-Parameter Water Quality Monitoring with Edge Processing and Cloud Analytics

Arxiv

0+阅读 · 1月29日

Hylog: A Hybrid Approach to Logging Text Production in Non-alphabetic Scripts

Arxiv

0+阅读 · 1月25日

THOR: A Versatile Foundation Model for Earth Observation Climate and Society Applications

Arxiv

0+阅读 · 1月22日

UniRoute: Unified Routing Mixture-of-Experts for Modality-Adaptive Remote Sensing Change Detection

Arxiv

0+阅读 · 1月21日

SynDroneVision: A Synthetic Dataset for Image-Based Drone Detection

Arxiv

0+阅读 · 1月8日

Utilizing Earth Foundation Models to Enhance the Simulation Performance of Hydrological Models with AlphaEarth Embeddings

Arxiv

0+阅读 · 1月4日

Traffic-MoE: A Sparse Foundation Model for Network Traffic Analysis

Arxiv

0+阅读 · 1月1日

VIP会员

文章信息

相关主题

最新内容

《将小型无人机系统与巡飞弹集成至连及以下级别战术机动》（美陆军最新报告中文版）

《将小型无人机系统与巡飞弹集成至连及以下级别战术机动》（美陆军最新报告中文版）

专知会员服务

1+阅读 · 49分钟前

加拿大国防部发布项目需求：用于高级态势决策的多模态人工智能

加拿大国防部发布项目需求：用于高级态势决策的多模态人工智能

专知会员服务

1+阅读 · 53分钟前

《无人机革命：来自俄乌战场的启示》（报告）

《无人机革命：来自俄乌战场的启示》（报告）

专知会员服务

2+阅读 · 59分钟前

《实现联合作战能力所需的技术》58页报告

《实现联合作战能力所需的技术》58页报告

专知会员服务

1+阅读 · 今天6:30

《算法化目标定位：人工智能在以色列加沙打击行动中的作用及其伦理影响》（中文版）

《算法化目标定位：人工智能在以色列加沙打击行动中的作用及其伦理影响》（中文版）

专知会员服务

1+阅读 · 今天6:22

以色列运用人工智能优化空袭警报系统

以色列运用人工智能优化空袭警报系统

专知会员服务

0+阅读 · 今天6:20

以色列在多条战线部署AI智能体

以色列在多条战线部署AI智能体

专知会员服务

1+阅读 · 今天6:12

《将形式化方法工具应用于电子战代码库（经验报告）》

《将形式化方法工具应用于电子战代码库（经验报告）》

专知会员服务

1+阅读 · 今天6:09

2025年大语言模型进展报告

2025年大语言模型进展报告

专知会员服务

13+阅读 · 4月25日

多智能体协作机制

多智能体协作机制

专知会员服务

12+阅读 · 4月25日

非对称优势：美海军开发低成本反无人机技术

非对称优势：美海军开发低成本反无人机技术

专知会员服务

9+阅读 · 4月25日

《反无人机技术领域的技术发展综述：C-UAS探测、跟踪与识别技术》80页报告

《反无人机技术领域的技术发展综述：C-UAS探测、跟踪与识别技术》80页报告

专知会员服务

19+阅读 · 4月25日

《美战争部小企业创新研究（SBIR）计划》

《美战争部小企业创新研究（SBIR）计划》

专知会员服务

8+阅读 · 4月25日

《军事模拟：将军事条令与目标融入AI智能体》

《军事模拟：将军事条令与目标融入AI智能体》

专知会员服务

12+阅读 · 4月25日

【NTU博士论文】3D人体动作生成

【NTU博士论文】3D人体动作生成

专知会员服务

9+阅读 · 4月24日

相关VIP内容

《用于水文建模应用的美国空军全球空陆天气开发模型数据流程：GALWEM采集系统v1.0与v2.0概述》最新报告

《用于水文建模应用的美国空军全球空陆天气开发模型数据流程：GALWEM采集系统v1.0与v2.0概述》最新报告

专知会员服务

16+阅读 · 2025年12月27日

大模型+自动驾驶=？普渡大学等最新《自动驾驶领域多模态大型语言模型》综述

大模型+自动驾驶=？普渡大学等最新《自动驾驶领域多模态大型语言模型》综述

专知会员服务

76+阅读 · 2023年11月27日

Meta-Transformer：多模态学习的统一框架

Meta-Transformer：多模态学习的统一框架

专知会员服务

59+阅读 · 2023年7月21日

《人类系统集成 (HSI) 度量贸易空间探索环境 (HMTee) 》美陆军研究实验室2022最新36页技术报告

《人类系统集成 (HSI) 度量贸易空间探索环境 (HMTee) 》美陆军研究实验室2022最新36页技术报告

专知会员服务

14+阅读 · 2022年12月12日

不可错过！首门《自监督学习统计模型》课程！霍普金斯Daniel Khashabi讲授

不可错过！首门《自监督学习统计模型》课程！霍普金斯Daniel Khashabi讲授

专知会员服务

24+阅读 · 2022年9月30日

中科院空天院等最新《基于深度学习的多模态遥感数据融合》综述论文

中科院空天院等最新《基于深度学习的多模态遥感数据融合》综述论文

专知会员服务

136+阅读 · 2022年5月7日

Nature. Mach. Intell. |军事科学院<基于图神经网络技术的转录因子调控网络建模>

Nature. Mach. Intell. |军事科学院<基于图神经网络技术的转录因子调控网络建模>

专知会员服务

12+阅读 · 2022年4月21日

【Google AI】多模态瓶颈Transformer(MBT):一种新的模态融合模型，Multimodal Bottleneck Transformer (MBT): A New Model for Modality Fusion

【Google AI】多模态瓶颈Transformer(MBT):一种新的模态融合模型，Multimodal Bottleneck Transformer (MBT): A New Model for Modality Fusion

专知会员服务

57+阅读 · 2022年3月20日

【Google】多模态Transformer视频检索，Multi-modal Transformer

【Google】多模态Transformer视频检索，Multi-modal Transformer

专知会员服务

103+阅读 · 2020年7月22日

网络流量监测与分析大数据综述，A Survey on Big Data for Network Traffic Monitoring and Analysis

网络流量监测与分析大数据综述，A Survey on Big Data for Network Traffic Monitoring and Analysis

专知会员服务

65+阅读 · 2020年3月5日

热门VIP内容

开通专知VIP会员享更多权益服务

加拿大国防部发布项目需求：用于高级态势决策的多模态人工智能

《实现联合作战能力所需的技术》58页报告

《将小型无人机系统与巡飞弹集成至连及以下级别战术机动》（美陆军最新报告中文版）

《无人机革命：来自俄乌战场的启示》（报告）

相关资讯

【Manning新书】MLOps工程规模化，344页pdf

【Manning新书】MLOps工程规模化，344页pdf

专知

24+阅读 · 2022年5月4日

【干货书】MLOps是什么？MLOps实战：操作机器学习模型，461页pdf

【干货书】MLOps是什么？MLOps实战：操作机器学习模型，461页pdf

专知

15+阅读 · 2022年2月16日

Transformer模型-深度学习自然语言处理，17页ppt

Transformer模型-深度学习自然语言处理，17页ppt

专知

14+阅读 · 2020年8月30日

最强NLP预训练模型库PyTorch-Transformers正式开源！支持6个预训练框架，27个预训练模型

最强NLP预训练模型库PyTorch-Transformers正式开源！支持6个预训练框架，27个预训练模型

AI前线

12+阅读 · 2019年7月22日

谷歌EfficientNet缩放模型，PyTorch实现登热榜

谷歌EfficientNet缩放模型，PyTorch实现登热榜

机器学习算法与Python学习

11+阅读 · 2019年6月4日

集多种半监督学习范式为一体，谷歌新研究提出新型半监督方法 MixMatch

集多种半监督学习范式为一体，谷歌新研究提出新型半监督方法 MixMatch

机器之心

11+阅读 · 2019年6月3日

加入Transformer-XL，这个PyTorch包能调用各种NLP预训练模型

加入Transformer-XL，这个PyTorch包能调用各种NLP预训练模型

机器之心

15+阅读 · 2019年2月13日

谷歌、CMU重磅论文：Transformer升级版，评估速度提升超1800倍！

谷歌、CMU重磅论文：Transformer升级版，评估速度提升超1800倍！

新智元

11+阅读 · 2019年1月12日

【泡泡图灵智库】HSfM: 混合运动恢复结构（CVPR）

【泡泡图灵智库】HSfM: 混合运动恢复结构（CVPR）

泡泡机器人SLAM

11+阅读 · 2018年12月13日

基于位置注意力机制模型和带标签数据来提升槽填充（EMNLP outstanding paper）

基于位置注意力机制模型和带标签数据来提升槽填充（EMNLP outstanding paper）

科技创新与创业

17+阅读 · 2017年11月17日

相关论文

StefaLand: An Efficient Geoscience Foundation Model That Improves Dynamic Land-Surface Predictions

Arxiv

0+阅读 · 2月2日

Ocean Current-Harnessing Stage-Gated MPC: Monotone Cost Shaping and Speed-to-Fly for Energy-Efficient AUV Navigation

Arxiv

0+阅读 · 1月31日

StreamSense: Streaming Social Task Detection with Selective Vision-Language Model Routing

Arxiv

0+阅读 · 1月30日

HydroSense: A Dual-Microcontroller IoT Framework for Real-Time Multi-Parameter Water Quality Monitoring with Edge Processing and Cloud Analytics

Arxiv

0+阅读 · 1月29日

Hylog: A Hybrid Approach to Logging Text Production in Non-alphabetic Scripts

Arxiv

0+阅读 · 1月25日

THOR: A Versatile Foundation Model for Earth Observation Climate and Society Applications

Arxiv

0+阅读 · 1月22日

UniRoute: Unified Routing Mixture-of-Experts for Modality-Adaptive Remote Sensing Change Detection

Arxiv

0+阅读 · 1月21日

SynDroneVision: A Synthetic Dataset for Image-Based Drone Detection

Arxiv

0+阅读 · 1月8日

Utilizing Earth Foundation Models to Enhance the Simulation Performance of Hydrological Models with AlphaEarth Embeddings

Arxiv

0+阅读 · 1月4日

Traffic-MoE: A Sparse Foundation Model for Network Traffic Analysis

Arxiv

0+阅读 · 1月1日

相关基金

动态不确定性条件下基于混杂约束满足问题的水下移动传感器网络节点自定位方法研究

国家自然科学基金

3+阅读 · 2015年12月31日

基于多时相遥感影像的亚像元级地表水变化监测研究

国家自然科学基金

0+阅读 · 2015年12月31日

土壤湿度遥感产品时空无缝融合方法研究

国家自然科学基金

0+阅读 · 2015年12月31日

h型信息网络测度的机理与实证研究

国家自然科学基金

0+阅读 · 2015年12月31日

基于模型预测的AUV三维轨迹跟踪控制研究

国家自然科学基金

1+阅读 · 2015年12月31日

复杂流体下微弯型科氏质量流量计驱动控制、信号处理和误差修正方法研究与实现

国家自然科学基金

0+阅读 · 2015年12月31日

利用GPS观测资料反演高时空分辨率局部地表质量变化的方法研究

国家自然科学基金

0+阅读 · 2015年12月31日

卫星重力测量反演高精度高分辨率局部地表质量变化的方法研究

国家自然科学基金

0+阅读 · 2014年12月31日

基于多源遥感数据的陆地上空高时空分辨率大气水汽反演研究

国家自然科学基金

0+阅读 · 2014年12月31日

基于本体论的海洋流动场时空数据建模与可视化

国家自然科学基金

0+阅读 · 2014年12月31日

微信扫码咨询专知VIP会员