Scaling Continual Learning to 300+ Tasks with Bi-Level Routing Mixture-of-Experts - 专知论文

会员服务 ·

0

Learning · Continuity · 数据集 · 缩放 · 判别器 ·

Scaling Continual Learning to 300+ Tasks with Bi-Level Routing Mixture-of-Experts

翻译：将持续学习扩展到300+任务：基于双层路由专家混合的规模方法

Meng Lou,Yunxiang Fu,Yizhou Yu

from arxiv, Accepted by ICML 2026

Continual learning, especially class-incremental learning (CIL), on the basis of a pre-trained model (PTM) has garnered substantial research interest in recent years. However, how to effectively learn both discriminative and comprehensive feature representations while maintaining stability and plasticity over very long task sequences remains an open problem. We propose CaRE, a scalable {C}ontinual Le{a}rner with efficient Bi-Level {R}outing Mixture-of-{E}xperts (BR-MoE). The core idea of BR-MoE is a bi-level routing mechanism: a router selection stage that dynamically activates relevant task-specific routers, followed by an expert routing phase that dynamically activates and aggregates experts, aiming to inject discriminative and comprehensive representations into every intermediate network layer. On the other hand, we introduce a challenging dataset, OmniBenchmark-1K, for CIL performance evaluation on very long task sequences with hundreds of tasks. Extensive experiments show that CaRE demonstrates leading performance across a variety of datasets and task settings, including commonly used CIL datasets with classical CIL settings (e.g., 5-20 tasks). To the best of our knowledge, CaRE is the first continual learner that scales to very long task sequences (ranging from 100 to over 300 non-overlapping tasks), while outperforming all baselines by a large margin on such task sequences. We hope that this work will inspire further research into continual learning over extremely long task sequences. Code and dataset are publicly released at https://github.com/LMMMEng/CaRE.

翻译：持续学习，特别是基于预训练模型（PTM）的类增量学习（CIL），近年来引起了广泛的研究兴趣。然而，如何在保持长期任务序列中稳定性和可塑性的同时，有效学习既具判别性又全面的特征表示，仍是一个未解决的问题。我们提出CaRE，一种可扩展的持续学习器，采用高效的双层路由专家混合（BR-MoE）。BR-MoE的核心思想是双层路由机制：先通过路由器选择阶段动态激活相关任务特定路由器，再经专家路由阶段动态激活并聚合专家，旨在将判别性和全面表示注入每一中间网络层。此外，我们引入了一个具有挑战性的数据集OmniBenchmark-1K，用于评估涉及数百个任务的超长任务序列上的CIL性能。大量实验表明，CaRE在多种数据集和任务设置（包括经典CIL设置下的常用CIL数据集，如5-20个任务）中均展现出领先性能。据我们所知，CaRE是首个可扩展至超长任务序列（从100个到超过300个无重叠任务）的持续学习器，在此类任务序列上大幅超越所有基线方法。我们希望这项工作能激发对极长任务序列上持续学习的进一步研究。代码和数据集已在https://github.com/LMMMEng/CaRE 公开。

0

相关内容

Learning

大语言模型持续学习：方法、挑战与机遇

大语言模型持续学习：方法、挑战与机遇

专知会员服务

21+阅读 · 3月16日

大规模语言模型智能体的终身学习：发展路线图

大规模语言模型智能体的终身学习：发展路线图

专知会员服务

46+阅读 · 2025年1月16日

【NeurIPS2024】SAFE: 慢速与快速参数高效调优用于基于预训练模型的持续学习

【NeurIPS2024】SAFE: 慢速与快速参数高效调优用于基于预训练模型的持续学习

专知会员服务

18+阅读 · 2024年11月5日

多模态持续学习的最新进展：综合综述

多模态持续学习的最新进展：综合综述

专知会员服务

47+阅读 · 2024年10月10日

释放多任务学习的力量：涵盖传统、深度和预训练基础模型时代的综述

释放多任务学习的力量：涵盖传统、深度和预训练基础模型时代的综述

专知会员服务

33+阅读 · 2024年5月2日

【综述】持续学习与预训练模型综述

【综述】持续学习与预训练模型综述

专知会员服务

55+阅读 · 2024年1月30日

【AAAI2023】类增量学习的在线超参数优化

【AAAI2023】类增量学习的在线超参数优化

专知会员服务

20+阅读 · 2023年1月18日

【NeurIPS2022】解决持续学习问题的理论研究

【NeurIPS2022】解决持续学习问题的理论研究

专知会员服务

31+阅读 · 2022年11月7日

最新《持续学习机器人技术：定义，框架，学习策略，机会与挑战》综述论文，17页pdf

最新《持续学习机器人技术：定义，框架，学习策略，机会与挑战》综述论文，17页pdf

专知会员服务

56+阅读 · 2020年12月11日

【Uber AI新论文】持续元学习，Learning to Continually Learn

【Uber AI新论文】持续元学习，Learning to Continually Learn

专知会员服务

37+阅读 · 2020年2月27日

多模态怎么用自监督？爱丁堡等最新《自监督多模态学习》综述，详述目标函数、数据对齐和模型架构

多模态怎么用自监督？爱丁堡等最新《自监督多模态学习》综述，详述目标函数、数据对齐和模型架构

专知

10+阅读 · 2023年4月6日

推荐！【DARPA终身学习机器（L2M）】《自主系统中用于感知和行动的终身学习》美空军、宾大2022最新234页技术报告

推荐！【DARPA终身学习机器（L2M）】《自主系统中用于感知和行动的终身学习》美空军、宾大2022最新234页技术报告

专知

27+阅读 · 2022年11月24日

「基于通信的多智能体强化学习」进展综述

「基于通信的多智能体强化学习」进展综述

专知

33+阅读 · 2022年11月12日

【CVPR 2020 Oral】小样本类增量学习

【CVPR 2020 Oral】小样本类增量学习

专知

20+阅读 · 2020年6月26日

【Uber AI新论文】持续元学习，Learning to Continually Learn

【Uber AI新论文】持续元学习，Learning to Continually Learn

专知

19+阅读 · 2020年2月27日

【加州理工】什么是模仿学习(Imitation Learning（模仿学习), 这62页ppt带你了解进展，附下载

【加州理工】什么是模仿学习(Imitation Learning（模仿学习), 这62页ppt带你了解进展，附下载

专知

21+阅读 · 2019年11月14日

BAM！利用知识蒸馏和多任务学习构建的通用语言模型

BAM！利用知识蒸馏和多任务学习构建的通用语言模型

机器之心

15+阅读 · 2019年3月18日

关于深度多任务学习的 3 点经验

关于深度多任务学习的 3 点经验

机器学习算法与Python学习

17+阅读 · 2019年2月18日

半监督多任务学习：Semisupervised Multitask Learning

半监督多任务学习：Semisupervised Multitask Learning

我爱读PAMI

18+阅读 · 2018年4月29日

学界 | 多任务学习概述论文：从定义和方法到应用和原理分析

学界 | 多任务学习概述论文：从定义和方法到应用和原理分析

机器之心

12+阅读 · 2018年3月9日

针对大规模环境下复杂任务的策略搜索强化学习方法研究

国家自然科学基金

43+阅读 · 2015年12月31日

基于复杂图知识表示的终身强化学习研究

国家自然科学基金

40+阅读 · 2015年12月31日

复杂环境下机器学习的理论研究

国家自然科学基金

21+阅读 · 2015年12月31日

基于高斯过程模型的多示例多标记学习算法研究

国家自然科学基金

14+阅读 · 2015年12月31日

高维不平衡数据的集成学习算法研究

国家自然科学基金

17+阅读 · 2015年12月31日

面向大规模多步学习问题的学习分类元系统技术研究

国家自然科学基金

5+阅读 · 2015年12月31日

基于扩展的概率转移矩阵模型的高精度快速广义门电路可靠性评估方法研究

国家自然科学基金

0+阅读 · 2015年12月31日

面向异分布数据的主动学习方法

国家自然科学基金

12+阅读 · 2015年12月31日

基于贝叶斯推理的模糊逻辑强化学习模型研究

国家自然科学基金

18+阅读 · 2012年12月31日

基于支持向量机的复杂连续系统强化学习控制研究

国家自然科学基金

12+阅读 · 2008年12月31日

Continual Learning with Support Boundary Experience Blending

Arxiv

0+阅读 · 6月18日

Dimensionality Controls When Modularity Helps in Continual Learning

Arxiv

0+阅读 · 6月16日

KeepLoRA++: Continual Learning with Layer-Scaled Residual Gradient Adaptation

Arxiv

0+阅读 · 6月15日

Learning New Tasks via Reusable Skills: Skill-Compositional Experts for Embodied Continual Learning

Arxiv

0+阅读 · 6月14日

Continual Learning with Support Boundary Experience Blending

Arxiv

0+阅读 · 6月10日

Listen, Look, and Learn: Learning Without Forgetting through SAM-Audio

Arxiv

0+阅读 · 6月9日

Towards Efficient and Exact Forgetting Services in Pre-Trained-Model-based Continual Learning

Arxiv

0+阅读 · 6月5日

A Conceptual Model and Methodology for Sustainability-aware, IoT-enhanced Business Processes

Arxiv

0+阅读 · 6月1日

Dynamic Mixed-Precision Routing for Efficient Multi-step LLM Interaction

Arxiv

0+阅读 · 5月14日

Improving the Performance and Learning Stability of Parallelizable RNNs Designed for Ultra-Low Power Applications

Arxiv

0+阅读 · 5月12日

VIP会员

文章信息

相关主题

最新内容

ICML 2026 Spotlight | SmoothSMoE：解析稀疏 MoE 路由不连续

ICML 2026 Spotlight | SmoothSMoE：解析稀疏 MoE 路由不连续

专知会员服务

3+阅读 · 6月18日

综述 | 周期表视角下的大模型推理：范式、方法与失败模式

综述 | 周期表视角下的大模型推理：范式、方法与失败模式

专知会员服务

4+阅读 · 6月18日

《廉价自杀式无人机战争的军事战略影响：乌克兰和伊朗案例研究》

《廉价自杀式无人机战争的军事战略影响：乌克兰和伊朗案例研究》

专知会员服务

9+阅读 · 6月18日

《面向反无人机作战的联邦式可解释射频–光电/红外情报融合：边缘人工智能优化、电子战韧性及分布式监视验证》

《面向反无人机作战的联邦式可解释射频–光电/红外情报融合：边缘人工智能优化、电子战韧性及分布式监视验证》

专知会员服务

7+阅读 · 6月18日

ICML 2026 | FR3D：解耦自车运动的未来动态三维重建世界模型

ICML 2026 | FR3D：解耦自车运动的未来动态三维重建世界模型

专知会员服务

4+阅读 · 6月17日

【伯克利博士论文】迈向可扩展与自我演进的大语言模型智能体

【伯克利博士论文】迈向可扩展与自我演进的大语言模型智能体

专知会员服务

6+阅读 · 6月17日

学习数据的几何：形状空间分析数学综述

学习数据的几何：形状空间分析数学综述

专知会员服务

6+阅读 · 6月17日

《现代防空系统综述：架构、传感器、拦截器及新兴威胁环境对基础设施受限防御环境的影响》2026最新长综述

《现代防空系统综述：架构、传感器、拦截器及新兴威胁环境对基础设施受限防御环境的影响》2026最新长综述

专知会员服务

8+阅读 · 6月17日

定向能反无人机系统最新发展动态

定向能反无人机系统最新发展动态

专知会员服务

7+阅读 · 6月17日

从燃煤战舰到算法战争：水面指挥的永恒要求

从燃煤战舰到算法战争：水面指挥的永恒要求

专知会员服务

4+阅读 · 6月17日

《短程弹道再入飞行器拦截时间中的一项异常现象》

《短程弹道再入飞行器拦截时间中的一项异常现象》

专知会员服务

6+阅读 · 6月17日

《基于回归方法与任务上下文的对抗环境动态战术网络报文优先级排序》

《基于回归方法与任务上下文的对抗环境动态战术网络报文优先级排序》

专知会员服务

7+阅读 · 6月17日

美智库《战术级指挥控制的迫切要求：构建弹性机动式指挥控制网络》报告

美智库《战术级指挥控制的迫切要求：构建弹性机动式指挥控制网络》报告

专知会员服务

5+阅读 · 6月17日

《韩国国防政策与军备出口：韩国安全与国防政策如何塑造其国防工业与军备出口格局》最新100页报告

《韩国国防政策与军备出口：韩国安全与国防政策如何塑造其国防工业与军备出口格局》最新100页报告

专知会员服务

5+阅读 · 6月17日

ICML 2026 | VOTP：用视频基础模型与最优传输，让离线偏好强化学习只需少量反馈

ICML 2026 | VOTP：用视频基础模型与最优传输，让离线偏好强化学习只需少量反馈

专知会员服务

6+阅读 · 6月16日

相关VIP内容

大语言模型持续学习：方法、挑战与机遇

大语言模型持续学习：方法、挑战与机遇

专知会员服务

21+阅读 · 3月16日

大规模语言模型智能体的终身学习：发展路线图

大规模语言模型智能体的终身学习：发展路线图

专知会员服务

46+阅读 · 2025年1月16日

【NeurIPS2024】SAFE: 慢速与快速参数高效调优用于基于预训练模型的持续学习

【NeurIPS2024】SAFE: 慢速与快速参数高效调优用于基于预训练模型的持续学习

专知会员服务

18+阅读 · 2024年11月5日

多模态持续学习的最新进展：综合综述

多模态持续学习的最新进展：综合综述

专知会员服务

47+阅读 · 2024年10月10日

释放多任务学习的力量：涵盖传统、深度和预训练基础模型时代的综述

释放多任务学习的力量：涵盖传统、深度和预训练基础模型时代的综述

专知会员服务

33+阅读 · 2024年5月2日

【综述】持续学习与预训练模型综述

【综述】持续学习与预训练模型综述

专知会员服务

55+阅读 · 2024年1月30日

【AAAI2023】类增量学习的在线超参数优化

【AAAI2023】类增量学习的在线超参数优化

专知会员服务

20+阅读 · 2023年1月18日

【NeurIPS2022】解决持续学习问题的理论研究

【NeurIPS2022】解决持续学习问题的理论研究

专知会员服务

31+阅读 · 2022年11月7日

最新《持续学习机器人技术：定义，框架，学习策略，机会与挑战》综述论文，17页pdf

最新《持续学习机器人技术：定义，框架，学习策略，机会与挑战》综述论文，17页pdf

专知会员服务

56+阅读 · 2020年12月11日

【Uber AI新论文】持续元学习，Learning to Continually Learn

【Uber AI新论文】持续元学习，Learning to Continually Learn

专知会员服务

37+阅读 · 2020年2月27日

热门VIP内容

开通专知VIP会员享更多权益服务

综述 | 周期表视角下的大模型推理：范式、方法与失败模式

《面向反无人机作战的联邦式可解释射频–光电/红外情报融合：边缘人工智能优化、电子战韧性及分布式监视验证》

ICML 2026 Spotlight | SmoothSMoE：解析稀疏 MoE 路由不连续

《廉价自杀式无人机战争的军事战略影响：乌克兰和伊朗案例研究》

相关资讯

多模态怎么用自监督？爱丁堡等最新《自监督多模态学习》综述，详述目标函数、数据对齐和模型架构

多模态怎么用自监督？爱丁堡等最新《自监督多模态学习》综述，详述目标函数、数据对齐和模型架构

专知

10+阅读 · 2023年4月6日

推荐！【DARPA终身学习机器（L2M）】《自主系统中用于感知和行动的终身学习》美空军、宾大2022最新234页技术报告

推荐！【DARPA终身学习机器（L2M）】《自主系统中用于感知和行动的终身学习》美空军、宾大2022最新234页技术报告

专知

27+阅读 · 2022年11月24日

「基于通信的多智能体强化学习」进展综述

「基于通信的多智能体强化学习」进展综述

专知

33+阅读 · 2022年11月12日

【CVPR 2020 Oral】小样本类增量学习

【CVPR 2020 Oral】小样本类增量学习

专知

20+阅读 · 2020年6月26日

【Uber AI新论文】持续元学习，Learning to Continually Learn

【Uber AI新论文】持续元学习，Learning to Continually Learn

专知

19+阅读 · 2020年2月27日

【加州理工】什么是模仿学习(Imitation Learning（模仿学习), 这62页ppt带你了解进展，附下载

【加州理工】什么是模仿学习(Imitation Learning（模仿学习), 这62页ppt带你了解进展，附下载

专知

21+阅读 · 2019年11月14日

BAM！利用知识蒸馏和多任务学习构建的通用语言模型

BAM！利用知识蒸馏和多任务学习构建的通用语言模型

机器之心

15+阅读 · 2019年3月18日

关于深度多任务学习的 3 点经验

关于深度多任务学习的 3 点经验

机器学习算法与Python学习

17+阅读 · 2019年2月18日

半监督多任务学习：Semisupervised Multitask Learning

半监督多任务学习：Semisupervised Multitask Learning

我爱读PAMI

18+阅读 · 2018年4月29日

学界 | 多任务学习概述论文：从定义和方法到应用和原理分析

学界 | 多任务学习概述论文：从定义和方法到应用和原理分析

机器之心

12+阅读 · 2018年3月9日

相关论文

Continual Learning with Support Boundary Experience Blending

Arxiv

0+阅读 · 6月18日

Dimensionality Controls When Modularity Helps in Continual Learning

Arxiv

0+阅读 · 6月16日

KeepLoRA++: Continual Learning with Layer-Scaled Residual Gradient Adaptation

Arxiv

0+阅读 · 6月15日

Learning New Tasks via Reusable Skills: Skill-Compositional Experts for Embodied Continual Learning

Arxiv

0+阅读 · 6月14日

Continual Learning with Support Boundary Experience Blending

Arxiv

0+阅读 · 6月10日

Listen, Look, and Learn: Learning Without Forgetting through SAM-Audio

Arxiv

0+阅读 · 6月9日

Towards Efficient and Exact Forgetting Services in Pre-Trained-Model-based Continual Learning

Arxiv

0+阅读 · 6月5日

A Conceptual Model and Methodology for Sustainability-aware, IoT-enhanced Business Processes

Arxiv

0+阅读 · 6月1日

Dynamic Mixed-Precision Routing for Efficient Multi-step LLM Interaction

Arxiv

0+阅读 · 5月14日

Improving the Performance and Learning Stability of Parallelizable RNNs Designed for Ultra-Low Power Applications

Arxiv

0+阅读 · 5月12日

相关基金

针对大规模环境下复杂任务的策略搜索强化学习方法研究

国家自然科学基金

43+阅读 · 2015年12月31日

基于复杂图知识表示的终身强化学习研究

国家自然科学基金

40+阅读 · 2015年12月31日

复杂环境下机器学习的理论研究

国家自然科学基金

21+阅读 · 2015年12月31日

基于高斯过程模型的多示例多标记学习算法研究

国家自然科学基金

14+阅读 · 2015年12月31日

高维不平衡数据的集成学习算法研究

国家自然科学基金

17+阅读 · 2015年12月31日

面向大规模多步学习问题的学习分类元系统技术研究

国家自然科学基金

5+阅读 · 2015年12月31日

基于扩展的概率转移矩阵模型的高精度快速广义门电路可靠性评估方法研究

国家自然科学基金

0+阅读 · 2015年12月31日

面向异分布数据的主动学习方法

国家自然科学基金

12+阅读 · 2015年12月31日

基于贝叶斯推理的模糊逻辑强化学习模型研究

国家自然科学基金

18+阅读 · 2012年12月31日

基于支持向量机的复杂连续系统强化学习控制研究

国家自然科学基金

12+阅读 · 2008年12月31日

微信扫码咨询专知VIP会员