Feed-Forward Optimization With Delayed Feedback for Neural Network Training - 专知论文

会员服务 ·

0

生物 · 前馈 · 神经网络训练 · 神经网络 · 反向传播 ·

Feed-Forward Optimization With Delayed Feedback for Neural Network Training

翻译：具有延迟反馈的前馈优化用于神经网络训练

Katharina Flügel,Daniel Coquelin,Marie Weiel,Charlotte Debus,Achim Streit,Markus Götz

from arxiv, This is the submitted manuscript of the version of record published in the proceedings to the 31st International Conference on Neural Information Processing (ICONIP 2024), Lecture Notes in Computer Science, vol 15289, and available online at https://doi.org/10.1007/978-981-96-6585-3_6

Backpropagation has long been criticized for being biologically implausible due to its reliance on concepts that are not viable in natural learning processes. Two core issues are the weight transport and update locking problems caused by the forward-backward dependencies, which limit biological plausibility, computational efficiency, and parallelization. Although several alternatives have been proposed to increase biological plausibility, they often come at the cost of reduced predictive performance. This paper proposes an alternative approach to training feed-forward neural networks addressing these issues by using approximate gradient information. We introduce Feed-Forward with delayed Feedback (F$^3$), which approximates gradients using fixed random feedback paths and delayed error information from the previous epoch to balance biological plausibility with predictive performance. We evaluate F$^3$ across multiple tasks and architectures, including both fully-connected and Transformer networks. Our results demonstrate that, compared to similarly plausible approaches, F$^3$ significantly improves predictive performance, narrowing the gap to backpropagation by up to 56% for classification and 96% for regression. This work is a step towards more biologically plausible learning algorithms while opening up new avenues for energy-efficient and parallelizable neural network training.

翻译：反向传播因其依赖自然学习过程中不可行的概念，长期以来被批评为生物学上不可信。两个核心问题是由前向-后向依赖引起的权重传输和更新锁定问题，这些问题限制了生物学可信度、计算效率和并行化能力。尽管已提出多种替代方案以增强生物学可信度，但它们通常以预测性能下降为代价。本文提出一种替代方法，通过使用近似梯度信息来训练前馈神经网络以解决这些问题。我们引入具有延迟反馈的前馈网络（F$^3$），该方法利用固定的随机反馈路径和来自前一训练周期的延迟误差信息来近似梯度，从而在生物学可信度与预测性能之间取得平衡。我们在多种任务和架构上评估F$^3$，包括全连接网络和Transformer网络。实验结果表明，与具有相似可信度的方案相比，F$^3$显著提升了预测性能，将分类任务中与反向传播的性能差距缩小了56%，回归任务中缩小了96%。这项工作为开发更具生物学可信度的学习算法迈出了重要一步，同时为节能且可并行的神经网络训练开辟了新途径。

0

相关内容

具有动能的生命体。

【博士论文】面向可扩展深度神经网络的预测编码：理论与实践

【博士论文】面向可扩展深度神经网络的预测编码：理论与实践

专知会员服务

15+阅读 · 2025年11月7日

【博士论文】理解神经网络的训练动态：从局部优化轨迹与特征学习视角

【博士论文】理解神经网络的训练动态：从局部优化轨迹与特征学习视角

专知会员服务

14+阅读 · 2025年8月15日

【普林斯顿博士论文】理解神经网络的训练动态：局部优化轨迹与特征学习视角

【普林斯顿博士论文】理解神经网络的训练动态：局部优化轨迹与特征学习视角

专知会员服务

21+阅读 · 2025年7月17日

康奈尔Nature论文：一种使用反向传播训练的深度物理神经网络

康奈尔Nature论文：一种使用反向传播训练的深度物理神经网络

专知会员服务

35+阅读 · 2022年2月3日

中科院自动化所研究登上Science子刊：自组织反向传播提升网络学习效率

中科院自动化所研究登上Science子刊：自组织反向传播提升网络学习效率

专知会员服务

26+阅读 · 2021年10月22日

借助几何先验知识促进深度神经网络：综述 | Boosting Deep Neural Networks with Geometrical Prior Knowledge: A Survey

借助几何先验知识促进深度神经网络：综述 | Boosting Deep Neural Networks with Geometrical Prior Knowledge: A Survey

专知会员服务

29+阅读 · 2020年7月10日

深度神经网络中的快捷学习，Shortcut Learning in Deep Neural Networks

深度神经网络中的快捷学习，Shortcut Learning in Deep Neural Networks

专知会员服务

22+阅读 · 2020年4月21日

【图机器学习论文】基于深度学习的网络生物学（Deep Learning for Network Biology）

【图机器学习论文】基于深度学习的网络生物学（Deep Learning for Network Biology）

专知会员服务

11+阅读 · 2019年12月16日

【图机器学习论文】综述：网络表示学习（Network Representation Learning: A Survey）

【图机器学习论文】综述：网络表示学习（Network Representation Learning: A Survey）

专知会员服务

92+阅读 · 2019年12月16日

【论文推荐】可解释神经网络，Towards Explainable Deep Neural Networks (xDNN)

【论文推荐】可解释神经网络，Towards Explainable Deep Neural Networks (xDNN)

专知会员服务

40+阅读 · 2019年12月5日

图神经网络如何时序化？看Twitter最新《动态图深度学习:时序图网络TGN》研究，附论文与PPT下载

图神经网络如何时序化？看Twitter最新《动态图深度学习:时序图网络TGN》研究，附论文与PPT下载

专知

17+阅读 · 2021年1月24日

强化学习《奖励函数设计: Reward Shaping》详细解读

强化学习《奖励函数设计: Reward Shaping》详细解读

深度强化学习实验室

19+阅读 · 2020年9月1日

【KDD2020】更深的图神经网络，Towards Deeper Graph Neural Networks

【KDD2020】更深的图神经网络，Towards Deeper Graph Neural Networks

专知

45+阅读 · 2020年7月22日

【论文笔记】用于Web级推荐系统的图卷积神经网络

【论文笔记】用于Web级推荐系统的图卷积神经网络

专知

20+阅读 · 2019年9月30日

Dropout、梯度消失/爆炸、Adam优化算法，神经网络优化算法看这一篇就够了

Dropout、梯度消失/爆炸、Adam优化算法，神经网络优化算法看这一篇就够了

AI100

14+阅读 · 2019年9月1日

深入卷积神经网络背后的数学原理

深入卷积神经网络背后的数学原理

人工智能学家

10+阅读 · 2019年4月26日

误差反向传播——CNN

误差反向传播——CNN

统计学习与视觉计算组

31+阅读 · 2018年7月12日

深度学习在推荐系统中的应用综述（最全）

深度学习在推荐系统中的应用综述（最全）

七月在线实验室

17+阅读 · 2018年5月5日

【深度学习最精炼中文讲义】前馈与卷积神经网络详解，复旦邱锡鹏老师《神经网络与深度学习》报告分享02（附报告pdf下载）

【深度学习最精炼中文讲义】前馈与卷积神经网络详解，复旦邱锡鹏老师《神经网络与深度学习》报告分享02（附报告pdf下载）

专知

11+阅读 · 2017年11月16日

干货 | 深度学习之卷积神经网络(CNN)的模型结构

干货 | 深度学习之卷积神经网络(CNN)的模型结构

机器学习算法与Python学习

12+阅读 · 2017年11月1日

忆阻递归神经网络的多重稳定性理论研究

国家自然科学基金

0+阅读 · 2015年12月31日

基于特征提取与分层建模的社交网络信息传播预测研究

国家自然科学基金

2+阅读 · 2015年12月31日

面向人类工作记忆改善的脑电复杂网络信息反馈非线性计算模型研究

国家自然科学基金

0+阅读 · 2015年12月31日

面向推荐系统中异构隐式反馈建模的迁移学习技术研究

国家自然科学基金

5+阅读 · 2015年12月31日

视知觉学习中的脑功能网络变化及其与学习效果的关系

国家自然科学基金

0+阅读 · 2015年12月31日

排序与半监督学习的误差分析

国家自然科学基金

0+阅读 · 2015年12月31日

神经反馈康复训练的反馈策略和控制方法研究

国家自然科学基金

0+阅读 · 2015年12月31日

演化优化的自适应约束处理机理及在生化过程中的应用

国家自然科学基金

0+阅读 · 2015年12月31日

反馈神经网络统一模型临界动力学研究及其在类脑计算机研制中的应用

国家自然科学基金

1+阅读 · 2014年12月31日

非凸非光滑优化的神经网络设计及其关键问题研究

国家自然科学基金

0+阅读 · 2014年12月31日

Linear Convergence in Games with Delayed Feedback via Extra Prediction

Linear Convergence in Games with Delayed Feedback via Extra Prediction

Arxiv

0+阅读 · 2月19日

Forward-Forward Autoencoder Architectures for Energy-Efficient Wireless Communications

Arxiv

0+阅读 · 2月16日

Tuning the burn-in phase in training recurrent neural networks improves their performance

Arxiv

0+阅读 · 2月11日

Deep Network Trainability via Persistent Subspace Orthogonality

Arxiv

0+阅读 · 2月11日

A feedback control optimizer for online and hardware-aware training of Spiking Neural Networks

Arxiv

0+阅读 · 2月3日

Neural Backward Filtering Forward Guiding

Arxiv

0+阅读 · 1月30日

Partial Feedback Online Learning

Arxiv

0+阅读 · 1月29日

ADMM-Based Training for Spiking Neural Networks

Arxiv

0+阅读 · 1月18日

Training Large Neural Networks With Low-Dimensional Error Feedback

Arxiv

0+阅读 · 1月14日

Beyond Backpropagation: Optimization with Multi-Tangent Forward Gradients

Arxiv

0+阅读 · 1月13日

VIP会员

文章信息

相关主题

神经网络训练

最新内容

《多域作战面临复杂现实》

《多域作战面临复杂现实》

专知会员服务

0+阅读 · 2分钟前

《印度的多域作战：条令与能力发展》报告

《印度的多域作战：条令与能力发展》报告

专知会员服务

0+阅读 · 13分钟前

《是“修复情报”还是修复部队？阿富汗反叛乱行动中美军情报调整》400页

《是“修复情报”还是修复部队？阿富汗反叛乱行动中美军情报调整》400页

专知会员服务

0+阅读 · 19分钟前

美军的算法化军备库：无人机优势计划（DDP）、复制者倡议（Replicator）与联合全域指挥控制（JADC2）如何重写战争规则

美军的算法化军备库：无人机优势计划（DDP）、复制者倡议（Replicator）与联合全域指挥控制（JADC2）如何重写战争规则

专知会员服务

0+阅读 · 今天3:25

（中文版）美空军部发布《空军部数据战略》与《人工智能战略》两份战略：旨在加速建立军事优势

（中文版）美空军部发布《空军部数据战略》与《人工智能战略》两份战略：旨在加速建立军事优势

专知会员服务

5+阅读 · 今天2:55

【斯坦福博士论文】语言模型的机械可解释性与控制

【斯坦福博士论文】语言模型的机械可解释性与控制

专知会员服务

2+阅读 · 4月23日

大语言模型智能体长期记忆安全性综述：迈向记忆主权

大语言模型智能体长期记忆安全性综述：迈向记忆主权

专知会员服务

1+阅读 · 4月23日

美军被摧毁的空战装备：伊朗战争如何重创美国空中力量

美军被摧毁的空战装备：伊朗战争如何重创美国空中力量

专知会员服务

4+阅读 · 4月23日

人工智能赋能无人机：俄乌战争（万字长文）

人工智能赋能无人机：俄乌战争（万字长文）

专知会员服务

6+阅读 · 4月23日

国外海军作战管理系统与作战训练系统

国外海军作战管理系统与作战训练系统

专知会员服务

3+阅读 · 4月23日

美军条令《海军陆战队规划流程（2026版）》

美军条令《海军陆战队规划流程（2026版）》

专知会员服务

10+阅读 · 4月23日

《压缩式分布式交互仿真标准》120页

《压缩式分布式交互仿真标准》120页

专知会员服务

4+阅读 · 4月23日

《电子战数据交换模型研究报告》

《电子战数据交换模型研究报告》

专知会员服务

6+阅读 · 4月23日

美军运用水下无人机与机器人系统竞速清除霍尔木兹海峡水雷

美军运用水下无人机与机器人系统竞速清除霍尔木兹海峡水雷

专知会员服务

4+阅读 · 4月23日

《基于Transformer的异常舰船导航识别与跟踪》80页

《基于Transformer的异常舰船导航识别与跟踪》80页

专知会员服务

8+阅读 · 4月23日

相关VIP内容

【博士论文】面向可扩展深度神经网络的预测编码：理论与实践

【博士论文】面向可扩展深度神经网络的预测编码：理论与实践

专知会员服务

15+阅读 · 2025年11月7日

【博士论文】理解神经网络的训练动态：从局部优化轨迹与特征学习视角

【博士论文】理解神经网络的训练动态：从局部优化轨迹与特征学习视角

专知会员服务

14+阅读 · 2025年8月15日

【普林斯顿博士论文】理解神经网络的训练动态：局部优化轨迹与特征学习视角

【普林斯顿博士论文】理解神经网络的训练动态：局部优化轨迹与特征学习视角

专知会员服务

21+阅读 · 2025年7月17日

康奈尔Nature论文：一种使用反向传播训练的深度物理神经网络

康奈尔Nature论文：一种使用反向传播训练的深度物理神经网络

专知会员服务

35+阅读 · 2022年2月3日

中科院自动化所研究登上Science子刊：自组织反向传播提升网络学习效率

中科院自动化所研究登上Science子刊：自组织反向传播提升网络学习效率

专知会员服务

26+阅读 · 2021年10月22日

借助几何先验知识促进深度神经网络：综述 | Boosting Deep Neural Networks with Geometrical Prior Knowledge: A Survey

借助几何先验知识促进深度神经网络：综述 | Boosting Deep Neural Networks with Geometrical Prior Knowledge: A Survey

专知会员服务

29+阅读 · 2020年7月10日

深度神经网络中的快捷学习，Shortcut Learning in Deep Neural Networks

深度神经网络中的快捷学习，Shortcut Learning in Deep Neural Networks

专知会员服务

22+阅读 · 2020年4月21日

【图机器学习论文】基于深度学习的网络生物学（Deep Learning for Network Biology）

【图机器学习论文】基于深度学习的网络生物学（Deep Learning for Network Biology）

专知会员服务

11+阅读 · 2019年12月16日

【图机器学习论文】综述：网络表示学习（Network Representation Learning: A Survey）

【图机器学习论文】综述：网络表示学习（Network Representation Learning: A Survey）

专知会员服务

92+阅读 · 2019年12月16日

【论文推荐】可解释神经网络，Towards Explainable Deep Neural Networks (xDNN)

【论文推荐】可解释神经网络，Towards Explainable Deep Neural Networks (xDNN)

专知会员服务

40+阅读 · 2019年12月5日

热门VIP内容

开通专知VIP会员享更多权益服务

美军的算法化军备库：无人机优势计划（DDP）、复制者倡议（Replicator）与联合全域指挥控制（JADC2）如何重写战争规则

【斯坦福博士论文】语言模型的机械可解释性与控制

《是“修复情报”还是修复部队？阿富汗反叛乱行动中美军情报调整》400页

（中文版）美空军部发布《空军部数据战略》与《人工智能战略》两份战略：旨在加速建立军事优势

相关资讯

图神经网络如何时序化？看Twitter最新《动态图深度学习:时序图网络TGN》研究，附论文与PPT下载

图神经网络如何时序化？看Twitter最新《动态图深度学习:时序图网络TGN》研究，附论文与PPT下载

专知

17+阅读 · 2021年1月24日

强化学习《奖励函数设计: Reward Shaping》详细解读

强化学习《奖励函数设计: Reward Shaping》详细解读

深度强化学习实验室

19+阅读 · 2020年9月1日

【KDD2020】更深的图神经网络，Towards Deeper Graph Neural Networks

【KDD2020】更深的图神经网络，Towards Deeper Graph Neural Networks

专知

45+阅读 · 2020年7月22日

【论文笔记】用于Web级推荐系统的图卷积神经网络

【论文笔记】用于Web级推荐系统的图卷积神经网络

专知

20+阅读 · 2019年9月30日

Dropout、梯度消失/爆炸、Adam优化算法，神经网络优化算法看这一篇就够了

Dropout、梯度消失/爆炸、Adam优化算法，神经网络优化算法看这一篇就够了

AI100

14+阅读 · 2019年9月1日

深入卷积神经网络背后的数学原理

深入卷积神经网络背后的数学原理

人工智能学家

10+阅读 · 2019年4月26日

误差反向传播——CNN

误差反向传播——CNN

统计学习与视觉计算组

31+阅读 · 2018年7月12日

深度学习在推荐系统中的应用综述（最全）

深度学习在推荐系统中的应用综述（最全）

七月在线实验室

17+阅读 · 2018年5月5日

【深度学习最精炼中文讲义】前馈与卷积神经网络详解，复旦邱锡鹏老师《神经网络与深度学习》报告分享02（附报告pdf下载）

【深度学习最精炼中文讲义】前馈与卷积神经网络详解，复旦邱锡鹏老师《神经网络与深度学习》报告分享02（附报告pdf下载）

专知

11+阅读 · 2017年11月16日

干货 | 深度学习之卷积神经网络(CNN)的模型结构

干货 | 深度学习之卷积神经网络(CNN)的模型结构

机器学习算法与Python学习

12+阅读 · 2017年11月1日

相关论文

Linear Convergence in Games with Delayed Feedback via Extra Prediction

Linear Convergence in Games with Delayed Feedback via Extra Prediction

Arxiv

0+阅读 · 2月19日

Forward-Forward Autoencoder Architectures for Energy-Efficient Wireless Communications

Arxiv

0+阅读 · 2月16日

Tuning the burn-in phase in training recurrent neural networks improves their performance

Arxiv

0+阅读 · 2月11日

Deep Network Trainability via Persistent Subspace Orthogonality

Arxiv

0+阅读 · 2月11日

A feedback control optimizer for online and hardware-aware training of Spiking Neural Networks

Arxiv

0+阅读 · 2月3日

Neural Backward Filtering Forward Guiding

Arxiv

0+阅读 · 1月30日

Partial Feedback Online Learning

Arxiv

0+阅读 · 1月29日

ADMM-Based Training for Spiking Neural Networks

Arxiv

0+阅读 · 1月18日

Training Large Neural Networks With Low-Dimensional Error Feedback

Arxiv

0+阅读 · 1月14日

Beyond Backpropagation: Optimization with Multi-Tangent Forward Gradients

Arxiv

0+阅读 · 1月13日

相关基金

忆阻递归神经网络的多重稳定性理论研究

国家自然科学基金

0+阅读 · 2015年12月31日

基于特征提取与分层建模的社交网络信息传播预测研究

国家自然科学基金

2+阅读 · 2015年12月31日

面向人类工作记忆改善的脑电复杂网络信息反馈非线性计算模型研究

国家自然科学基金

0+阅读 · 2015年12月31日

面向推荐系统中异构隐式反馈建模的迁移学习技术研究

国家自然科学基金

5+阅读 · 2015年12月31日

视知觉学习中的脑功能网络变化及其与学习效果的关系

国家自然科学基金

0+阅读 · 2015年12月31日

排序与半监督学习的误差分析

国家自然科学基金

0+阅读 · 2015年12月31日

神经反馈康复训练的反馈策略和控制方法研究

国家自然科学基金

0+阅读 · 2015年12月31日

演化优化的自适应约束处理机理及在生化过程中的应用

国家自然科学基金

0+阅读 · 2015年12月31日

反馈神经网络统一模型临界动力学研究及其在类脑计算机研制中的应用

国家自然科学基金

1+阅读 · 2014年12月31日

非凸非光滑优化的神经网络设计及其关键问题研究

国家自然科学基金

0+阅读 · 2014年12月31日

微信扫码咨询专知VIP会员