Free Energy Mixer - 专知论文

会员服务 ·

0

自由能 · 混合 · 通道 · 存储 · 不变 ·

Free Energy Mixer

翻译：自由能混合器

Jiecheng Lu,Shihao Yang

from arxiv, Camera-ready version. Accepted at ICLR 2026

Standard attention stores keys/values losslessly but reads them via a per-head convex average, blocking channel-wise selection. We propose the Free Energy Mixer (FEM): a free-energy (log-sum-exp) read that applies a value-driven, per-channel log-linear tilt to a fast prior (e.g., from queries/keys in standard attention) over indices. Unlike methods that attempt to improve and enrich the $(q,k)$ scoring distribution, FEM treats it as a prior and yields a value-aware posterior read at unchanged complexity, smoothly moving from averaging to per-channel selection as the learnable inverse temperature increases, while still preserving parallelism and the original asymptotic complexity ($O(T^2)$ for softmax; $O(T)$ for linearizable variants). We instantiate a two-level gated FEM that is plug-and-play with standard and linear attention, linear RNNs and SSMs. It consistently outperforms strong baselines on NLP, vision, and time-series at matched parameter budgets.

翻译：标准注意力机制以无损方式存储键/值，但通过每个头部的凸平均进行读取，这阻碍了通道级选择。我们提出自由能混合器（FEM）：一种自由能（对数求和指数）读取机制，它将对索引的快速先验（例如，来自标准注意力中的查询/键）施加一个由值驱动的、逐通道的对数线性倾斜。与试图改进和丰富$(q,k)$评分分布的方法不同，FEM将其视为先验，并以不变的复杂度产生一个值感知的后验读取，随着可学习的逆温度参数增加，平滑地从平均过渡到逐通道选择，同时仍保持并行性和原有的渐近复杂度（对于softmax为$O(T^2)$；对于可线性化变体为$O(T)$）。我们实例化了一个两级门控FEM，它可以即插即用地与标准及线性注意力、线性RNN和SSM结合使用。在参数预算匹配的情况下，它在NLP、视觉和时间序列任务上持续优于强基线模型。

0

相关内容

自由能

TransMLA：多头潜在注意力（MLA）即为所需

TransMLA：多头潜在注意力（MLA）即为所需

专知会员服务

23+阅读 · 2025年2月13日

《基于智能自适应混合控制实现自主性：采用自适应协作/控制技术的智能跨域多无人系统规划器》107页干货

《基于智能自适应混合控制实现自主性：采用自适应协作/控制技术的智能跨域多无人系统规划器》107页干货

专知会员服务

58+阅读 · 2024年11月12日

大模型时代还不理解自注意力(Self-Attention)？这篇文章教你从头写代码实现

大模型时代还不理解自注意力(Self-Attention)？这篇文章教你从头写代码实现

专知会员服务

36+阅读 · 2024年2月12日

【CVPR2023】面向自监督视觉表示学习的混合自编码器

【CVPR2023】面向自监督视觉表示学习的混合自编码器

专知会员服务

25+阅读 · 2023年4月3日

主动学习预测结合自由能进行分子优化

主动学习预测结合自由能进行分子优化

专知会员服务

16+阅读 · 2022年9月18日

自监督如何做推荐？昆士兰大学最新《自监督学习推荐系统》综述论文，阐述对比、生成、预测和混合四大类方法

自监督如何做推荐？昆士兰大学最新《自监督学习推荐系统》综述论文，阐述对比、生成、预测和混合四大类方法

专知会员服务

32+阅读 · 2022年4月5日

【CVPR 2022】MixFormer：跨窗口与维度的特征融合，MixFormer: Mixing Features across Windows and Dimensions

【CVPR 2022】MixFormer：跨窗口与维度的特征融合，MixFormer: Mixing Features across Windows and Dimensions

专知会员服务

15+阅读 · 2022年3月19日

【YannLecun最新报告】自监督学习与能量模型，附99页ppt与视频

【YannLecun最新报告】自监督学习与能量模型，附99页ppt与视频

专知会员服务

56+阅读 · 2021年6月19日

无所不能的Self-Attention！洛桑理工ICLR2020论文验证「自注意力可以表达任何CNN卷积滤波层」

无所不能的Self-Attention！洛桑理工ICLR2020论文验证「自注意力可以表达任何CNN卷积滤波层」

专知会员服务

57+阅读 · 2020年1月12日

【Yann Lecun最新报告】基于能量的自监督学习（Energy-Based Self-Supervised Learning ）附68页ppt

【Yann Lecun最新报告】基于能量的自监督学习（Energy-Based Self-Supervised Learning ）附68页ppt

专知会员服务

87+阅读 · 2019年11月24日

多模态怎么用自监督？爱丁堡等最新《自监督多模态学习》综述，详述目标函数、数据对齐和模型架构

多模态怎么用自监督？爱丁堡等最新《自监督多模态学习》综述，详述目标函数、数据对齐和模型架构

专知

10+阅读 · 2023年4月6日

推荐！【DARPA终身学习机器（L2M）】《自主系统中用于感知和行动的终身学习》美空军、宾大2022最新234页技术报告

推荐！【DARPA终身学习机器（L2M）】《自主系统中用于感知和行动的终身学习》美空军、宾大2022最新234页技术报告

专知

27+阅读 · 2022年11月24日

无所不能的Self-Attention！洛桑理工ICLR2020论文验证「自注意力可以表达任何CNN卷积滤波层」

无所不能的Self-Attention！洛桑理工ICLR2020论文验证「自注意力可以表达任何CNN卷积滤波层」

专知

24+阅读 · 2020年1月12日

概述自动机器学习（AutoML）

概述自动机器学习（AutoML）

人工智能学家

19+阅读 · 2019年8月11日

告别调参，AutoML新书发布

告别调参，AutoML新书发布

专知

14+阅读 · 2018年10月16日

入门 | 什么是自注意力机制？

入门 | 什么是自注意力机制？

机器之心

17+阅读 · 2018年8月19日

FAGAN：完全注意力机制（Full Attention）GAN，Self-attention+GAN

FAGAN：完全注意力机制（Full Attention）GAN，Self-attention+GAN

专知

32+阅读 · 2018年8月14日

Ian Goodfellow等提出自注意力GAN，ImageNet图像合成获最优结果！

Ian Goodfellow等提出自注意力GAN，ImageNet图像合成获最优结果！

新智元

11+阅读 · 2018年5月24日

自然语言处理中的自注意力机制（Self-Attention Mechanism）

自然语言处理中的自注意力机制（Self-Attention Mechanism）

PaperWeekly

22+阅读 · 2018年3月28日

【论文推荐】最新七篇自注意力机制(Self-attention)相关论文—结构化自注意力、相对位置、混合、句子表达、文本向量

【论文推荐】最新七篇自注意力机制(Self-attention)相关论文—结构化自注意力、相对位置、混合、句子表达、文本向量

专知

29+阅读 · 2018年3月12日

再生能源供电分布式无线随机接入关键技术

国家自然科学基金

0+阅读 · 2015年12月31日

不锈钢无纺布基Li4Ti5O12@石墨烯/石墨烯@碳泡沫锂离子混合超级电容器

国家自然科学基金

0+阅读 · 2015年12月31日

微功率能量收集系统中片上集成的超低压自启动方法研究

国家自然科学基金

0+阅读 · 2015年12月31日

随机混杂预测控制的插电式混合动力系统能量管理策略优化机理

国家自然科学基金

0+阅读 · 2015年12月31日

混合等离激元纳米流体的太阳能吸收特性及其调控方法研究

国家自然科学基金

0+阅读 · 2015年12月31日

低维自旋轨道耦合费米气体的量子蒙特卡罗研究

国家自然科学基金

0+阅读 · 2015年12月31日

基于动态匹配的高能量利用率多层堆叠结构静态随机存储器（SRAM）关键技术

国家自然科学基金

0+阅读 · 2015年12月31日

多喷嘴对置式Fenton脱硝反应器的液滴对撞混合反应机理研究

国家自然科学基金

0+阅读 · 2014年12月31日

自旋轨道耦合BEC系统的混沌特性研究

国家自然科学基金

0+阅读 · 2014年12月31日

城市地铁用LiB-EDLC混合储能系统功率/能量匹配特性及协同控制策略

国家自然科学基金

0+阅读 · 2014年12月31日

Hybrid Human-Agent Social Dilemmas in Energy Markets

Arxiv

0+阅读 · 3月12日

Fast and low energy approximate full adder based on FELIX logic

Arxiv

0+阅读 · 2月25日

Quantum Scrambling Born Machine

Quantum Scrambling Born Machine

Arxiv

0+阅读 · 2月19日

Multi-Agent Home Energy Management Assistant

Arxiv

0+阅读 · 2月16日

Intrinsic-Energy Joint Embedding Predictive Architectures Induce Quasimetric Spaces

Arxiv

0+阅读 · 2月12日

TyphoonMLA: A Mixed Naive-Absorb MLA Kernel For Shared Prefix

Arxiv

0+阅读 · 2月12日

DirMoE: Dirichlet-routed Mixture of Experts

Arxiv

0+阅读 · 2月9日

Orthogonal Self-Attention

Arxiv

0+阅读 · 2月5日

Light Forcing: Accelerating Autoregressive Video Diffusion via Sparse Attention

Arxiv

0+阅读 · 2月4日

Windowed SummaryMixing: An Efficient Fine-Tuning of Self-Supervised Learning Models for Low-resource Speech Recognition

Arxiv

0+阅读 · 2月4日

VIP会员

文章信息

相关主题

最新内容

《国防领域敏感性分析白皮书》

《国防领域敏感性分析白皮书》

专知会员服务

0+阅读 · 今天3:42

综述 | 从问答到任务完成：Agent系统与Harness设计

综述 | 从问答到任务完成：Agent系统与Harness设计

专知会员服务

3+阅读 · 6月24日

Agentic RL：框架、实践与长程智能体训练

Agentic RL：框架、实践与长程智能体训练

专知会员服务

2+阅读 · 6月24日

反无人机拦截器训练与运用课程：对美国陆军部队发展的启示

反无人机拦截器训练与运用课程：对美国陆军部队发展的启示

专知会员服务

8+阅读 · 6月24日

重新思考无人机时代的生存能力

重新思考无人机时代的生存能力

专知会员服务

6+阅读 · 6月24日

装甲突击旅：现代战争思考、战斗与组织

装甲突击旅：现代战争思考、战斗与组织

专知会员服务

5+阅读 · 6月24日

在人工智能加速决策环境中拓展OODA循环

在人工智能加速决策环境中拓展OODA循环

专知会员服务

6+阅读 · 6月24日

《廉价自杀式无人机战争的军事战略影响：乌克兰与伊朗案例研究》

《廉价自杀式无人机战争的军事战略影响：乌克兰与伊朗案例研究》

专知会员服务

6+阅读 · 6月24日

军事欺骗：供作战战术指挥官使用的工具

军事欺骗：供作战战术指挥官使用的工具

专知会员服务

5+阅读 · 6月24日

ICML 2026 | CFPO：用反事实策略优化提升多模态推理

ICML 2026 | CFPO：用反事实策略优化提升多模态推理

专知会员服务

4+阅读 · 6月23日

综述 | 世界动作模型：少做梦，多行动

综述 | 世界动作模型：少做梦，多行动

专知会员服务

7+阅读 · 6月23日

美以伊冲突：无人机与人工智能的运用

美以伊冲突：无人机与人工智能的运用

专知会员服务

12+阅读 · 6月23日

《战时图神经网络：整合以色列-伊朗冲突中的网络安全与无人机智能》最新50页文献

《战时图神经网络：整合以色列-伊朗冲突中的网络安全与无人机智能》最新50页文献

专知会员服务

6+阅读 · 6月23日

《特种部队在透明战场中的生存力》最新报告

《特种部队在透明战场中的生存力》最新报告

专知会员服务

5+阅读 · 6月23日

《自主无人机蜂群协同与控制系统：人工智能赋能的战场协同与自主任务编排平台》

《自主无人机蜂群协同与控制系统：人工智能赋能的战场协同与自主任务编排平台》

专知会员服务

9+阅读 · 6月23日

相关VIP内容

TransMLA：多头潜在注意力（MLA）即为所需

TransMLA：多头潜在注意力（MLA）即为所需

专知会员服务

23+阅读 · 2025年2月13日

《基于智能自适应混合控制实现自主性：采用自适应协作/控制技术的智能跨域多无人系统规划器》107页干货

《基于智能自适应混合控制实现自主性：采用自适应协作/控制技术的智能跨域多无人系统规划器》107页干货

专知会员服务

58+阅读 · 2024年11月12日

大模型时代还不理解自注意力(Self-Attention)？这篇文章教你从头写代码实现

大模型时代还不理解自注意力(Self-Attention)？这篇文章教你从头写代码实现

专知会员服务

36+阅读 · 2024年2月12日

【CVPR2023】面向自监督视觉表示学习的混合自编码器

【CVPR2023】面向自监督视觉表示学习的混合自编码器

专知会员服务

25+阅读 · 2023年4月3日

主动学习预测结合自由能进行分子优化

主动学习预测结合自由能进行分子优化

专知会员服务

16+阅读 · 2022年9月18日

自监督如何做推荐？昆士兰大学最新《自监督学习推荐系统》综述论文，阐述对比、生成、预测和混合四大类方法

自监督如何做推荐？昆士兰大学最新《自监督学习推荐系统》综述论文，阐述对比、生成、预测和混合四大类方法

专知会员服务

32+阅读 · 2022年4月5日

【CVPR 2022】MixFormer：跨窗口与维度的特征融合，MixFormer: Mixing Features across Windows and Dimensions

【CVPR 2022】MixFormer：跨窗口与维度的特征融合，MixFormer: Mixing Features across Windows and Dimensions

专知会员服务

15+阅读 · 2022年3月19日

【YannLecun最新报告】自监督学习与能量模型，附99页ppt与视频

【YannLecun最新报告】自监督学习与能量模型，附99页ppt与视频

专知会员服务

56+阅读 · 2021年6月19日

无所不能的Self-Attention！洛桑理工ICLR2020论文验证「自注意力可以表达任何CNN卷积滤波层」

无所不能的Self-Attention！洛桑理工ICLR2020论文验证「自注意力可以表达任何CNN卷积滤波层」

专知会员服务

57+阅读 · 2020年1月12日

【Yann Lecun最新报告】基于能量的自监督学习（Energy-Based Self-Supervised Learning ）附68页ppt

【Yann Lecun最新报告】基于能量的自监督学习（Energy-Based Self-Supervised Learning ）附68页ppt

专知会员服务

87+阅读 · 2019年11月24日

热门VIP内容

开通专知VIP会员享更多权益服务

综述 | 从问答到任务完成：Agent系统与Harness设计

反无人机拦截器训练与运用课程：对美国陆军部队发展的启示

《国防领域敏感性分析白皮书》

Agentic RL：框架、实践与长程智能体训练

相关资讯

多模态怎么用自监督？爱丁堡等最新《自监督多模态学习》综述，详述目标函数、数据对齐和模型架构

多模态怎么用自监督？爱丁堡等最新《自监督多模态学习》综述，详述目标函数、数据对齐和模型架构

专知

10+阅读 · 2023年4月6日

推荐！【DARPA终身学习机器（L2M）】《自主系统中用于感知和行动的终身学习》美空军、宾大2022最新234页技术报告

推荐！【DARPA终身学习机器（L2M）】《自主系统中用于感知和行动的终身学习》美空军、宾大2022最新234页技术报告

专知

27+阅读 · 2022年11月24日

无所不能的Self-Attention！洛桑理工ICLR2020论文验证「自注意力可以表达任何CNN卷积滤波层」

无所不能的Self-Attention！洛桑理工ICLR2020论文验证「自注意力可以表达任何CNN卷积滤波层」

专知

24+阅读 · 2020年1月12日

概述自动机器学习（AutoML）

概述自动机器学习（AutoML）

人工智能学家

19+阅读 · 2019年8月11日

告别调参，AutoML新书发布

告别调参，AutoML新书发布

专知

14+阅读 · 2018年10月16日

入门 | 什么是自注意力机制？

入门 | 什么是自注意力机制？

机器之心

17+阅读 · 2018年8月19日

FAGAN：完全注意力机制（Full Attention）GAN，Self-attention+GAN

FAGAN：完全注意力机制（Full Attention）GAN，Self-attention+GAN

专知

32+阅读 · 2018年8月14日

Ian Goodfellow等提出自注意力GAN，ImageNet图像合成获最优结果！

Ian Goodfellow等提出自注意力GAN，ImageNet图像合成获最优结果！

新智元

11+阅读 · 2018年5月24日

自然语言处理中的自注意力机制（Self-Attention Mechanism）

自然语言处理中的自注意力机制（Self-Attention Mechanism）

PaperWeekly

22+阅读 · 2018年3月28日

【论文推荐】最新七篇自注意力机制(Self-attention)相关论文—结构化自注意力、相对位置、混合、句子表达、文本向量

【论文推荐】最新七篇自注意力机制(Self-attention)相关论文—结构化自注意力、相对位置、混合、句子表达、文本向量

专知

29+阅读 · 2018年3月12日

相关论文

Hybrid Human-Agent Social Dilemmas in Energy Markets

Arxiv

0+阅读 · 3月12日

Fast and low energy approximate full adder based on FELIX logic

Arxiv

0+阅读 · 2月25日

Quantum Scrambling Born Machine

Quantum Scrambling Born Machine

Arxiv

0+阅读 · 2月19日

Multi-Agent Home Energy Management Assistant

Arxiv

0+阅读 · 2月16日

Intrinsic-Energy Joint Embedding Predictive Architectures Induce Quasimetric Spaces

Arxiv

0+阅读 · 2月12日

TyphoonMLA: A Mixed Naive-Absorb MLA Kernel For Shared Prefix

Arxiv

0+阅读 · 2月12日

DirMoE: Dirichlet-routed Mixture of Experts

Arxiv

0+阅读 · 2月9日

Orthogonal Self-Attention

Arxiv

0+阅读 · 2月5日

Light Forcing: Accelerating Autoregressive Video Diffusion via Sparse Attention

Arxiv

0+阅读 · 2月4日

Windowed SummaryMixing: An Efficient Fine-Tuning of Self-Supervised Learning Models for Low-resource Speech Recognition

Arxiv

0+阅读 · 2月4日

相关基金

再生能源供电分布式无线随机接入关键技术

国家自然科学基金

0+阅读 · 2015年12月31日

不锈钢无纺布基Li4Ti5O12@石墨烯/石墨烯@碳泡沫锂离子混合超级电容器

国家自然科学基金

0+阅读 · 2015年12月31日

微功率能量收集系统中片上集成的超低压自启动方法研究

国家自然科学基金

0+阅读 · 2015年12月31日

随机混杂预测控制的插电式混合动力系统能量管理策略优化机理

国家自然科学基金

0+阅读 · 2015年12月31日

混合等离激元纳米流体的太阳能吸收特性及其调控方法研究

国家自然科学基金

0+阅读 · 2015年12月31日

低维自旋轨道耦合费米气体的量子蒙特卡罗研究

国家自然科学基金

0+阅读 · 2015年12月31日

基于动态匹配的高能量利用率多层堆叠结构静态随机存储器（SRAM）关键技术

国家自然科学基金

0+阅读 · 2015年12月31日

多喷嘴对置式Fenton脱硝反应器的液滴对撞混合反应机理研究

国家自然科学基金

0+阅读 · 2014年12月31日

自旋轨道耦合BEC系统的混沌特性研究

国家自然科学基金

0+阅读 · 2014年12月31日

城市地铁用LiB-EDLC混合储能系统功率/能量匹配特性及协同控制策略

国家自然科学基金

0+阅读 · 2014年12月31日

微信扫码咨询专知VIP会员