互易隐场用于预计算声传播 (Reciprocal Latent Fields for Precomputed Sound Propagation) - 专知论文

会员服务 ·

0

声传播 · 声学参数 · 内存 · 解码 · 虚拟场景 ·

Reciprocal Latent Fields for Precomputed Sound Propagation

翻译：互易隐场用于预计算声传播

Hugo Seuté,Pranai Vasudev,Etienne Richan,Louis-Xavier Buffoni

from arxiv, Temporary pre-print, will be updated. In review at a conference

Realistic sound propagation is essential for immersion in a virtual scene, yet physically accurate wave-based simulations remain computationally prohibitive for real-time applications. Wave coding methods address this limitation by precomputing and compressing impulse responses of a given scene into a set of scalar acoustic parameters, which can reach unmanageable sizes in large environments with many source-receiver pairs. We introduce Reciprocal Latent Fields (RLF), a memory-efficient framework for encoding and predicting these acoustic parameters. The RLF framework employs a volumetric grid of trainable latent embeddings decoded with a symmetric function, ensuring acoustic reciprocity. We study a variety of decoders and show that leveraging Riemannian metric learning leads to a better reproduction of acoustic phenomena in complex scenes. Experimental validation demonstrates that RLF maintains replication quality while reducing the memory footprint by several orders of magnitude. Furthermore, a MUSHRA-like subjective listening test indicates that sound rendered via RLF is perceptually indistinguishable from ground-truth simulations.

翻译：真实的声传播对于虚拟场景的沉浸感至关重要，然而物理上精确的基于波动方程的模拟在计算上仍然过于昂贵，难以用于实时应用。波编码方法通过预计算并将给定场景的脉冲响应压缩为一组标量声学参数来解决这一限制，但在具有大量声源-接收器对的大型环境中，这些参数可能达到难以管理的规模。我们引入了互易隐场（Reciprocal Latent Fields, RLF），这是一种用于编码和预测这些声学参数的高内存效率框架。RLF框架采用一个由可训练隐嵌入构成的体素网格，并通过一个对称函数进行解码，从而确保声学互易性。我们研究了多种解码器，并证明利用黎曼度量学习能够更好地在复杂场景中复现声学现象。实验验证表明，RLF在保持复现质量的同时，将内存占用减少了数个数量级。此外，一项类似MUSHRA的主观听力测试表明，通过RLF渲染的声音在感知上与真实模拟结果无法区分。

0

相关内容

声传播

【NeurIPS 2024】用于变分似然估计和图像去噪的扩散先验

【NeurIPS 2024】用于变分似然估计和图像去噪的扩散先验

专知会员服务

15+阅读 · 2024年10月26日

《使用 "先跟踪后检测 "方法在主动声纳阵列中检测和跟踪多个移动目标》

《使用 "先跟踪后检测 "方法在主动声纳阵列中检测和跟踪多个移动目标》

专知会员服务

19+阅读 · 2024年4月24日

【ICML2022】Branchformer:并行MLP-Attention架构，捕捉局部和全局上下文，用于语音识别和理解

【ICML2022】Branchformer:并行MLP-Attention架构，捕捉局部和全局上下文，用于语音识别和理解

专知会员服务

25+阅读 · 2022年7月8日

【ICASSP 2022教程】声场估计:最新进展与应用，日本东京大学Shoichi Koyama博士

【ICASSP 2022教程】声场估计:最新进展与应用，日本东京大学Shoichi Koyama博士

专知会员服务

24+阅读 · 2022年6月7日

图像去噪方法概述

专知会员服务

43+阅读 · 2021年8月30日

CVPR 2021｜无需干净图像的自监督图像降噪

专知会员服务

39+阅读 · 2021年3月29日

【IJCAI2020-Facebook】利用弱标记数据对声音进行大规模的视听学习

【IJCAI2020-Facebook】利用弱标记数据对声音进行大规模的视听学习

专知会员服务

19+阅读 · 2020年6月3日

【Google Research】Wavesplit:通过说话者聚类实现端到端的语音分离，Wavesplit: End-to-End Speech Separation by Speaker Clustering

【Google Research】Wavesplit:通过说话者聚类实现端到端的语音分离，Wavesplit: End-to-End Speech Separation by Speaker Clustering

专知会员服务

19+阅读 · 2020年2月26日

【Science论文】基于波的物理现象作为一种模拟递归神经网络（Wave physics as an analog recurrent neural network）

【Science论文】基于波的物理现象作为一种模拟递归神经网络（Wave physics as an analog recurrent neural network）

专知会员服务

12+阅读 · 2020年1月3日

【KDD2019|讲座推荐】假设检验与统计声音模式挖掘：Hypothesis Testing and Statistically-sound Pattern Mining

【KDD2019|讲座推荐】假设检验与统计声音模式挖掘：Hypothesis Testing and Statistically-sound Pattern Mining

专知会员服务

22+阅读 · 2019年12月6日

图像/视频去噪算法资源集锦

图像/视频去噪算法资源集锦

专知

19+阅读 · 2019年12月14日

Deformable Kernels，用于图像/视频去噪，即将开源

Deformable Kernels，用于图像/视频去噪，即将开源

极市平台

13+阅读 · 2019年8月29日

BASNet，一种能关注边缘的显著性检测算法

BASNet，一种能关注边缘的显著性检测算法

极市平台

15+阅读 · 2019年7月19日

无需建模：谷歌SpecAugment即可获得最先进的语音识别性能

无需建模：谷歌SpecAugment即可获得最先进的语音识别性能

云头条

18+阅读 · 2019年4月23日

近期声学领域前沿论文(No. 3)

近期声学领域前沿论文(No. 3)

深度学习每日摘要

24+阅读 · 2019年3月31日

论文浅尝 | 基于深度强化学习的远程监督数据集的降噪

论文浅尝 | 基于深度强化学习的远程监督数据集的降噪

开放知识图谱

29+阅读 · 2019年1月17日

学界 | 最大化互信息来学习深度表示，Bengio等提出Deep INFOMAX

学界 | 最大化互信息来学习深度表示，Bengio等提出Deep INFOMAX

机器之心

10+阅读 · 2018年9月6日

DeepMind无监督表示学习重大突破：语音、图像、文本、强化学习全能冠军！

DeepMind无监督表示学习重大突破：语音、图像、文本、强化学习全能冠军！

新智元

12+阅读 · 2018年7月13日

如何设计基于深度学习的图像压缩算法

如何设计基于深度学习的图像压缩算法

论智

41+阅读 · 2018年4月26日

图像降噪算法介绍及实现汇总

图像降噪算法介绍及实现汇总

极市平台

26+阅读 · 2018年1月3日

间接优化的高效Monte Carlo声传播研究

国家自然科学基金

0+阅读 · 2017年12月31日

管道伴流声场问题计算的无网格-半解析耦合方法研究

国家自然科学基金

0+阅读 · 2015年12月31日

有理小波理论在多途信号解析与水声网络设计中的应用研究

国家自然科学基金

0+阅读 · 2015年12月31日

换流站滤波电容器装置辐射声场特性与优化措施研究

国家自然科学基金

0+阅读 · 2015年12月31日

低频主动声纳双曲线调频串信号-接收处理联合设计研究

国家自然科学基金

1+阅读 · 2015年12月31日

基于时序相似性的机场噪声监测点交互预测

国家自然科学基金

1+阅读 · 2015年12月31日

回声干扰抑制中的自适应信号处理算法研究

国家自然科学基金

1+阅读 · 2015年12月31日

环境自适应高灵敏度光纤声传感器研究

国家自然科学基金

0+阅读 · 2015年12月31日

基于声光互作用动量匹配的相干探测光学降噪方法研究

国家自然科学基金

0+阅读 · 2014年12月31日

共振增强低噪声小尺度传输光场耦合效率的研究

国家自然科学基金

0+阅读 · 2014年12月31日

VoiceBridge: General Speech Restoration with One-step Latent Bridge Models

Arxiv

0+阅读 · 2月15日

A Wavefield Correlation Approach to Improve Sound Speed Estimation in Ultrasound Autofocusing

Arxiv

0+阅读 · 2月13日

Surface impedance inference via neural fields and sparse acoustic data obtained by a compact array

Arxiv

0+阅读 · 2月11日

VoiceBridge: Designing Latent Bridge Models for General Speech Restoration at Scale

Arxiv

0+阅读 · 2月11日

Neural Gaussian Radio Fields for Channel Estimation

Arxiv

0+阅读 · 2月10日

Neural Gaussian Radio Fields for Channel Estimation

Arxiv

0+阅读 · 2月9日

Spectral Prefiltering of Neural Fields

Arxiv

0+阅读 · 2月4日

GRAM: Spatial general-purpose audio representation models for real-world applications

Arxiv

0+阅读 · 2月4日

GRAM: Spatial general-purpose audio representations for real-world environments

Arxiv

0+阅读 · 2月4日

SoundCompass: Navigating Target Sound Extraction With Effective Directional Clue Integration In Complex Acoustic Scenes

Arxiv

0+阅读 · 1月19日

VIP会员

文章信息

相关主题

相关VIP内容

【NeurIPS 2024】用于变分似然估计和图像去噪的扩散先验

【NeurIPS 2024】用于变分似然估计和图像去噪的扩散先验

专知会员服务

15+阅读 · 2024年10月26日

《使用 "先跟踪后检测 "方法在主动声纳阵列中检测和跟踪多个移动目标》

《使用 "先跟踪后检测 "方法在主动声纳阵列中检测和跟踪多个移动目标》

专知会员服务

19+阅读 · 2024年4月24日

【ICML2022】Branchformer:并行MLP-Attention架构，捕捉局部和全局上下文，用于语音识别和理解

【ICML2022】Branchformer:并行MLP-Attention架构，捕捉局部和全局上下文，用于语音识别和理解

专知会员服务

25+阅读 · 2022年7月8日

【ICASSP 2022教程】声场估计:最新进展与应用，日本东京大学Shoichi Koyama博士

【ICASSP 2022教程】声场估计:最新进展与应用，日本东京大学Shoichi Koyama博士

专知会员服务

24+阅读 · 2022年6月7日

图像去噪方法概述

专知会员服务

43+阅读 · 2021年8月30日

CVPR 2021｜无需干净图像的自监督图像降噪

专知会员服务

39+阅读 · 2021年3月29日

【IJCAI2020-Facebook】利用弱标记数据对声音进行大规模的视听学习

【IJCAI2020-Facebook】利用弱标记数据对声音进行大规模的视听学习

专知会员服务

19+阅读 · 2020年6月3日

【Google Research】Wavesplit:通过说话者聚类实现端到端的语音分离，Wavesplit: End-to-End Speech Separation by Speaker Clustering

【Google Research】Wavesplit:通过说话者聚类实现端到端的语音分离，Wavesplit: End-to-End Speech Separation by Speaker Clustering

专知会员服务

19+阅读 · 2020年2月26日

【Science论文】基于波的物理现象作为一种模拟递归神经网络（Wave physics as an analog recurrent neural network）

【Science论文】基于波的物理现象作为一种模拟递归神经网络（Wave physics as an analog recurrent neural network）

专知会员服务

12+阅读 · 2020年1月3日

【KDD2019|讲座推荐】假设检验与统计声音模式挖掘：Hypothesis Testing and Statistically-sound Pattern Mining

【KDD2019|讲座推荐】假设检验与统计声音模式挖掘：Hypothesis Testing and Statistically-sound Pattern Mining

专知会员服务

22+阅读 · 2019年12月6日

热门VIP内容

开通专知VIP会员享更多权益服务

《无人机与战争：被忽视的环境影响及无人机保护潜力》

俄罗斯规划未来无人机驱动军队

《整合杀伤链：一个用于边缘目标验证与战术推理的零样本框架》最新资料

《人工智能、武器与影响力：前沿模型在模拟核危机中展现复杂推理》2026最新46页报告

相关资讯

图像/视频去噪算法资源集锦

图像/视频去噪算法资源集锦

专知

19+阅读 · 2019年12月14日

Deformable Kernels，用于图像/视频去噪，即将开源

Deformable Kernels，用于图像/视频去噪，即将开源

极市平台

13+阅读 · 2019年8月29日

BASNet，一种能关注边缘的显著性检测算法

BASNet，一种能关注边缘的显著性检测算法

极市平台

15+阅读 · 2019年7月19日

无需建模：谷歌SpecAugment即可获得最先进的语音识别性能

无需建模：谷歌SpecAugment即可获得最先进的语音识别性能

云头条

18+阅读 · 2019年4月23日

近期声学领域前沿论文(No. 3)

近期声学领域前沿论文(No. 3)

深度学习每日摘要

24+阅读 · 2019年3月31日

论文浅尝 | 基于深度强化学习的远程监督数据集的降噪

论文浅尝 | 基于深度强化学习的远程监督数据集的降噪

开放知识图谱

29+阅读 · 2019年1月17日

学界 | 最大化互信息来学习深度表示，Bengio等提出Deep INFOMAX

学界 | 最大化互信息来学习深度表示，Bengio等提出Deep INFOMAX

机器之心

10+阅读 · 2018年9月6日

DeepMind无监督表示学习重大突破：语音、图像、文本、强化学习全能冠军！

DeepMind无监督表示学习重大突破：语音、图像、文本、强化学习全能冠军！

新智元

12+阅读 · 2018年7月13日

如何设计基于深度学习的图像压缩算法

如何设计基于深度学习的图像压缩算法

论智

41+阅读 · 2018年4月26日

图像降噪算法介绍及实现汇总

图像降噪算法介绍及实现汇总

极市平台

26+阅读 · 2018年1月3日

相关论文

VoiceBridge: General Speech Restoration with One-step Latent Bridge Models

Arxiv

0+阅读 · 2月15日

A Wavefield Correlation Approach to Improve Sound Speed Estimation in Ultrasound Autofocusing

Arxiv

0+阅读 · 2月13日

Surface impedance inference via neural fields and sparse acoustic data obtained by a compact array

Arxiv

0+阅读 · 2月11日

VoiceBridge: Designing Latent Bridge Models for General Speech Restoration at Scale

Arxiv

0+阅读 · 2月11日

Neural Gaussian Radio Fields for Channel Estimation

Arxiv

0+阅读 · 2月10日

Neural Gaussian Radio Fields for Channel Estimation

Arxiv

0+阅读 · 2月9日

Spectral Prefiltering of Neural Fields

Arxiv

0+阅读 · 2月4日

GRAM: Spatial general-purpose audio representation models for real-world applications

Arxiv

0+阅读 · 2月4日

GRAM: Spatial general-purpose audio representations for real-world environments

Arxiv

0+阅读 · 2月4日

SoundCompass: Navigating Target Sound Extraction With Effective Directional Clue Integration In Complex Acoustic Scenes

Arxiv

0+阅读 · 1月19日

相关基金

间接优化的高效Monte Carlo声传播研究

国家自然科学基金

0+阅读 · 2017年12月31日

管道伴流声场问题计算的无网格-半解析耦合方法研究

国家自然科学基金

0+阅读 · 2015年12月31日

有理小波理论在多途信号解析与水声网络设计中的应用研究

国家自然科学基金

0+阅读 · 2015年12月31日

换流站滤波电容器装置辐射声场特性与优化措施研究

国家自然科学基金

0+阅读 · 2015年12月31日

低频主动声纳双曲线调频串信号-接收处理联合设计研究

国家自然科学基金

1+阅读 · 2015年12月31日

基于时序相似性的机场噪声监测点交互预测

国家自然科学基金

1+阅读 · 2015年12月31日

回声干扰抑制中的自适应信号处理算法研究

国家自然科学基金

1+阅读 · 2015年12月31日

环境自适应高灵敏度光纤声传感器研究

国家自然科学基金

0+阅读 · 2015年12月31日

基于声光互作用动量匹配的相干探测光学降噪方法研究

国家自然科学基金

0+阅读 · 2014年12月31日

共振增强低噪声小尺度传输光场耦合效率的研究

国家自然科学基金

0+阅读 · 2014年12月31日

微信扫码咨询专知VIP会员