该研究探究了结合盲音频录音和3D场景信息对新视角声学合成的益处。研究确定了新视角声学合成的主要挑战,并证明了融入从3D重建房间导出的房间脉冲响应(RIRs)使得相同的网络能够统一解决这些任务。在Matterport3D-NVAS数据集上的模拟研究中,该方法优于现有方法,证明了其在利用3D视觉信息方面的有效性。
完成下面两步后,将自动完成登录并继续当前操作。