ASDnB: Integrating Facial and Bodily Cues to Enhance Robustness in Active Speaker Detection

💡 原文英文,约100词,阅读约需1分钟。
📝

内容提要

本研究提出ASDnB模型,解决主动说话者检测中身体动态特征利用不足的问题。该模型通过整合面部与身体信息,在复杂条件下表现优异,实验结果在多个基准数据集上达到最先进水平。

🏷️

标签

➡️

继续阅读