音频对齐:使用高效多序列对齐评估和可视化基于文本的日识别(扩展版)

💡 原文中文,约400字,阅读约需1分钟。
📝

内容提要

本文提出了一种新的基于文本的发言人分离评估方法,通过对参考和假设转录中的标记进行对齐,进行话语和单词级别的评估。作者的工作打包为两个工具,align4d 提供用于对齐算法的 API,TranscribeView 用于可视化和评估发言人分离错误。

🏷️

标签

➡️

继续阅读