本文首次将迭代伪标签训练法应用于中英混合语音识别(CS-ASR),利用未标注数据提升性能。方法分三阶段:生成伪标签、两阶段双语模型训练及迭代优化。在SEAME数据集上,devman和devsge子集词错误率分别降低6.35%和8.29%,显著提升复杂混合场景识别精度。
完成下面两步后,将自动完成登录并继续当前操作。