该研究提出了一种新方法,结合稳定扩散的想象网络和增强学习,有效利用视觉信息,显著提升多模态翻译效果。
本文提出了一种新型多模态机器翻译方法,结合机器翻译与视觉信息,发布了CoMMuTE数据集,显著提升了翻译性能。研究表明,在视觉上下文下,多模态翻译优于传统文本翻译,强调了合适数据集的重要性,并提出了一种无监督神经机器翻译方法,通过图像识别增强翻译效果。
完成下面两步后,将自动完成登录并继续当前操作。