通过视觉 - 非对称一致性学习在文档图像中增强的语义实体识别

💡 原文中文,约300字,阅读约需1分钟。
📝

内容提要

本文提出了一种增强模型对细粒度视觉和布局特征的捕捉能力的新方法,通过引入颜色先验知识,并在基准数据集上实验证明其优于强大的 LayoutLM 系列基线。研究不同的颜色方案对该方法的影响,为优化模型性能提供了启示。

🏷️

标签

➡️

继续阅读