本文提出了一种基于大型语言模型的多模态框架,用于检测恶意互联网迷因,特别是表情包。通过集成学习和视觉语言模型,研究提高了检测性能,并在相关挑战中取得了优异成绩。该方法结合图像和文本信息,探索半监督学习技术以提升分类准确率。
完成下面两步后,将自动完成登录并继续当前操作。