《信号处理杂志》发表论文赏析

基于双对齐和对比学习的多模态情感识别

来源:信号处理杂志 2025年第3期北京时间:

作者:文宇华, 李启飞, 周莹莹, 高迎明, 李雅

摘要:情感识别在现代人机交互、情感感知和沉浸式虚拟现实等领域具有重要价值,因其能够通过计算机自动识别和分类人类情感状态。随着多模态学习的发展,情感识别逐渐从传统的单一模态情感识别转向多模态情感识别。多模态情感识别涉及处理来自不同模态的数据,例如文本、语音和视觉。这些模态数据可以通过捕捉不同的情感特征,帮助模型更准确地理解人的情感状态。然而,现有的多模态情感识别中存在时间错位和模态异质性等一系列挑战。为了应对这些挑战,本文设计并实现了一种基于双对齐和对比学习的多模态情感识别模型。该模型结合了文本、语音和视觉三种模态,通过双对齐模块实现不同模态之间的全面对齐。其中,特征级对齐利用交叉注意力机制实现时间维度上的动态对齐;样本级对齐利用对比学习在特征空间中对齐各个模态。模型引入监督对比学习进一步利用标签信息,挖掘细粒度的情感线索,增强模型的鲁棒性。此外,本文利用自注意力机制来学习多模态特征间的交互,有效提升了模型性能。实验结果表明,该模型在三个公开数据集上表现优异,在大多数指标上均优于现有模型。综上所述,本文提出的基于双对齐和对比学习的多模态情感识别模型,有效解决了多模态情感识别中的关键挑战,取得了显著的性能提升。

关键词:多模态学习, 情感识别, 对比学习, 多模态对齐

填文献完整题目 获取完整文献

填写需求
联系方式
注:学术顾问会在1小时内联系您,请留意!