《计算机工程与应用杂志》发表论文赏析
作者:王安启, 李明轩, 程泊宣
单位:中国人民公安大学 侦查学院,北京 100038
摘要:随着互联网和视频平台的快速发展,网络视频内容日益多样,如何有效评估用户对不同类型网络视频的满意度成为视频内容推广和人机交互研究领域的关键问题。尽管融合文本、语音和视觉信息的多模态情感分析方法已被广泛应用于用户情绪识别,但情绪状态并不能完全反映用户对内容的综合体验。现有研究往往仅停留在情感极性的建模,缺乏对情绪与满意度之间关联机制的探讨,导致满意度这一高阶心理结构长期被忽视。为了更加准确地评估用户对于网络视频的综合情感,提出了基于多模态融合的视频满意度分析框架——MVSA(multimodal video satisfaction analysis),同时,构建了一个针对网络视频用户满意度研究的多模态数据集MVS-Eval(multimodal video satisfaction evaluation),涵盖了吸引力、专注度、参与度等多维度满意度标签,旨在全面建模用户对视频内容的主观反馈,进一步提出了基于模态一致性训练和满意度引导融合机制的多模态满意度估计算法MUSE(multimodal understanding for satisfaction estimation),有效建立情绪-满意度链路,并提升了模型的满意度指标预测性能与跨场景泛化能力。此外,MVSA框架集成了一个智能反馈处理平台,能够自动解析用户反馈视频并生成结构化的满意度评估结果。实验结果表明,MUSE在多个基准任务中显著优于现有主流模型,验证了其在多类型网络视频满意度建模中的有效性与可解释性。
关键词:网络视频,多模态数据,满意度分析