《计算机应用与软件杂志》发表论文赏析
作者:丁建立, 袁梓瑞, 王怀超
摘要:视频级动作识别存在着数据量大、识别速度慢的问题,主要原因是需要提取空间维度上人体姿态,还需要考虑时间维度上动作关联。提出一种基于视频关键帧提取的快速T3D动作识别模型,通过改进的Superpoint网络提取视频关键帧,缩减数据量。以T3D网络为基础,时空分解其关键模块可变时序卷积层,显著提升了其计算效率。在公共数据集UCF-101和HMDB-51数据集进行了实验验证,准确率和原T3D网络近似,但其识别速度为原T3D网络的2倍,更适合于实际的应用场景。
关键词:快速动作识别, 视频关键帧提取, T3D网络, Superpoint网络, 快速识别