《计算机工程与应用杂志》发表论文赏析
作者:张逸,谷毅,韩芳,王直杰
单位:1.东华大学 信息科学与技术学院,上海 201620;2.上海航天电子技术研究所,上海 201109
摘要:为了方便网络传输和本地存储需对大量音频文件进行压缩处理,但获取存储空间下降的同时会牺牲相应的音质。针对音频最常使用的MPEG-1Layer3有损压缩方法,即mp3文件,使用ASRGAN(Audio Super-Resolution Generative Adversarial Nets)对码率下降的音频进行音质还原,使用生成模型和判别模型相互促进学习,并进行交叠加权处理,同时使用空洞卷积和双向循环网络增强整体网络对超长序列处理的能力,最终选出最优的音频提升模型。该方法减小了音频传输和存储所使用的网络带宽和存储容量,同时还能够获得较好的音质。
关键词:生成对抗网络(GAN),音质提升,模型压缩