《环境科学杂志》发表论文赏析
作者:吴英晗,许嘉,段玉森,伏晴艳,杨文
单位:中国环境科学研究院, 北京 100012,中国环境科学研究院, 北京 100012,上海市环境监测中心, 上海 200235,上海市环境监测中心, 上海 200235,中国环境科学研究院, 北京 100012
摘要:地统计模型被广泛应用于环境空气污染物暴露模拟,但不同建模方法及其模拟结果之间的对比研究较少.基于上海2016~2019年55个环境空气监测点位的NO2和PM2.5观测数据,以及交通路网、排放源兴趣点和卫星数据等地统计变量,应用偏最小二乘回归(PLS)、监督学习线性回归(SLR)和机器学习随机森林(RF)这3种建模方法创建年暴露模型,并进一步应用普通克里金插值(OK)法分析模型残差,构建复合模型.应用交叉验证对模型的模拟效果进行检验,选取每一种建模方法的最优模型结构(是否应用OK)作为最终模型.结果表明,NO2模型中表现最好的是RF-OK (Rmse2为0.70~0.82)和PLS-OK模型(Rmse2为0.78~0.84);PM2.5模型中PLS模型(Rmse2为0.62~0.71)优于SLR-OK (Rmse2为0.40~0.79)和RF-OK (Rmse2:0.31~0.56)模型.应用3种建模方法对上海1 km网格开展年暴露模拟和对比,NO2模型间模拟结果的相关性(r为0.82~0.91)高于PM2.5模拟结果的相关性(r为0.66~0.96).基于3种模型2019年的模拟结果,评估了上海NO2和PM2.5的人群暴露水平.
关键词:PM2.5,NO2,地统计模型,偏最小二乘回归(PLS),随机森林(RF),