《图书情报工作杂志》发表论文赏析
作者:邱科达,马建玲
单位:中国科学院兰州文献情报中心 兰州 730000;中国科学院西北生态环境资源研究院 兰州 730000;中国科学院大学经济与管理学院图书情报与档案管理系 北京 100049
摘要:[目的/意义] 梳理和总结基于机器学习的自动术语抽取的相关研究,为领域相关人员提供参考。[方法/过程] 在CNKI和EndNote的分析工具基础上,应用文献计量对主题的年度趋势和核心机构进行宏观分析,然后从抽取技术方法、数据集和评价以及应用3个方面进行主题内容分析。[结果/结论] 近些年,术语抽取研究取得了很大的进步,是知识系统、自然语言处理、情报分析等领域的基础工作。随着自然语言处理领域的迅猛发展,抽取技术开始朝着深度学习方向发展,但术语抽取的基础理论体系还有待完善,如评价指标、语料选取和效果评价方法。
关键词:术语抽取,机器学习,知识组织,文献计量,
基金资助:本文系国家自然科学基金面上项目"气候变化科学成果集成研究范式及其实现平台研究"(项目编号:41671535)和中国科学院文献情报能力建设专项"开放学术资源体系"(项目编号:Y7ZG081001)研究成果之一。