《图书情报工作杂志》发表论文赏析

依存句法特征的科研命名实体识别算法

来源:图书情报工作杂志2020年第11期北京时间:

作者:赵华茗,钱力,余丽

单位:1 中国科学院文献情报中心 北京 100190;<br />\r\n2 中国科学院大学经济与管理学院图书情报与档案管理系 北京 100190

摘要:[目的/意义] 探索科研命名实体及其关系的识别与抽取,提升其在长句等复杂情况下的识别效果,为进一步的应用提供参考与借鉴。[方法/过程] 以依存句法特征分析为基础,提出一种科研命名实体关系抽取方法,过程包括:①使用Standford Tagger工具对目标文本进行词性标注;②基于标注结果,围绕核心谓词和SAO结构,将目标文本分割为结构规范的语义片段;③通过依存句法分析,找出与核心谓词语义相关的主语和宾语,构成(实体,关系,实体)三元组。[结果/结论] 与Ollie、Reverb等主流算法进行的对比测试表明,该方法可以有效提升科研命名实体识别的准确性。

关键词:依存句法分析,科研命名实体,实体识别,关系抽取,

基金资助:本文系中国科学院文献情报能力建设专项项目&quot;文献情报'数据湖&rsquo;及开放式大数据框架建设&quot;(项目编号:院1852)与国家科技图书文献中心专项任务&quot;多源数据增值与知识计算方法研究&quot;(项目编号:K180201001)研究成果之一。

填文献完整题目 获取完整文献

填写需求
联系方式
注:学术顾问会在1小时内联系您,请留意!