• 综合
  • 标题
  • 关键词
  • 摘要
  • 学者
  • 期刊-刊名
  • 期刊-ISSN
  • 会议名称
搜索

作者:

刘博 (刘博.) (学者:刘博) | 张佳慧 (张佳慧.) | 李建强 (李建强.) (学者:李建强) | 李永 (李永.) | 郎建垒 (郎建垒.) (学者:郎建垒)

收录:

CSCD

摘要:

为了明确大气污染物、污染源、影响因素、评价指标、危害等之间的关系,分析大气污染传播路径,建立了一个较为清晰、完善的大气污染领域本体.首先,基于机器学习和自然语言处理等技术,提出一种基于注意力机制的序列标注联合抽取实体关系的方法,在双向长短时记忆(long short-term memory,LSTM)网络模型中加入注意力机制,并将实体和关系联合标注,从而进行实体关系抽取.其次,结合词频-逆文档频率(term frequency-inverse document frequency,TF-IDF)核心概念挖掘方法进行知识抽取,并将概念、属性、关系和实例组织起来,从而实现大气污染本体模型的半自动构建.最后,在本体和实例的基础上通过Protégé的SPARQL Query模块和HermiT推理机分别进行条件推理和可视化推理.结果表明,基于注意力机制的序列标注实体关系联合抽取方法所构建的大气污染领域本体包含核心实体68个,实例数360个,相较于现有的本领域本体,在全面性、有效性、准确性和可重用性方面都有较好表现,同时推理出了Ca2+和K+等污染离子的传播路径.因此,基于注意力机制的序列标注联合抽取实体关系的方法能够有效地半自动构建大气污染领域本体,推理出清晰的大气污染传播路径.

关键词:

大气污染 实体关系抽取 本体 注意力机制 自然语言处理 语义推理

作者机构:

  • [ 1 ] [刘博]北京工业大学
  • [ 2 ] [张佳慧]北京工业大学区域大气污染控制北京市重点实验室,北京 100124

通讯作者信息:

电子邮件地址:

查看成果更多字段

相关关键词:

来源 :

北京工业大学学报

ISSN: 0254-0037

年份: 2021

期: 3

卷: 47

页码: 246-259

被引次数:

WoS核心集被引频次: 0

SCOPUS被引频次: 1

ESI高被引论文在榜: 0 展开所有

万方被引频次: -1

中文被引频次:

近30日浏览量: 3

在线人数/总访问数:5878/2941936
地址:北京工业大学图书馆(北京市朝阳区平乐园100号 邮编:100124) 联系我们:010-67392185
版权所有:北京工业大学图书馆 站点建设与维护:北京爱琴海乐之技术有限公司