收录:
摘要:
Web信息抽取方法属于互联网技术领域。如何才能从冗杂的Web页面中抽取出需要的信息已经成为多数研究者希望解决的问题。Web信息抽取方法:基于特征比较法建立抽取规则的过程中计算结点相似度,具体步骤选择数据项特征,构建数据项特征,计算相似度;深度遍历整个DOM树完成后,就计算出了所有结点的综合相似度S,最终得到综合相似度S最大的结点,就是需要找的相似结点;相似结点对于的内容就是待抽取信息。本文针对互联网上煤矿安全事件信息的特点,提出了面向煤矿安全事件的Web信息抽取方法,为用户提供更加快速、准确的煤矿安全事件信息服务。
关键词:
通讯作者信息:
电子邮件地址: