全部 标题 作者
关键词 摘要

OALib Journal期刊
ISSN: 2333-9721
费用:99美元

查看量下载量

相关文章

更多...
软件学报  2000 

从web文档中构造半结构化信息的抽取器

, PP. 73-78

Keywords: 启发式规则,数据抽取格式,对象交换模型.

Full-Text   Cite this paper   Add to My Lib

Abstract:

为了对web上不规则的、动态的信息按照数据库的方式集成和查询,采用对象交换模型(objectexchangemodel,简称oem)建立了web信息模型.为了将页面中各个部分表示为对应的oem对象,设计了半结构化信息的抽取算法,并给出测试结果.该方法可以抽取结构化和半结构化的信息,比现有的抽取方法通用性更强.

Full-Text

Contact Us

service@oalib.com

QQ:3279437679

WhatsApp +8615387084133