基于层次树模型的Deep Web数据提取方法

田建伟; 李石君

摘要

网络在成为信息查询和发布平台的同时,海量的信息隐藏在查询受限的Web数据库中,使得人们无法有效地获取这些高质量的数据记录.传统的Deep Web搜索研究主要集中在通过关键字接口获取Web数据库内容.但是,由于Deep Web具有多属性和top-k的特点,基于关键字的方法具有固有的缺点,这就为Deep Web查询和检索带来了挑战.为了解决这个问题,提出了一种基于层次树的DeepWeb数据获取方法,该方法可以无重复和完整地提取Web数据库中的数据记录.该方法首先把Web数据库模型化为一棵层次树,Deep Web数据获取问题就转化为树的遍历问题.其次,对树中的属性排序,缩小遍历空间;同时,利用基于属...

单位
软件工程国家重点实验室; 武汉大学

收藏分享被引浏览

更新时间：2020-06-16 10:21

基于层次树模型的Deep Web数据提取方法

摘要

产品服务

站内浏览

服务支持

联系方式

科研之友