下载网页信息块提取方法和装置的技术资料

文档序号:2853872

温馨提示:您尚未登录,请点 登陆 后下载,如果您还没有账户请点 注册 ,登陆完成后,请刷新本页查看技术详细信息。

本发明提出了一种网页信息块提取装置和方法。在本发明中,首先生成网页的结构信息块树,并对结构信息块进行分类归并和合并,对结果块的语义进行标记,从而根据内容和功能把网页分割为信息块。特别地,结构层次的自动重复模式发现和语义层次的分类归并是实现本...
该专利属于富士通株式会社;南京大学所有,仅供学习研究参考,未经过富士通株式会社;南京大学授权不得商用。

详细技术文档下载地址

温馨提示:您尚未登录,请点 登陆 后下载,如果您还没有账户请点 注册 ,登陆完成后,请刷新本页查看技术详细信息。