下载一种从收藏网页中消除重复网页的方法及系统的技术资料

文档序号:19593318

温馨提示:您尚未登录,请点 登陆 后下载,如果您还没有账户请点 注册 ,登陆完成后,请刷新本页查看技术详细信息。

本发明提供了一种从收藏网页中消除重复网页的方法,包括如下步骤:获取用于收藏网页的收藏文件夹,并从所述收藏文件夹中获取收藏网页的源代码;根据所述源代码提取所述网页中的至少部分正文内容;将所述至少部分正文内容与在先收藏网页中的对应内容进行相似度...
该专利属于佛山市灏金赢科技有限公司所有,仅供学习研究参考,未经过佛山市灏金赢科技有限公司授权不得商用。

详细技术文档下载地址

温馨提示:您尚未登录,请点 登陆 后下载,如果您还没有账户请点 注册 ,登陆完成后,请刷新本页查看技术详细信息。