深度优先搜索是一种在开发爬虫的早期使用较多的方法。它的目的是达到被搜索结构的叶结点(即那些不包含任何超链的HTML文件)。在一个HTML文件中,当一个超链被选择后,被链接的HTML文件将执行深度优先搜索,即在搜索其余的超链结果之前必须先完整地搜索一条单独的链。深度优先搜索沿着HTML文件上的超链走到不能再深入为止,然后返回到某一个HTML文件,再继续选择该HTML文件中的其他超链。当不再有其他超链可选择时,说明搜索已经结束。优点是能遍历一个Web站点或深层嵌套的文档集合;缺点是因为Web结构相当深,有可能出现一旦进去便再也出不来的情况。
相关推荐
花间相见2 天前
【计算基础|网络04】—— HTTP接口实战(下):接口测试、鉴权与跨域排错Xiu Yan3 天前
Python 数据分析:Pandas DataFrame 零基础入门教程Xiu Yan3 天前
Python 数据分析:Pandas Series 零基础入门教程黑化旺仔4 天前
【OC】KVOMadison-No74 天前
基于JMeter工具的性能测试(接口)Liekkas Kono4 天前
macOS 27 安装 VMware Fusion 和 Win11 经验troy1286 天前
Python 基础语法(九):Django/Flask/FastAPI 三大 Web 框架详细对比解析shark-chili6 天前
关于AI辅助编程的认知zwd20057 天前
Mac 上写英文遇到不会的词,有哪些工具?输入法、翻译软件、写作助手怎么选33三 三like7 天前
Jx-Mac 本地部署过程总结