阅读背景:

写网络爬虫学python(一)

来源:互联网 

网络爬虫是一个抓取网页的程序。网络爬虫(蜘蛛)是通过网页的链接地址来寻找网页,从网站某一个页面开始,读取网页的内容,找到在网页中的其它链接地址,然后通过这些链接地址寻找下一个网页,这样一直循环下去,直到把这个网站所有的网页都抓取完为止。如果把整个互联网当成一个网站,那么网络爬虫(蜘蛛)就可以用这个原理把互联网上所有的网页都抓取下来。,从网站某一个页面




你的当前访问异常,请进行认证后继续阅读剩余内容。

分享到: