阅读背景:

新浪微博爬虫项目

来源:互联网 
利用scrapy、proxy_pool、cookie_pool抓取新浪微博:用户信息、关注列表、粉丝列表、微博内容,信息保存至MongoDB。以几个大V为起点,爬取个人信息、粉丝、关注、微博信息,然后继续获取这些粉丝和关注的个人信息、粉丝、关注、微博信息,以此类推,实现递归爬取。
利用scrapy、proxy_pool、cookie_poo



你的当前访问异常,请进行认证后继续阅读剩余内容。

分享到: