1、Scrapy+redis+mongodb+selenium等(一天大概1300万条数据)
2、下载中间件会从Cookie池和User-Agent池中随机抽取一个加入到spider中
3、start_requests 中根据用户ID启动四个Request,同时对个人信息、微博、
关注和粉丝进行爬取
4、将新爬下来的关注和粉丝ID加入到待爬队列(去重)
需求方专属客服,免费梳理匹配
添加客服微信,免费为您安排与该工程师直接沟通
长按二维码添加客服微信
如当前档期不合,也可免费为您推荐相似案例作者