1.给哔哩哔哩直播间发送弹幕:
使用scrapy框架进行操作,需要实现post请求。
2.爬取xiaojiejie网址图片:
使用scrapy框架进行操作,循环爬取166页,一共3306张,开启并发线程,20分钟爬完。
3.hao6v电影网址爬取信息:
使用scrapy框架进行操作,循环爬取所有页信息,涉及一个深度爬取。
4.爬取虎扑网址球员数据:
分别通过管道保存在Excel、MySQL、MongoDB中。
5.爬取拼多多手机端商品信息:
通过xpath解析数据进行爬取。
6.实现哔哩哔哩自动登录:
使用selenium自动化测试工具,后面有一个图片识别,通过超级鹰进行图片识别,创建动作链,遍历分别取坐标点击完成图片
验证。
7.爬取站长简历中的简历:
深度爬取,使用异步进行爬取,提高工作效率。