这里是使用selenium以及xpath来爬取抖音个人主页的一些数据 博主的网名 粉丝数量 及其视频标题和视频地址...
这个案列用的是爬虫的scrapy框架爬取的 用到了selenium xpath 管道接收后保存到数据库中...
这是使用selenium 进入到中国环境网的详情页面 进行详情页的数据爬取 文章的正文、标题和文章发布时间...
用requests 模块发送请求后 伪装cookie、UA、获取到源代码之后 使用正则进行抓取,拿到数据后将图片转换为二进制放到文件夹当中...