通过python的selenium库对指定网站的信息挖掘,首先分析完整的结构,通过抓包找到自己想要的数据,通过url的请求,获取响应,得到想要的数据,再进行数据的分析和清晰,把有用的数据进行保存。
这个是静态网站的信息,因此我使用了request来进行数据爬取,通过get请求网址,获得响应,得到信息提取信息里面的json数据,再通过jsonpath来进行json数据的处理,最后把信息提取处出来保存到表格。
扫码添加客服极速匹配,或直接发布需求让更多人才主动报名
基于 35,336 需求方信任
鼠标悬停或点击上方资质图片,可放大右下角二维码进行扫码验真。
添加客服微信,免费为您安排与该工程师直接沟通
长按二维码添加客服微信
如该工程师当前档期不合,也可免费为您推荐相似候选人
收藏后可在“我的收藏”里统一查看,也方便后续继续联系和筛选合适人才。
登录后将自动返回当前页,继续浏览不会丢失。