在这两个项目中我负责网页数据爬取。 第一个静态数据爬取的主要步骤是根据网页网站获取网页源代码,将源代码转化到xml类型,再由for循环获取数据,最后讲数据保存。 第二个动态数据项目,先爬取所需数据的包,根据字典的变量名获取数据所在位置,再经过for循环获取数据,最后保存数据。
在此处项目中,我主要负责动态数据的爬取。动态数据的爬取,首先需要在网站中打开开发者工具,找到所需数据的包,通过这个数据包爬取数据位置,再通过for循环获得所需所有数据,最后通过csv保存数据。
扫码添加客服极速匹配,或直接发布需求让更多人才主动报名
基于 35,336 需求方信任
鼠标悬停或点击上方资质图片,可放大右下角二维码进行扫码验真。