以物物物

python
浪潮 · 8年经验
以物物物
日薪: ¥500/8h
地点: 山东 全区
时间: 下班后周六周日
ID:321940 复制

0
接单数
0
评价数
0
收藏数

AI 技能提取 | Python C++ MySQL Oracle SQL Server 测试 Linux
熟悉office等办公软件
熟练而全面掌握通信及计算机网络专业知识
熟悉SQL Server、MySQL等数据库操作,了解Oracle数据库操作熟悉Linux系统基本操作,熟悉C++、python等编程语言
熟悉计算机软件工程理论;熟悉测试流程和技巧

项目时间:2022-01到2022-10

项目名称:分布式爬虫爬取北京市企业信用信息网

项目描述:

这个项目是通过scrapy-redis搭建分布式爬虫爬取企业信用信息网公布栏,爬取列表页每一项下的子页获取数据

我的职责

首先爬取首页后通过xpath匹配每个的信息块的span后构建请求,并通过scrapy.Request发送请求,用xpath匹配需要的信息。

同时循环创建下一页请求的form表单,通过scrapy.FormRequest发送POST请求。所有爬取的信息缓存到redis数据库中,

最后通过编写python脚本将redis数据库中数据读取出来加入mysql数据库。

其他爬取的网站:搜狐新闻、豆瓣、腾讯新闻网
以物物物 ID:321940 复制

以物物物

python · 8年经验 · 浪潮
城市山东 全区 日薪500元/8h 时间 下班后周六周日
0
累计接单
0
用户评价
0
被收藏

信用行为

0
接单数
0
评价数
0
收藏数

技术能力

AI 技能提取 | Python C++ MySQL Oracle SQL Server 测试 Linux
熟悉office等办公软件
熟练而全面掌握通信及计算机网络专业知识
熟悉SQL Server、MySQL等数据库操作,了解Oracle数据库操作熟悉Linux系统基本操作,熟悉C++、python等编程语言
熟悉计算机软件工程理论;熟悉测试流程和技巧

项目经验

项目时间:2022-01到2022-10

项目名称:分布式爬虫爬取北京市企业信用信息网

项目描述:

这个项目是通过scrapy-redis搭建分布式爬虫爬取企业信用信息网公布栏,爬取列表页每一项下的子页获取数据

我的职责

首先爬取首页后通过xpath匹配每个的信息块的span后构建请求,并通过scrapy.Request发送请求,用xpath匹配需要的信息。

同时循环创建下一页请求的form表单,通过scrapy.FormRequest发送POST请求。所有爬取的信息缓存到redis数据库中,

最后通过编写python脚本将redis数据库中数据读取出来加入mysql数据库。

其他爬取的网站:搜狐新闻、豆瓣、腾讯新闻网
客服二维码

没找到合适的人才?

扫码添加客服极速匹配,或直接发布需求让更多人才主动报名

平台担保交易 · 1小时内不满意可退款

平台信誉与实力

基于 35,336 需求方信任

  • 支付宝企业信用分 优秀 评级
  • 市场份额约占全行业三分之一
  • 程序员兼职行业全能首选平台
查看平台资质详情
收藏