刘鼻涕

python爬虫开发工程师
智数云科 · 2年经验
刘鼻涕
日薪: ¥500/8h
地点: 成都 高新
时间: 可工作日驻场(自由职业原因)
ID:417338 复制

0
接单数
0
评价数
0
收藏数

AI 技能提取 | Python Selenium Ajax MySQL Redis MongoDB HTML HTTP 分布式
熟练使用 Python 进行网络爬虫与数据采集开发,掌握 Requests、Scrapy、Selenium、Playwright 等主流爬虫框架,能应对静态/动态页面、AJAX 异步加载、反爬验证(UA/代理池/验证码识别)等场景。熟悉 HTML/XML 解析(XPath、BeautifulSoup、lxml)、正则表达式数据清洗,掌握 MySQL、MongoDB、Redis 等数据库的数据存储与读写优化。了解多线程、异步协程(aiohttp)、分布式爬虫架构,能独立完成中小型数据采集项目的需求分析、方案设计、开发部署与维护。具备基础的前端与HTTP协议知识,可快速定位与解决反爬与数据抓取异常问题。

1. 电商平台商品数据采集项目:基于 Scrapy 框架开发分布式爬虫,针对目标平台实现商品信息、价格、库存数据的定时抓取,通过代理池与UA池解决IP封禁问题,将采集数据清洗后存入 MySQL,为竞品分析提供稳定数据源。

2. 公开信息自动化采集项目:使用 Selenium+Playwright 开发动态页面爬虫,模拟用户行为绕过前端渲染与反爬机制,实现目标网站公开数据的自动化抓取、去重与结构化存储,通过定时脚本实现每日增量更新,保证数据时效性。

3. 多平台数据聚合处理项目:整合多个来源的采集数据,使用 Pandas 进行数据清洗、格式转换与多源数据对齐,生成标准化数据报表,支持后续数据分析与可视化,提升数据处理效率与准确性。
刘鼻涕 ID:417338 复制

刘鼻涕

python爬虫开发工程师 · 2年经验 · 智数云科
城市成都 高新 日薪500元/8h 时间 可工作日驻场(自由职业原因)
0
累计接单
0
用户评价
0
被收藏

信用行为

0
接单数
0
评价数
0
收藏数

技术能力

AI 技能提取 | Python Selenium Ajax MySQL Redis MongoDB HTML HTTP 分布式
熟练使用 Python 进行网络爬虫与数据采集开发,掌握 Requests、Scrapy、Selenium、Playwright 等主流爬虫框架,能应对静态/动态页面、AJAX 异步加载、反爬验证(UA/代理池/验证码识别)等场景。熟悉 HTML/XML 解析(XPath、BeautifulSoup、lxml)、正则表达式数据清洗,掌握 MySQL、MongoDB、Redis 等数据库的数据存储与读写优化。了解多线程、异步协程(aiohttp)、分布式爬虫架构,能独立完成中小型数据采集项目的需求分析、方案设计、开发部署与维护。具备基础的前端与HTTP协议知识,可快速定位与解决反爬与数据抓取异常问题。

项目经验

1. 电商平台商品数据采集项目:基于 Scrapy 框架开发分布式爬虫,针对目标平台实现商品信息、价格、库存数据的定时抓取,通过代理池与UA池解决IP封禁问题,将采集数据清洗后存入 MySQL,为竞品分析提供稳定数据源。

2. 公开信息自动化采集项目:使用 Selenium+Playwright 开发动态页面爬虫,模拟用户行为绕过前端渲染与反爬机制,实现目标网站公开数据的自动化抓取、去重与结构化存储,通过定时脚本实现每日增量更新,保证数据时效性。

3. 多平台数据聚合处理项目:整合多个来源的采集数据,使用 Pandas 进行数据清洗、格式转换与多源数据对齐,生成标准化数据报表,支持后续数据分析与可视化,提升数据处理效率与准确性。
客服二维码

没找到合适的人才?

扫码添加客服极速匹配,或直接发布需求让更多人才主动报名

平台担保交易 · 1小时内不满意可退款

平台信誉与实力

基于 35,336 需求方信任

  • 支付宝企业信用分 优秀 评级
  • 市场份额约占全行业三分之一
  • 程序员兼职行业全能首选平台
查看平台资质详情
收藏