谢泽华

谢泽华

爬虫 · 1年经验 · dddddd
城市成都 高新 日薪500元/8h 时间 下班后
0
累计接单
0
用户评价
0
被收藏

技术能力

AI 技能提取 | Python HTML MySQL SQLite Selenium
熟练使用 Python 开展网络数据采集开发,核心爬虫相关库掌握完善:基础请求库 requests、aiohttp 实现同步 / 异步网页请求解析,BeautifulSoup4、lxml、pyquery 完成 HTML、XML 页面数据提取;熟练运用正则表达式清洗、筛选文本类目标数据。
熟悉 Selenium、Playwright 无头浏览器,可处理 JS 动态渲染页面、模拟真人滑动、点击、下拉翻页等交互行为,应对简单反爬校验。掌握基础反爬应对方案:请求头伪装、随机 User-Agent、代理 IP 轮换、请求延时限流、Cookie 会话维持。
能够将采集数据规范化存储,支持导出 Excel、CSV 文件,也可写入 MySQL、SQLite 本地数据库;会搭建简易定时采集脚本,实现网站公开数据定期监控更新。
了解爬虫合规规范,仅采集网页公开展示、无隐私权限限制的商用资讯、商品榜单、行业公开数据,遵循站点 robots 协议,控制访问频率避免对目标站点造成压力,可根据客户需求产出干净结构化数据报表。

项目经验

项目 1:电商公开商品信息采集脚本
针对中小型购物网站公开商品页面开发爬虫,使用 requests+lxml 批量抓取商品名称、标价、库存、分类、图文链接等公开信息,加入随机访问间隔、UA 池规避基础拦截,最终将上万条商品数据批量导出 Excel 表格,用于客户行业市场价格调研,脚本可一键重复执行更新数据。
项目 2:资讯网站动态页面数据抓取
目标站点内容由 JS 异步加载,采用 Playwright 无头模式模拟浏览器访问,自动翻页加载全部文章,提取标题、发布时间、正文、标签等公开资讯内容,通过正则过滤多余广告、空白字符,清洗后存入本地 SQLite 数据库,支持按发布日期筛选导出报表。
项目 3:榜单类定时监控采集工具
编写轻量化定时爬虫脚本,定时抓取行业公开排名榜单数据,对比前后两次采集结果标记榜单变动,自动生成差异文档,全程低频请求站点,严格控制并发,仅用于客户合法行业数据对比分析,全程不涉及用户隐私、付费内容等受限数据采集。
客服二维码

没找到合适的人才?

扫码添加客服极速匹配,或直接发布需求让更多人才主动报名

微信沟通 立即沟通 立即预约
平台担保交易 · 1小时内不满意可退款
微信扫码,建群沟通

平台信誉与实力

基于 35,336 需求方信任

  • 支付宝企业信用分 优秀 评级
  • 市场份额约占全行业三分之一
  • 程序员兼职行业全能首选平台
查看平台资质详情
相似人才推荐: