ikun家族

无 · 2年经验
ikun家族
日薪: ¥500/8h
地点: 深圳 龙岗
时间: 下班后
ID:424175 复制

0
接单数
0
评价数
0
收藏数

AI 技能提取 | Python CSS
熟练掌握 Python 爬虫全栈开发能力,可独立完成静态网页、公开资讯、榜单类公开数据采集需求。基础爬虫开发依托 requests、BeautifulSoup 库,熟练使用 CSS 选择器、XPath 完成网页内容解析,能够精准提取标题、简介、评分、链接、图文等结构化文本数据;熟练使用 Scrapy 异步爬虫框架,掌握项目分层开发,包含 Item 数据定义、Pipeline 数据持久化、全局请求配置、分页自动爬取等工程化开发流程。
具备完整数据处理能力,可将采集数据清洗去重、格式化导出 TXT、CSV、Excel 表格;掌握基础反爬适配方案,可配置请求头 UA、请求延时、随机访问间隔规避封禁,保证爬虫稳定运行。严格遵守网络爬虫合规规范,仅承接政府公开公示、图书榜单、诗词科普、院校公开信息等无隐私、无版权风险的公开静态站点采集任务,能够根据需求定制分页抓取、列表 + 详情二级页面采集脚本,交付可直接运行完整源码与成品数据文件,适配学生论文数据、小型行业公开信息汇总等轻量化项目需求。

基于 Scrapy 框架开发图书榜单数据采集程序,目标为公开图书排行榜静态站点,实现自动分页循环爬取。自定义 Item 规范存储书名、作者、评分、简介、出版信息五大字段,通过 Pipeline 将清洗后数据批量导出 Excel;配置全局下载延时、浏览器请求头降低网站访问压力,自动过滤空白无效数据,完成 10 页共 500 + 条图书信息完整采集。项目交付标准化可运行脚本,支持自定义修改爬取页数与目标字段,可直接用于行业数据分析、课程论文数据素材。
ikun家族 ID:424175 复制

ikun家族

无 · 2年经验 · 无
城市深圳 龙岗 日薪500元/8h 时间 下班后
0
累计接单
0
用户评价
0
被收藏

信用行为

0
接单数
0
评价数
0
收藏数

技术能力

AI 技能提取 | Python CSS
熟练掌握 Python 爬虫全栈开发能力,可独立完成静态网页、公开资讯、榜单类公开数据采集需求。基础爬虫开发依托 requests、BeautifulSoup 库,熟练使用 CSS 选择器、XPath 完成网页内容解析,能够精准提取标题、简介、评分、链接、图文等结构化文本数据;熟练使用 Scrapy 异步爬虫框架,掌握项目分层开发,包含 Item 数据定义、Pipeline 数据持久化、全局请求配置、分页自动爬取等工程化开发流程。
具备完整数据处理能力,可将采集数据清洗去重、格式化导出 TXT、CSV、Excel 表格;掌握基础反爬适配方案,可配置请求头 UA、请求延时、随机访问间隔规避封禁,保证爬虫稳定运行。严格遵守网络爬虫合规规范,仅承接政府公开公示、图书榜单、诗词科普、院校公开信息等无隐私、无版权风险的公开静态站点采集任务,能够根据需求定制分页抓取、列表 + 详情二级页面采集脚本,交付可直接运行完整源码与成品数据文件,适配学生论文数据、小型行业公开信息汇总等轻量化项目需求。

项目经验

基于 Scrapy 框架开发图书榜单数据采集程序,目标为公开图书排行榜静态站点,实现自动分页循环爬取。自定义 Item 规范存储书名、作者、评分、简介、出版信息五大字段,通过 Pipeline 将清洗后数据批量导出 Excel;配置全局下载延时、浏览器请求头降低网站访问压力,自动过滤空白无效数据,完成 10 页共 500 + 条图书信息完整采集。项目交付标准化可运行脚本,支持自定义修改爬取页数与目标字段,可直接用于行业数据分析、课程论文数据素材。
客服二维码

没找到合适的人才?

扫码添加客服极速匹配,或直接发布需求让更多人才主动报名

平台担保交易 · 1小时内不满意可退款

平台信誉与实力

基于 35,336 需求方信任

  • 支付宝企业信用分 优秀 评级
  • 市场份额约占全行业三分之一
  • 程序员兼职行业全能首选平台
查看平台资质详情
收藏