陆文仟的案例列表

作者:陆文仟 · 共 2 个案例

豆瓣电影 Top250 信息采集整理

本案例从豆瓣电影 Top 250公开网页分页采集 Top250 电影的真实数据,采集 电影名称,海报,评分等数据。本人负责采集脚本、字段解析与结果核对。可承接网页信息采集、爬虫整理成表格、数据提取清洗等任务。高效按需定制爬虫有爬虫经验,网页端移动端都能做。

电商数据采集

项目简介:通过爬虫程序批量提取商品信息,经数据清洗、结构化处理后入库,保障电商系统商品数据实时可用。 相关技术:requests、curl_cffi、json、xpath、re、selenium、ip代理等 职责: 1、分析各相关数据接口参数情况,构造接口请求相关逻辑 2、使用requests、curl_cffi 发起网络请求,结合IP代理池应对目标站点反爬机制 3、通过XPath、re 正则、json解析页面与接口数据,提取商品标题、价格、图片、规格、库存等核心字段 4、使用Selenium处理JS 动态渲染、异步加载等复杂页面,保证数据正常采集 5、负责数据清洗、去重、格式标

案例判断参考

程序员兼职平台怎么选 程序员平台对比怎么看 企业找程序员外包避坑

陆文仟的案例列表

豆瓣电影 Top250 信息采集整理

本案例从豆瓣电影 Top 250公开网页分页采集 Top250 电影的真实数据,采集 电影名称,海报,评分等数据。本人负责采集脚本、字段解析与结果核对。可承接网页信息采集、爬虫整理成表格、数据提取清洗等任务。高效按需定制爬虫有爬虫经验,网页端移动端都能做。...

电商数据采集

项目简介:通过爬虫程序批量提取商品信息,经数据清洗、结构化处理后入库,保障电商系统商品数据实时可用。 相关技术:requests、curl_cffi、json、xpath、re、selenium、ip代理等 职责: 1、分析各相关数据接口参数情况,构造接口请求相关逻辑 2、使用requests、curl_cffi 发起网络请求,结合IP代理池应对目标站点反爬机制 3、通过XPath、re 正则、json解析页面与接口数据,提取商品标题、价格、图片、规格、库存等核心字段 4、使用Selenium处理JS 动态渲染、异步加载等复杂页面,保证数据正常采集 5、负责数据清洗、去重、格式标...

案例判断参考

程序员兼职平台怎么选 程序员平台对比怎么看 企业找程序员外包避坑
查看简历
微信沟通 客服 看中这位工程师了?客服帮你 1 小时对接沟通 → ×