JinritemaiCrawler — 电商选品爬虫
项目背景:基于浏览器自动化方案实现今日头条电商选品数据的自动采集
核心工作:实现登录态保持、商品详情抓取、销售数据采集、转化率分析和带货内容链接提取
量化成果:抓取结果自动生成 Excel 报表,client_db.py 负责数据格式化与导出
ArticleCrawler — 多站点新闻聚合爬虫
项目背景:构建增量式新闻聚合爬虫系统,覆盖博彩/游戏行业主流资讯源
核心工作:内置 affpapa、bnldata 等 10 个站点的爬虫模块;集成 APScheduler 实现定时任务调度
量化成果:设计模块化架构,新站点接入仅需实现标准接口;通过哈希去重减少 80% 冗余请求