独立完成采招网公开招标信息的采集脚本开发。针对网站的访问频率限制,通过请求头模拟、Session 维持、访问间隔控制等方式保证采集稳定性。实现了关键词搜索、多页翻页、详情页字段提取、异常重试与断点续采功能。最终输出结构化 Excel 文件,包含标题、发布时间、地区、正文摘要等字段
独立完成建筑市场网站公开信息的采集脚本开发。针对该网站的分页逻辑和列表详情结构,采用 Requests + BeautifulSoup 进行静态页面解析,实现了关键词搜索、列表翻页、详情页字段提取等功能。处理了页面编码、字段缺失、异常跳转等实际工程问题。编写了请求间隔控制与异常重
独立完成建筑市场网站公开信息的采集脚本开发。针对该网站的分页逻辑和列表详情结构,采用 Requests + BeautifulSoup 进行静态页面解析,实现了关键词搜索、列表翻页、详情页字段提取等功能。处理了页面编码、字段缺失、异常跳转等实际工程问题。编写了请求间隔控制与异常重