项目一:批量Excel数据自动化处理脚本
项目简介:针对办公大批量表格整理、数据汇总、格式统一、空白清理、重复数据剔除的人工低效问题,独立开发自动化处理脚本。
技术栈:Python、Pandas、OpenPyXL
个人职责:设计数据读取逻辑,实现多Excel文件批量读取、行列规整、缺失值填充、重复数据自动删除、数据分类汇总;自定义输出模板,自动生成标准化结果表格,支持批量导出。
项目成果:替代人工逐条整理,单批次可处理千行以上数据,将原本数小时的人工整理工作缩短至5分钟内完成,数据准确率100%,大幅提升办公数据处理效率。
项目二:静态网页数据爬取与规整项目
项目简介:针对公开网页文本、链接、参数、列表数据的批量采集需求,开发轻量爬虫脚本,规避基础反爬限制,实现自动化采集与数据保存。
技术栈:Python、Requests、BeautifulSoup
个人职责:模拟浏览器请求,配置请求头、延时访问,规避基础反爬机制;解析网页源码,精准提取目标文字、链接、参数信息;对采集的杂乱数据进行清洗、去重、规整,分类保存为Excel、TXT格式文件。
项目成果:可稳定批量采集公开合规网页数据,解决人工复制粘贴效率低、易出错的问题,适用于资料收集、信息汇总、竞品数据整理等场景,脚本可复用、可按需修改采集字段。