由于爬取数量较多为提高爬取速度选择用scrapy-redis分布式爬取 首先先分析网页,需要从一级页面获取大标题和二级页面的url,从二级页面获取各章节名称和三级页面url,在三级页面获取小说具体各章节的文本呢内容,再编写爬虫程序,运用xpath解析,再保存数据,再setting中设置请求头和redis等设置
项目描述:该项目是一款供用户可以免费阅读小说的平台,主要包括
全历史(Allhistory)以AI知识图谱为核心引擎,通过
个人主站。前后端都由本人完成。整个网站由个人建站,部署和维护
本人原创程序,该程序借鉴了人生重开模拟器里面的词条,里面还添
读书郎小程序是在线阅读类微信小程序,用户通过读书郎实现搜索书
该项目技术:vue3 + vuex + axios + h5
需求方专属客服,免费梳理匹配