该项目为公司项目,不方便透露太多。 整个项目是对app和网站的数据进行爬取定时每天运行,作为一个增量式爬虫。然后对爬取到的文章,提取出来对关键字和错别字进行识别,并保存到数据库。整个项目自己独立开发,数据量达到一百万以上,现在也是自己在维护当中。
由于是公司项目,不放便透露太多。 整个项目是对推特指定用户进行爬取,查看是否有发文,然后进行文章的采集,采集到了之后通过接口,推送到前端进行数据展示。整个项目从开发到部署以及现在的维护都是自己独立开发。
添加客服微信,免费为您安排与该工程师直接沟通
长按二维码添加客服微信
如该工程师当前档期不合,也可免费为您推荐相似候选人