20岁清澈纯情男大

python开发工程师
象盒网络科技有限公司 · 4年经验
20岁清澈纯情男大
日薪: ¥600/8h
地点: 深圳 福田
时间: 可工作日驻场(自由职业原因)
ID:384756 复制

0
接单数
0
评价数
1
收藏数

AI 技能提取 | Python Django FastAPI 分布式 LangChain LLM Docker Tomcat SVN Git Redis HTTP MongoDB
• 精通掌握python中的Seleuim、requests、Fastapi、pandas、os、爬虫、正侧表达式、bs4、Numpy、多线程、异步协程、分布式爬虫,掌握Django、log日志监控,具有良好python基础。
• 熟练掌握http和https协议,熟练掌握js逆向工程与app逆向,了解常见的前端加密方式。
• 熟练掌握python中的LLM大语言模型(chatGLM)、langchain、向量数据库milvus、pytroch、docker工具等。
• 熟练使用Tomcat服务器发布 运行、SVN控制器、Git、debug模式和F12对代码的调试。
• 熟练使用MyEclipse、Eclipse、IntelliJ IDEA、Pycharm、Fiddler、SVCode、SVN等开发工具及其安装、配置环境.
• 掌握Redis及MongoDB等非关系型数据库,能够独立搭建Redis伪集群。
• 具有良好的职业素质,优点学习能力强 沟通能力理解力好 有亲和力 责任感强。

爬取房源信息、下载房源图片等,在web、app两端分别爬取
web:
1、requests.get()获取数据源网页 (模拟登入获取cookie或者用Selenium模拟操作网页获取数据源,或者破解验证码)
2、利用Beautiful Soup解析数据源
3、通过soup、正则表达式、Pathx截取到需要的字段
4、创建数据库,建立索引与标识
5、pymysql连接数据库,操作数据库进行添加数据
6、报错日记监控
7、反爬虫机制策略(使用AU,cookie,Referer、设置ip代理池,降低一个次爬取访问网页的测试)
8、对有些网页的请求进行解密生成值,与js逆向。
9、利用多线程分布式爬虫,异步爬取数据。
app:
1、使用Fiddler/charles前,设置配置,下载证书
2、建立Fiddler/charles与手机的连接,找寻目标数据包
3、requsets读取数据包
4、下载资源,或者数据存进数据库中
5、报错日记监控
6、反爬虫机制策略
7、反爬虫机制策略(使用AU,cookie,Referer、设置ip代理池,降低一个次爬取访问网页的测试)
8、对有些网页的请求进行解密生成值,与app逆向。(使用的逆向工具jadx )
9、利用多线程分布式爬虫,异步爬取数据。
scrapy:
1、分析爬取的网页,制定爬虫策略
2、创建scrapy项目,指定需要的提取链接的规则
3、分析数据结构,生成itmes
4、对爬虫根据爬虫策略进行编码
5、修改配置文件,配置管道
6、对网页进行解析,提取数据传给itmes提交给管道
7、在管道中进行数据的存储与持久化(MySQL)
8、开启下载中间的配置,在请求拦截器中进行对头部参数的设置,在响应拦截器中进行动态加载(Selenium),在请求
异常拦截器中设置ip代理与异常监控
20岁清澈纯情男大 ID:384756 复制

20岁清澈纯情男大

python开发工程师 · 4年经验 · 象盒网络科技有限公司
城市深圳 福田 日薪600元/8h 时间 可工作日驻场(自由职业原因)
0
累计接单
0
用户评价
1
被收藏

信用行为

0
接单数
0
评价数
1
收藏数

技术能力

AI 技能提取 | Python Django FastAPI 分布式 LangChain LLM Docker Tomcat SVN Git Redis HTTP MongoDB
• 精通掌握python中的Seleuim、requests、Fastapi、pandas、os、爬虫、正侧表达式、bs4、Numpy、多线程、异步协程、分布式爬虫,掌握Django、log日志监控,具有良好python基础。
• 熟练掌握http和https协议,熟练掌握js逆向工程与app逆向,了解常见的前端加密方式。
• 熟练掌握python中的LLM大语言模型(chatGLM)、langchain、向量数据库milvus、pytroch、docker工具等。
• 熟练使用Tomcat服务器发布 运行、SVN控制器、Git、debug模式和F12对代码的调试。
• 熟练使用MyEclipse、Eclipse、IntelliJ IDEA、Pycharm、Fiddler、SVCode、SVN等开发工具及其安装、配置环境.
• 掌握Redis及MongoDB等非关系型数据库,能够独立搭建Redis伪集群。
• 具有良好的职业素质,优点学习能力强 沟通能力理解力好 有亲和力 责任感强。

项目经验

爬取房源信息、下载房源图片等,在web、app两端分别爬取
web:
1、requests.get()获取数据源网页 (模拟登入获取cookie或者用Selenium模拟操作网页获取数据源,或者破解验证码)
2、利用Beautiful Soup解析数据源
3、通过soup、正则表达式、Pathx截取到需要的字段
4、创建数据库,建立索引与标识
5、pymysql连接数据库,操作数据库进行添加数据
6、报错日记监控
7、反爬虫机制策略(使用AU,cookie,Referer、设置ip代理池,降低一个次爬取访问网页的测试)
8、对有些网页的请求进行解密生成值,与js逆向。
9、利用多线程分布式爬虫,异步爬取数据。
app:
1、使用Fiddler/charles前,设置配置,下载证书
2、建立Fiddler/charles与手机的连接,找寻目标数据包
3、requsets读取数据包
4、下载资源,或者数据存进数据库中
5、报错日记监控
6、反爬虫机制策略
7、反爬虫机制策略(使用AU,cookie,Referer、设置ip代理池,降低一个次爬取访问网页的测试)
8、对有些网页的请求进行解密生成值,与app逆向。(使用的逆向工具jadx )
9、利用多线程分布式爬虫,异步爬取数据。
scrapy:
1、分析爬取的网页,制定爬虫策略
2、创建scrapy项目,指定需要的提取链接的规则
3、分析数据结构,生成itmes
4、对爬虫根据爬虫策略进行编码
5、修改配置文件,配置管道
6、对网页进行解析,提取数据传给itmes提交给管道
7、在管道中进行数据的存储与持久化(MySQL)
8、开启下载中间的配置,在请求拦截器中进行对头部参数的设置,在响应拦截器中进行动态加载(Selenium),在请求
异常拦截器中设置ip代理与异常监控
客服二维码

没找到合适的人才?

扫码添加客服极速匹配,或直接发布需求让更多人才主动报名

平台担保交易 · 1小时内不满意可退款

平台信誉与实力

基于 35,336 需求方信任

  • 支付宝企业信用分 优秀 评级
  • 市场份额约占全行业三分之一
  • 程序员兼职行业全能首选平台
查看平台资质详情
收藏