宅男拯救协会会长

python数据分析工程师
京东数字科技控股股份有限公司 · 3年经验
宅男拯救协会会长
日薪: ¥600/8h
地点: 北京 海淀
时间: 下班后周六周日可工作日远程可工作日驻场(离职原因)可工作日驻场(自由职业原因)
ID:198160 复制

0
接单数
0
评价数
1
收藏数

AI 技能提取 | Python MySQL Redis MongoDB 深度学习 Hadoop Hive TensorFlow 机器学习 NLP Linux
熟悉Pandas、Numpy、Matplotlib等数据分析常用库的功能,进行数据操作、采集、处理、清洗、可视化、规整数据集;
● 熟悉Random Forest、GradientBoosting、Logistic Regression、K-Nearest Neighbors、Naive Bayes、Linear Regression、Support Vector Machines 等机器学习算法应用;
● 熟悉常用数据结构算法;
● 熟悉NLP中Word Segmentation、Filtering Words、Representation、Sentence Similarity、Noisy Channel Model、Language Model等方法原理;
● 对数据有较强的敏感度;
● 熟悉集成学习算法的模型选择;
● 熟悉数据离散化操作;
● 熟悉特征工程;
● 理解TensorFlow深度学习框架的使用;
● 理解深度学习、神经网络;
● 熟悉Github操作;
● 理解Hadoop、Hive;
● 熟悉MySQL、MongoDB、Redis数据库的使用;
● 熟悉Python函数式编程;
● 熟悉Linux命令;
● 熟悉常见网站的反爬策略;
● 理解Scrapy爬虫框架;
● 熟练掌握Python OOP开发,编码遵守PEP8规范;

项目一:对目标网站爬取分析生成报告
项目简介:利用Scrapy框架编写代码对一些特定网站的数据进行抓取,然后将获得的数据进行内容分析,得到可用的数据后生成情报报告。
项目职责:
1.从上级获取目标网站。
2.分析网站结构。
3.编写爬虫代码,将数据存在本地。
4.针对报告格式编写自动化生成报告程序。

项目二:对网站中的内容进行分类
项目简介:通过建立语言模型判断目标网站内容发布的信息是否有害,并将结果上报给相关部门。
项目职责:
1.利用爬虫搜集网站内容。
2.通过分词工具建立有害信息字典。
3.利用贝叶斯算法训练分类模型。
4.将结果输出并上报。

项目三:基于平台大学生用户行为分析绘制用户画像
项目简介:P2P借贷平台的兴起吸引了社会中各个层次人群加入其中,对于用户群体分析发现许多年轻大学生活跃程度很高。为了分析大学生在目标客户平台借贷的行为特征,对大学生借贷、投资和生活行为制作用户画像。
项目职责:
1. 提取用户信用信息,定位目标用户。
2. 分析提取用户强相关信息,忽略弱相关信息。
3. 根据用户信息为目标用户打标签。
宅男拯救协会会长 ID:198160 复制

宅男拯救协会会长

python数据分析工程师 · 3年经验 · 京东数字科技控股股份有限公司
城市北京 海淀 日薪600元/8h 时间 下班后周六周日可工作日远程可工作日驻场(离职原因)可工作日驻场(自由职业原因)
0
累计接单
0
用户评价
1
被收藏

信用行为

0
接单数
0
评价数
1
收藏数

技术能力

AI 技能提取 | Python MySQL Redis MongoDB 深度学习 Hadoop Hive TensorFlow 机器学习 NLP Linux
熟悉Pandas、Numpy、Matplotlib等数据分析常用库的功能,进行数据操作、采集、处理、清洗、可视化、规整数据集;
● 熟悉Random Forest、GradientBoosting、Logistic Regression、K-Nearest Neighbors、Naive Bayes、Linear Regression、Support Vector Machines 等机器学习算法应用;
● 熟悉常用数据结构算法;
● 熟悉NLP中Word Segmentation、Filtering Words、Representation、Sentence Similarity、Noisy Channel Model、Language Model等方法原理;
● 对数据有较强的敏感度;
● 熟悉集成学习算法的模型选择;
● 熟悉数据离散化操作;
● 熟悉特征工程;
● 理解TensorFlow深度学习框架的使用;
● 理解深度学习、神经网络;
● 熟悉Github操作;
● 理解Hadoop、Hive;
● 熟悉MySQL、MongoDB、Redis数据库的使用;
● 熟悉Python函数式编程;
● 熟悉Linux命令;
● 熟悉常见网站的反爬策略;
● 理解Scrapy爬虫框架;
● 熟练掌握Python OOP开发,编码遵守PEP8规范;

项目经验

项目一:对目标网站爬取分析生成报告
项目简介:利用Scrapy框架编写代码对一些特定网站的数据进行抓取,然后将获得的数据进行内容分析,得到可用的数据后生成情报报告。
项目职责:
1.从上级获取目标网站。
2.分析网站结构。
3.编写爬虫代码,将数据存在本地。
4.针对报告格式编写自动化生成报告程序。

项目二:对网站中的内容进行分类
项目简介:通过建立语言模型判断目标网站内容发布的信息是否有害,并将结果上报给相关部门。
项目职责:
1.利用爬虫搜集网站内容。
2.通过分词工具建立有害信息字典。
3.利用贝叶斯算法训练分类模型。
4.将结果输出并上报。

项目三:基于平台大学生用户行为分析绘制用户画像
项目简介:P2P借贷平台的兴起吸引了社会中各个层次人群加入其中,对于用户群体分析发现许多年轻大学生活跃程度很高。为了分析大学生在目标客户平台借贷的行为特征,对大学生借贷、投资和生活行为制作用户画像。
项目职责:
1. 提取用户信用信息,定位目标用户。
2. 分析提取用户强相关信息,忽略弱相关信息。
3. 根据用户信息为目标用户打标签。
客服二维码

没找到合适的人才?

扫码添加客服极速匹配,或直接发布需求让更多人才主动报名

微信沟通 立即沟通 立即预约
平台担保交易 · 1小时内不满意可退款
微信扫码,建群沟通

平台信誉与实力

基于 35,336 需求方信任

  • 支付宝企业信用分 优秀 评级
  • 市场份额约占全行业三分之一
  • 程序员兼职行业全能首选平台
查看平台资质详情
收藏 立即预约 微信沟通 立即沟通