H

算法实习生
腾讯 · 2年经验
H
日薪: ¥500/8h
地点: 其他 全区
时间: 下班后可工作日远程
ID:250379 复制

0
接单数
0
评价数
1
收藏数

AI 技能提取 | Java Python 人工智能 C++ 计算机视觉
1. 985硕士,硕士三年主攻人工智能算法,包括数据挖掘、数据分析、计算机视觉,硕士期间发表两篇视觉方向(图像处理)的论文。
2. 多次参加算法比赛,多次取得Top10的成绩
3. 编程语言会python、java、C++
4. 技术栈:java的后端,java的大数据开发,python的人工智能

一. 人工智能和数据分析
1 -- 阿里巴巴算法大赛-智慧海洋建(线上排名 Top7/3250)
比赛内容描述:
使用结构型数据集,每艘船有 2 到 3 天内的行船轨迹,以此来预测每艘船的作业类型(拖网、围网、刺网)
属于多分类问题
主要解决方案
(1)使用 matplotlib 和 seaborn 等 python 库,根据异常值、离群点等方法做数据清洗,删除静止记录
(2)深入业务逻辑,使用 pandas 和 numpy 等做特征工程
(3)使用 sklearn 库做算法选择和对比分析,包括 XGB、LGB、随机森林等,使用贝叶斯调优做参数自整定
2 -- University of Liverpool-Ion-Switching (kaggle) 线上排名:铜牌 Top8%
比赛内容描述和方法:
为了模拟真实实验室所采集的离子通道电信号,举办方主动向该数据加入不同噪声,该噪声导致训练集和测试集数据分布 差异太大,所以在特征工程中去除噪声,并对比其他去燥算法(Kalman 滤波),分别将电信号向前和向后移动三个时间点和随机森林训练得到的预测概率作为特征;模型部分先后使用 WaveNet、DenseNet(一维卷积)等 NN 算法,在其基础上加入 BiLSTM、修改损失函数f1_score 和 focal_loss, 使用 LightGBM 的 stacking 模型,对比选择最优结果。

二. Java大数据开发
1. 电商数据仓库分析系统
项目描述:
该项目收集来自前端埋点的用户行为日志数据和 JavaEE 后台的 MySQL 业务数据,使用 Hadoop 生态技术圈的
相关技术,搭建数据仓库,并进行统计分析;通过统计活跃用户数(日活、周活、月活)、每日新增用户、留存率
等,了解用户的详细使用情况;通过统计商品销量、商品差评率、商品退款率等,了解商品相关信息;通过复购率
等,了解商品的营销情况
个人职责:
(1)整体上负责项目的技术选型,数据库设计,环境搭建等
(2)负责用 HiveSQL 写表,分析电商相关指标
技术栈:
Java、Hadoop、Flume、Kafka、Sqoop、MySQL、HDFS、Hive、Zookeeper
H ID:250379 复制

H

算法实习生 · 2年经验 · 腾讯
城市其他 全区 日薪500元/8h 时间 下班后可工作日远程
0
累计接单
0
用户评价
1
被收藏

信用行为

0
接单数
0
评价数
1
收藏数

技术能力

AI 技能提取 | Java Python 人工智能 C++ 计算机视觉
1. 985硕士,硕士三年主攻人工智能算法,包括数据挖掘、数据分析、计算机视觉,硕士期间发表两篇视觉方向(图像处理)的论文。
2. 多次参加算法比赛,多次取得Top10的成绩
3. 编程语言会python、java、C++
4. 技术栈:java的后端,java的大数据开发,python的人工智能

项目经验

一. 人工智能和数据分析
1 -- 阿里巴巴算法大赛-智慧海洋建(线上排名 Top7/3250)
比赛内容描述:
使用结构型数据集,每艘船有 2 到 3 天内的行船轨迹,以此来预测每艘船的作业类型(拖网、围网、刺网)
属于多分类问题
主要解决方案
(1)使用 matplotlib 和 seaborn 等 python 库,根据异常值、离群点等方法做数据清洗,删除静止记录
(2)深入业务逻辑,使用 pandas 和 numpy 等做特征工程
(3)使用 sklearn 库做算法选择和对比分析,包括 XGB、LGB、随机森林等,使用贝叶斯调优做参数自整定
2 -- University of Liverpool-Ion-Switching (kaggle) 线上排名:铜牌 Top8%
比赛内容描述和方法:
为了模拟真实实验室所采集的离子通道电信号,举办方主动向该数据加入不同噪声,该噪声导致训练集和测试集数据分布 差异太大,所以在特征工程中去除噪声,并对比其他去燥算法(Kalman 滤波),分别将电信号向前和向后移动三个时间点和随机森林训练得到的预测概率作为特征;模型部分先后使用 WaveNet、DenseNet(一维卷积)等 NN 算法,在其基础上加入 BiLSTM、修改损失函数f1_score 和 focal_loss, 使用 LightGBM 的 stacking 模型,对比选择最优结果。

二. Java大数据开发
1. 电商数据仓库分析系统
项目描述:
该项目收集来自前端埋点的用户行为日志数据和 JavaEE 后台的 MySQL 业务数据,使用 Hadoop 生态技术圈的
相关技术,搭建数据仓库,并进行统计分析;通过统计活跃用户数(日活、周活、月活)、每日新增用户、留存率
等,了解用户的详细使用情况;通过统计商品销量、商品差评率、商品退款率等,了解商品相关信息;通过复购率
等,了解商品的营销情况
个人职责:
(1)整体上负责项目的技术选型,数据库设计,环境搭建等
(2)负责用 HiveSQL 写表,分析电商相关指标
技术栈:
Java、Hadoop、Flume、Kafka、Sqoop、MySQL、HDFS、Hive、Zookeeper
客服二维码

没找到合适的人才?

扫码添加客服极速匹配,或直接发布需求让更多人才主动报名

平台担保交易 · 1小时内不满意可退款

平台信誉与实力

基于 35,336 需求方信任

  • 支付宝企业信用分 优秀 评级
  • 市场份额约占全行业三分之一
  • 程序员兼职行业全能首选平台
查看平台资质详情
收藏