(= ̄ ρ ̄=) ..zzZZ ID:341443 复制

(= ̄ ρ ̄=) ..zzZZ

大数据开发工程师 · 8年经验 · 腾讯云计算有限责任公司
城市北京 海淀 日薪800元/8h 时间 下班后周六周日可工作日远程
0
累计接单
0
用户评价
0
被收藏

技术能力

AI 技能提取 | Spring Boot Kafka MySQL Hadoop HBase ZooKeeper Nginx
技术架构:Nginx、Springboot、Flume、Kafka、MqSQL、Sqoop、Hadoop、Zookeeper、HBase、Mysql、Azkaban、Atlas、Range、Griffin、Superset、Presto

项目经验

腾讯云湖仓一体实时项目 2022.03-2024.04
技 术 架 构:FlinkCDC、firebeat、logstash、upsert-kafka、kafka、Flink、hudi。开发工具:IDEA + Oceanus流计算平台
项目描述:FlinkCDC将业务数据导入到Kafka的主题中,形成ods层.使用Flink对接Kafka,消费kafka中 的
数据至hudi,按照预定的数仓结构,使用hudi读和写的能力将ods层的业务数据经过Oceanus平台流式计算平台的处理 形成对应的dwd层放置在hudi中,日志埋点数据通过firebeat发往logstash再次发往MQ,输出到hudi中。
技术要点:
1.使用 FlinkCDC 将业务数据导入到 Kafka中的topic中(json or csv).
2.使用 Flink 读取kafka 层的业务数据,对数据进行逻辑加工设定成满足hudi配置的一些参数
3.读hudi表数据逻辑加工统计数据输出至hudi
4.Hudi新式框架的特性,表模式(mor,cow),buckert索引,插入(upsert insert)的模式等相关的一些知识点
5.Hudi表双流拼接功能解决流式join问题
6.流式任务,SparkSql操作hudi表(增删改查)对hudi表读任务的异常和下游数据回撤的功能
7.数据发往数据湖,数据倾斜致使某个bucket数据量变多,其它变少,致使写入hudi的小文件过多问题
8.Hudi表开启异步压缩,减少在线压缩内存的消耗。
9.Hudi写入背压增大,调节背压
流量监控各个阶段保证任务正常运行。
客服二维码

没找到合适的人才?

扫码添加客服极速匹配,或直接发布需求让更多人才主动报名

微信沟通 立即沟通 立即预约
平台担保交易 · 1小时内不满意可退款
微信扫码,建群沟通

平台信誉与实力

基于 35,336 需求方信任

  • 支付宝企业信用分 优秀 评级
  • 市场份额约占全行业三分之一
  • 程序员兼职行业全能首选平台
查看平台资质详情
相似人才推荐: