Mr.💤

Mr.💤

运维leader · 7年经验 · 深圳比核科技有限公司
城市成都 高新 日薪500元/8h 时间 下班后周六周日可工作日远程
0
累计接单
0
用户评价
0
被收藏

技术能力

AI 技能提取 | Kubernetes Docker CI/CD Jenkins Ansible Python MySQL Redis Linux
7年运维/开发经验,其中5年以上专注SRE方向。系统与网络:熟悉Linux操作系统、常用服务部署及网络故障排查。容器与编排:熟悉Kubernetes网络(Calico/Flannel)、存储(CSI)及安全策略,设计过基于HPA的自动伸缩和故障自愈机制,熟悉Docker镜像优化与容器化部署策略。CI/CD与自动化:精通使用Jenkins、Kubernetes、Docker构建和优化CI/CD流水线,推动基础设施即代码实践(Ansible/Shell),具备运维自动化平台从0到1的独立设计开发能力。可观测性:深度掌控Zabbix、Grafana、InfluxDB等监控栈的搭建、优化与二次开发,具备端到端的可观测性体系建设经验,熟悉基于SLO/错误预算的告警设计思路,能有效控制告警噪音。数据库:熟悉MySQL、Redis的操作、性能优化与灾备方案设计。云平台:熟悉AWS、阿里云核心服务的运维与优化。编程能力:熟练使用Python、Shell开发自动化脚本和工具平台,能独立完成从需求分析到落地上线的全流程开发。稳定性保障:拥有丰富的On-Call与紧急事件处理经验,专注于优化MTTR,推动有效的故障复盘与改进项落地闭环。软技能:具备团队培训、新人指导和跨部门协调经验,能用英语进行日常技术沟通与汇报。

项目经验

项目一:全球可观测性数据平台高可用架构。负责支撑全球化流媒体业务的可观测性数据平台(基于InfluxDB)的稳定性、性能与成本优化,该平台每秒处理百万级数据点,是衡量核心业务SLA的数据基石。主导完成从单点内存型架构到多实例、文件存储、高可用架构的彻底重构,设计并实施基于VIP切换的主备容灾方案。平台可用性从99.5%提升至99.95%,在业务数据量增长300%的情况下,数据丢失率控制在0.001%以下。

项目二:自动化运维平台独立设计开发。识别到运维团队存在的批量配置、数据通报等大量重复性手动操作痛点,主动发起并独立完成一套运维自动化平台的设计与开发,与CI/CD流程(Jenkins/Kubernetes)深度集成,实现应用发布后的自动化监控装配与上线检查。该平台上线后为团队消除约70%的重复性手工操作,新服务/功能的监控上线时间从平均2小时缩短到5分钟,运维人为失误事件降为零。

项目三:业务稳定性保障与应急响应体系建设。作为团队核心成员,负责7x24小时一级On-Call响应,作为重大故障的应急指挥官,协调开发、网络与基础设施团队进行快速止损与根因分析,主导撰写故障复盘报告并推动改进措施落地。通过优化告警策略和应急手册,将平均MTTR从30分钟降低至10分钟以内,全年成功处理10起以上P1级重大故障,推动建立的故障复盘机制使同类故障复发率降低90%。
客服二维码

没找到合适的人才?

扫码添加客服极速匹配,或直接发布需求让更多人才主动报名

微信沟通 立即沟通 立即预约
平台担保交易 · 1小时内不满意可退款
微信扫码,建群沟通

平台信誉与实力

基于 35,336 需求方信任

  • 支付宝企业信用分 优秀 评级
  • 市场份额约占全行业三分之一
  • 程序员兼职行业全能首选平台
查看平台资质详情