1. 负责 K8s 生产集群日常运维,管控 Node/Pod/Namespace 生命周期,完成资源隔离、异常排查与高可用保障。
2. 通过K8s HPA 自动扩缩容 + 手动调优,支撑业务流量波动,保障服务无中断,集群稳定运行。
3. 基于 Prometheus+Grafana 搭建 K8s 集群监控体系,实时监控节点、Pod 性能,快速预警并处理异常。
4. 参与 Jenkins+K8s+Docker+GitLab+Harbor CI/CD 流水线搭建,实现应用自动化构建与部署。
5. 编写 Shell 脚本实现集群巡检、服务重启、备份等自动化任务,降低人工运维成本。