编程与自动化:精通 Shell/Python/Go ,擅长开发运维自动化工具与脚本 ,显著提升部署效率 ,降低人工操作风险。
服务器 、数据库与中间件:熟练配置与调优 Tomcat 、Nginx 等 Web 服务器;精通 MySQL 、Redis 、MongoDB的日常管理 、性能调优与高可用方案;具备丰富的中间件运维实战经验 ,涵盖 Nacos 配置中心 、RocketMQ / Kafka /
RabbitMQ 消息队列 、Zookeeper 分布式协调服务 、Zeebe 云原生工作流引擎 , 日常负责集群部署 、监控告警 、故障排查 、性能调优及高可用保障。
容器与编排 :深度掌握 Kubernetes / Docker ,主导过大规模业务容器化迁移;熟悉 OpenEBS/Longhorn 存储 、ELK日志 、Istio 服务网格等云原生生态组件。
云原生网关与流量治理:精通 Kubernetes Gateway API 及 Envoy Gateway ,成功将传统 Nginx Ingress + Spring
Cloud Gateway 双层架构升级为统一网关层 ,实现 JWT 无状态认证 、IP 白名单 、Header 注入 、金丝雀/灰度发布等高级流量治理能力 ,延迟降低 50% ,资源开销减少 60%。
GitOps 与渐进式交付 :深入实践 ArgoCD + Argo Rollouts ,实现声明式 GitOps 持续交付与灰度发布; 自研 Nacos 配置同步工具 ,实现配置版本化 、审计追溯与自动同步 ,回滚效率由小时级提升至分钟级。
可观测性体系:构建 Prometheus+Grafana 监控 、SkyWalking 链路追踪 、SLS 日志平台三位一体的企业级可观测体系 ,集成飞书/企业微信告警 ,大幅缩短故障定位时间。
CI/CD 与自动化 :设计优化 Jenkins Pipeline 全流程自动化 ,熟练使用 Drone 实现面向 K8s 的 CI/CD;具备 Ansible 批量运维经验。
云服务管理 :深入掌握阿里云(ACK/ECS/SLS)与腾讯云(TKE)产品 ,擅长资源规划 、成本优化及弹性伸缩(HPA + ECI) ,资源利用率提升 25%。
云原生网关迁移 技术负责人
项目背景: 原流量入口采用 Nginx Ingress(社区已停维)+ Spring Cloud Gateway 双层架构 ,链路冗余 、监控割裂、资源开销大;且 Spring Cloud Gateway 依赖 Redis 存储 Session ,有状态特性成为水平扩展瓶颈。
技术方案:
主导迁移至 Kubernetes Gateway API + Envoy Gateway 统一网关层 ,核心策略包括:
1. 通过 SecurityPolicy 实现 JWT 无状态认证 ,彻底移除 Redis Session 依赖。
2. 配置 claimToHeaders 映射 + External Processing 服务 ,实现用户信息透传与自定义 Header 注入。
3. 利用 ClientTrafficPolicy 与 SecurityPolicy 原生实现 IP 白名单与访问控制。
4. 基于 HTTPRoute 权重路由与请求匹配能力,原生落地金丝雀发布与灰度发布策略,无需额外组件。
5. 对接 Prometheus + OpenTelemetry ,解决迁移过程中的监控断层 ,实现端到端统一可观测。
项目成果:
1. 成功下线 Nginx Ingress Controller 与 Spring Cloud Gateway ,流量路径缩短 ,延迟降低 50%;所有路由 、认证 、限流策略均以 Kubernetes CRD 声明并纳入 GitOps 管理 ,变更即时生效 ,运维复杂度显著降低。
GitOps 持续交付体系与渐进式发布实践 运维负责人
项目背景 :为提升应用发布的一致性与可观测性 ,降低人工操作风险 , 引入 GitOps 理念与渐进式交付能力。
实施方案:
1. 引入 ArgoCD 作为声明式持续交付引擎 ,实现 Git 仓库与 K8s 集群状态的自动同步与偏差修复。
2. 结合 Argo Rollouts 实现金丝雀发布与蓝绿部署 ,精细化控制发布流量比例与自动回滚条件。
3. 自研 Nacos 配置 GitOps 同步工具 ,将 Nacos 配置以 YAML 形式纳管至 Git 仓库 ,实现配置变更的版本化 、Code Review 审计与自动同步 ,回滚时间由降至分钟级。
项目成果:
1. 发布流程全链路声明式管理 ,配置漂移与人为失误基本消除;配置变更引发的故障率大幅降低 ,发布风险显著收敛。
核心业务云原生架构迁移与可观测体系建设 运维负责人
项目背景: 公司核心业务线面临架构老旧 、部署分散 、环境不一致及缺乏统一观测能力等问题 ,难以支撑业务高速增长与稳定性要求。
核心工作:
1. 制定分阶段迁移方案 ,涵盖集群规划 、应用容器化改造 、中间件(Nacos 、MQ 、Zookeeper 、Zeebe)容器化部署 、灰度发布策略与回滚预案 ,实现全链路零故障迁移。
2. 从零构建基于 自研 Kubernetes Operator(CRD + Controller) + Kustomize的标准化部署体系 ,统一多环境(开发/预发/生产)应用交付标准。
3. 集成 Prometheus + Grafana(指标监控) 、SkyWalking(链路追踪) 、SLS( 日志平台) ,打造企业级可观测体系,配置精准告警规则并集成飞书通知。
4. 落地健康检查与优雅终止机制 ,确保发布期间用户无感知切换。
项目成果:
1. 100% 完成计划内业务云原生升级 ,业务可用性达 100%;环境交付时间由小时级缩短至 10 分钟内 ,资源利用率提升25%。
作为项目负责人,从零开始完成 Sub2API 聚合网关与管理系统的全流程部署与定制开发: 服务器基础环境配置:在云服务器(Linux 环境)上完成系统初始化,包括时区设置、软件源更新、基础工具安装及安全组策略配置。服务器选用海外节点以保障对 Claude、OpenAI 等上
1. XORM 数据库驱动层适配 CasDoor 使用 XORM 作为数据库 ORM 框架。达梦 8 的官方 Go 驱动基于 database/sql 接口实现,理论上可以与 XORM 集成。但在实际适配中,CasDoor 集成的 XORM 版本过低,无法与达梦驱动兼容。通