1.云平台与运维:熟悉腾讯云、火山云、阿里云IAAS层产品(计算服务器、各类存储产品、网络VPC/CLB、监控等)的运维、排障与调优;
2.Linux运维:熟悉Linux系统性能分析(CPU、内存、磁盘I/O、网络)、故障排查、内核参数调优及系统安全加固。
3. 自动化运维:熟练掌握Shell脚本编写实现自动化任务;利用Jenkins+GitLab CI/CD流水线构建与维护;具备Ansible等自动 化工具使用经验。
4. 监控与日志:熟悉Zabbix监控平台的部署、定制与告警管理;熟悉ELK日志收集与分析。
5. web 集群方案:nginx、tomcat、nodejs、lvs、keepalived、haproxy
6. 熟悉数据库集群方案:mycat、atlas 中间件,pgsql 分库分表插件 citus、mongodb 分片集群,redis、Hadoop之 HDFS 分布式存储
项目一、云平台IAAS层深度运维与排障
内容:
1. 根据客户业务模型设计压测方案,对云服务器、云磁盘及网络进行性能基准测试
2. 使用tcpdump、Wireshark等工具分析解决复杂网络抖动、延迟超时问题
3. 开发Shell脚本实现服务器批量性能采集、日志关键错误扫描自动化
4. 将典型故障案例转化为技术文档,形成知识库
项目二、利用云平台产品搭建完整的业务架构
内容:
1.利用网络安全产品配置入网出网安全规则
2.利用负载均衡和k8s实现高可用架构
3.利用安全产品防护服务器
4.最后再配置云监控告警及时监控服务整体运行状态
将云上审计日志投递到日志服务,编写sql检索语句,将需要告警的字段和告警条件取出来,通过飞书或者其他渠道推送消息到群里
项目概述 处理客户云服务器突发故障:网站打不开、服务器被攻击、勒索病毒、漏洞修复、权限泄露等紧急运维需求,同时完成等保 2.0 安全基线加固。 核心工作内容 应急排障:VNC 救援模式修复系统、磁盘爆满清理、进程卡死排查、数据库崩溃修复; 安全加固:SSH 禁止密码登录、
项目概述 云服务器出现 CPU 高占用、内存溢出、磁盘 IO 打满、网络延迟高、接口响应缓慢、并发卡顿等问题,做全维度系统内核、中间件、业务层深度性能调优,适用于商城、后台 API、小程序、数据库、消息队列业务服务器。 核心调优工作内容 CPU 调优 内核参数:CPU