1.智慧监控运维平台
技术栈:
NATS、SpringBoot、WebSocket、WebShell、Vue.js、Redis、PostgreSQL、Docker
核心职责:
主导系统架构设计,基于NATS消息中间件构建高并发设备状态上报通道,实现千台级边缘设备秒级心跳监测与状态感知;
设计插件化告警引擎,支持邮箱、钉钉、企业微信、短信等多通道动态配置与热插拔,按设备类型、区域、告警级别灵活触发通知策略;
实现基于WebShell技术的浏览器端远程运维功能,支持对边缘设备的SSH连接、日志查看、服务重启与配置更新,提升故障处置效率。
项目成果:
系统稳定运行超7个月,异常告警响应及时率达 98%,远程运维覆盖率达 90%,现场维护成本降低 70%,有效支撑城市交通AI调度算法的连续性与可靠性,获客户“年度运维创新奖”。
2.某某数据治理平台
技术栈:
Hadoop, Hive, HBase, Spark, Doris, Kafka, DataX, Zookeeper, MySQL, Redis, SpringBoot, SpringCloud Gateway, SpringCloud Alibaba(Nacos, Sentinel, Seata)
核心职责与成果:
1.主导平台整体技术架构设计与技术选型
设计“五中心一体化”数据治理架构(数据资产中心、数据汇聚中心、数据服务中心、数据开发中心、数据运营中心),统一数据模型、接口规范与元数据标准,提升系统模块化与可维护性。
完成大数据技术栈(批处理 + 实时计算)与微服务中台(SpringCloud Alibaba)的融合选型,支持PB级数据处理与高并发API服务调用。
2.构建高性能、可扩展的数据底座
基于Kafka + Spark Streaming实现多源异构数据实时接入,日均处理数据量超9000万条;
采用Doris构建实时数仓,支撑多维分析与即席查询,平均响应时间 < 1s;
通过DataX +调度系统实现离线任务自动化调度,支持每日5000+批处理作业稳定运行。
3.主导核心功能模块研发与持续迭代
元数据管理:实现数据表、字段级血缘追踪与影响分析,覆盖率达98%;
主数据管理:统一院校、专业、教师、学生等核心主数据标准,提升跨系统数据一致性;
数据源管理:支持 MySQL、Oracle、SQL Server、Hive等10+类型数据源动态接入与连接池优化;
工作流与任务调度:基于自研调度引擎实现离线任务依赖编排与失败重试机制,任务成功率提升至99.5%;
4.提升平台可用性与用户体验
设计统一API网关(SpringCloud Gateway)与服务熔断机制(Sentinel),保障高并发场景下服务稳定性;
推动前端组件标准化与后端接口规范化,降低前后端联调成本40%。
项目成果:
平台累计接入2000+所某某,管理数据资产超12万项,日均提供数据服务调用55万次;
数据质量达标率由初期75% 提升至96%+;
系统稳定运行三年。