熟练掌握 Java、Go、Python 等主流开发语言,具备扎实的数据结构、算法、计算机网络、操作系统及软件工程基础。曾在哔哩哔哩工作,熟悉大型互联网业务的研发流程和工程规范,具备高并发、高可用、低延迟系统的设计、开发与性能优化经验。熟练使用 Spring Boot、Spring Cloud、MyBatis、Gin 等框架,掌握微服务架构、领域建模、接口设计、服务治理、限流熔断、分布式事务及灰度发布等技术。熟悉 MySQL、PostgreSQL、Redis、MongoDB 等数据库及缓存系统,能够进行索引优化、SQL 调优、数据一致性和容量规划。熟悉 Kafka、RocketMQ、Elasticsearch、Nginx 等中间件,掌握 Docker、Kubernetes、Linux、Git、Jenkins 等工程化工具,具备持续集成、自动化部署、日志监控、故障排查和线上应急处理能力。拥有良好的系统分析、技术方案设计、代码审查和跨团队协作能力,能够独立负责复杂业务模块及大型项目的落地与迭代。
曾参与哔哩哔哩核心业务系统及基础平台建设,负责高并发服务的架构设计、核心模块研发、性能优化和线上稳定性治理,具备从需求分析、技术方案设计、开发测试到灰度发布、监控告警和故障复盘的完整项目经验。
1. 大规模内容分发与信息流服务建设
参与内容推荐、动态信息流及用户个性化内容分发相关后端系统建设,负责内容聚合、候选结果编排、用户状态查询和接口性能优化。系统采用 Java、Go、Spring Boot、gRPC、Redis、MySQL、Kafka 等技术,通过服务拆分、异步化处理和多级缓存降低核心链路延迟。针对热点内容引发的缓存击穿和流量倾斜问题,设计本地缓存与分布式缓存协同机制,引入请求合并、热点隔离、缓存预热和随机过期策略;针对下游服务抖动,完善超时控制、熔断降级和限流保护,提升高峰流量下的系统可用性。参与慢查询治理、线程池参数调优和接口链路分析,持续优化服务吞吐量与响应时间。
2. 用户互动及消息事件处理平台
参与点赞、收藏、评论、关注、消息通知等高频互动业务的服务化建设,负责事件接入、状态变更、消息投递和数据一致性处理。基于 Kafka 构建异步事件驱动架构,将核心交易链路与统计、通知、推荐特征更新等非核心流程解耦。针对消息重复、乱序和消费失败问题,设计业务幂等键、状态机校验、重试队列、死信队列和补偿任务,保障消息处理的最终一致性。针对突发热点流量,采用分区扩容、批量消费、削峰填谷和热点用户隔离等方式提升系统承载能力,并通过消费延迟、失败率和积压量监控及时发现异常。
3. 高可用微服务及稳定性治理项目
负责多个核心微服务的稳定性建设,对服务依赖、数据库、缓存、中间件和外部接口进行系统性风险梳理。建立接口成功率、P95/P99 延迟、线程池使用率、数据库连接池、缓存命中率和消息积压等监控指标,完善日志、指标和分布式链路追踪体系。推动服务分级、容量评估、压测演练、故障注入和应急预案建设,通过限流、熔断、降级、隔离、重试和快速回滚机制降低故障影响范围。参与线上故障定位和复盘,根据根因分析推动代码、架构及流程改进,提升系统可观测性和故障恢复能力。
4. 数据存储与查询性能优化
负责业务数据库和缓存系统的性能治理,能够根据访问模式进行表结构、索引和数据分片设计。针对大数据量场景下的慢查询问题,通过执行计划分析、联合索引优化、查询改写、冷热数据分离和异步汇总降低数据库压力。针对高频读写业务,合理使用 Redis 数据结构、Lua 脚本和分布式锁,处理缓存与数据库一致性、并发更新和热点 Key 等问题。参与数据迁移和版本升级方案设计,通过双写校验、灰度切流和数据对账保证迁移过程平稳可控。
个人围绕大模型推理服务中长上下文 Prefill 开销高、KVCache 跨请求复用效率不足以及分布式缓存检索调度成本较高等问题,设计并实现 CachePilot。该项目基于 Mooncake 分布式 KVCache Store 构建,是一套非侵入式、可复现的 KVCache 性
项目已投入使用,2个月营收达20万+ 循物社区智能分类回收系统是一套面向社区、校园及园区场景的智能分类回收与运营管理平台,围绕“分类投递—积分奖励—商品兑换—清运管理—后台监管—财务结算”构建完整业务闭环,解决传统垃圾分类中用户反馈不足、设备状态难监管、清运过程难追踪以及积分运
项目已投入使用,2个月营收达20万+ 循物社区智能分类回收系统是一套面向社区、校园及园区场景的智能分类回收与运营管理平台,围绕“分类投递—积分奖励—商品兑换—清运管理—后台监管—财务结算”构建完整业务闭环,解决传统垃圾分类中用户反馈不足、设备状态难监管、清运过程难追踪以及积分运