点击保存简历
模块
风格
模板
导入
  • 个人名称
  • 头像
  • 基本信息
  • 求职意向
  • 工作经历
  • 项目经验
  • 实习经验
  • 作品展示
  • 奖项荣誉
  • 校园经历
  • 教育背景
  • 兴趣爱好
  • 技能特长
  • 语言能力
  • 自我评价
  • 报考信息
  • 简历封面
  • 自荐信
陆明哲的照片
陆明哲
在平凡的岗位上创造不平凡的价值,这是我的职业信仰。
28岁
3年工作经验
13800138000
DB@zjengine.com
求职意向
云平台运维工程师
北京
薪资面谈
一周内到岗
工作经历
2021.12 - 2023.07
小楷闪购科技有限公司
云原生可观测性工程师
  • 主导构建了公司新一代“基于eBPF的可观测性平台”,通过eBPF技术无侵入地采集应用网络流量、系统调用等指标,实现了代码零修改的全链路网络性能分析,精准定位了多个微服务间的网络性能瓶颈,将平均网络延迟优化了15%。
  • 利用eBPF开发了“持续性能剖析”工具,以极低的开销(<1%)持续采集生产环境应用的CPU、内存火焰图,帮助开发团队发现并优化了多个深层次的代码性能问题,使核心服务P99延迟降低20%。
  • 通过设计“智能根因分析”算法,能自动关联metrics, logs, traces和eBPF网络数据,在发生故障时快速定位问题是出在应用代码、网络、中间件还是资源层面,将平均故障定位时间(MTTR)缩短了60%。
  • 将该平台以“可观测性即代码”的方式提供给所有开发团队,通过简单的注解即可开启深度监控,极大地降低了使用门槛,提升了整个研发体系的可观测性水平。
2020.03 - 2021.11
小楷闪购科技有限公司
运维开发工程师
  • 维护和优化基于Prometheus的监控告警体系,处理了海量指标带来的存储和查询性能挑战,保障了系统的稳定性。
  • 深入学习了eBPF技术,并尝试编写了一些简单的工具用于网络抓包和性能分析,为后续的重大项目做好了技术储备。
  • 积极参与on-call轮值,处理线上故障,培养了敏锐的风险意识和应急处理能力。
技能特长
沟通能力
执行能力
热情坦诚
文案能力
项目经验
2022.07 - 2024.03
星途互动科技有限公司
运维开发工程师(资深)

电商大促高可用保障体系全链路升级项目

  • 项目背景:公司核心电商平台承载年GMV超100亿的业务,过往大促(如双11、618)依赖人工巡检与被动故障响应,SLA仅99.5%,曾因数据库慢查询、缓存击穿导致页面宕机3次,影响订单转化率。目标是构建“预防-监控-处置”全链路自动化保障体系,将大促SLA提升至99.95%以上。
  • 关键难题:1)多系统(订单、库存、支付、物流)耦合下,故障根因定位耗时平均15分钟;2)流量峰值(单秒10万QPS)下,资源弹性伸缩滞后,曾出现库存服务CPU飙升至90%未及时扩容;3)跨团队(开发、测试、运维)预案协同混乱,故障处置时职责不清。
  • 核心行动:1)主导基于Jaeger的全链路追踪平台建设,整合12个核心系统的trace数据,通过自定义标签(如订单ID、用户地域)实现故障秒级溯源,定位时间缩短至2分钟内;2)设计“历史流量+实时舆情”的动态容量预测模型(用Python实现LSTM算法),预测准确率达92%,联动阿里云弹性伸缩规则,将资源扩容时间从30分钟压缩至5分钟;3)开发混沌演练平台,覆盖“网络延迟、节点宕机、数据库主从切换”8类高频故障场景,推动制定《大促故障处置SOP》,并将跨团队演练频率从季度改为月度,协同效率提升40%。
  • 项目成果:大促期间SLA稳定在99.95%以上,故障响应时间从15分钟降至2分钟,年度因故障导致的订单损失减少约800万元;资源弹性成本降低18%(年节省云费用120万)。本人主导了全链路体系的架构设计与落地,推动跨部门建立了标准化的故障处置流程,成为公司大促保障的核心技术负责人。
2020.05 - 2022.06
星途互动科技有限公司
高级运维开发工程师

容器化微服务治理平台自主研发项目

  • 项目背景:公司微服务数量从20个增长至50+,依赖第三方容器平台(如某云ACK)不仅年费用超300万,且缺乏针对业务的流量治理、资源调度能力(如活动服务需优先分配资源)。目标是自主研发轻量化容器治理平台,支撑微服务高可用与成本优化。
  • 关键难题:1)第三方平台无法实现“按业务优先级”的资源抢占,活动高峰期常因资源竞争导致核心服务延迟;2)微服务间流量调度单一,无法支持灰度发布时的按用户分层放量;3)平台扩展性差,新增微服务需手动配置监控与熔断规则。
  • 核心行动:1)基于Kubernetes Operator模式开发“业务优先级调度模块”,通过自定义ResourceQuota与PriorityClass,实现活动服务在大促时自动抢占非核心服务资源,资源利用率从45%提升至65%;2)集成Istio服务网格,设计“用户标签+权重”的灰度发布策略,支持按新用户/老用户、地域分层放量,将灰度故障影响范围缩小至5%以内;3)构建自动化规则引擎,通过Prometheus采集的指标(如QPS、延迟)自动生成熔断与降级策略,无需人工干预,微服务故障次数减少50%。
  • 项目成果:平台上线后替代了第三方容器平台的核心功能,年节省费用300万;微服务平均延迟从80ms降至50ms,故障恢复时间从30分钟缩短至5分钟;平台可用性达99.99%,支持公司微服务数量扩张至80+。本人主导了平台的核心模块研发与架构设计,解决了微服务治理的关键痛点,推动公司技术栈从“依赖第三方”转向“自主可控”。
奖项荣誉
  • 信息系统运维管理工程师(中级)
  • 2022年度公司项目攻坚奖
  • 2023年度部门优秀技术员工
自我评价
  • 深耕互联网云运维,以业务连续性为核心搭高可用体系,习惯从用户端体验反推策略,提前布局容灾弹性,避免被动救火。
  • 擅长数据驱动资源优化,从利用率到成本形成闭环,锚定业务增长平衡性能投入,让云资源支撑更多核心场景。
  • 故障处理不止恢复,更沉淀根因分析与流程改进机制,推动跨团队建故障预防共识,把单点问题转组织能力迭代。
  • 跨团队用业务语言解码技术约束,让产品开发快速理解运维边界,共定支撑业务目标的方案,降沟通成本。
智能诊断
编写灵感
请选择需要查找的灵感类型
请选择灵感源泉
选择合适的内容插入后即可编辑调整
请在上方选择您需要获取的灵感类型
对话框
提示
说明