点击保存简历
模块
风格
模板
导入
  • 个人名称
  • 头像
  • 基本信息
  • 求职意向
  • 工作经历
  • 项目经验
  • 实习经验
  • 作品展示
  • 奖项荣誉
  • 校园经历
  • 教育背景
  • 兴趣爱好
  • 技能特长
  • 语言能力
  • 自我评价
  • 报考信息
  • 简历封面
  • 自荐信
陆明哲的照片
28岁
3年工作经验
13800138000
DB@zjengine.com
求职意向
云平台运维工程师
北京
薪资面谈
一个月内到岗
技能特长
沟通能力
执行能力
热情坦诚
文案能力
兴趣爱好
摄影
看书
阅读
跑步
陆明哲
用系统化的思维解决问题,用温度化的方式交付成果,这是我的工作准则。
工作经历
2023.03 - 至今
小楷科技有限公司
云原生架构师
  • 主导设计并落地了公司基于Kubernetes的下一代混合云平台架构,通过Cluster API实现了对多云(AWS, Azure,私有云)集群的统一生命周期管理,使新集群交付时间从周级缩短至小时级,资源利用率提升35%,年节省基础设施成本超两千万元。
  • 设计“多租户与资源配额治理”体系,通过OpenPolicyAgent定义安全策略,通过Hierarchical Namespace Controller实现复杂的资源分层配额管理,在保证数百个业务团队隔离性的同时,实现了资源的公平共享与自动回收。
  • 攻克“万级节点集群”下的稳定性与性能瓶颈,通过优化etcd备份策略、kube-apiserver请求优先级与流量整形、以及自定义调度器扩展,将集群控制面的可用性提升至99.99%,无单点故障。
  • 建立的“云原生技术雷达与准入规范”,定义了服务网格、可观测性、GitOps等技术的选型与最佳实践,并通过开发Kyverno策略即代码,实现了对集群配置的自动化合规检查,确保了平台的整体一致性与安全性。
2021.07 - 2023.02
小楷科技有限公司
高级云原生开发工程师
  • 负责公司核心“服务网格(Istio)”的引入与落地,通过引入“渐进式流量迁移、金丝雀发布、分布式链路追踪”方案,实现了应用无感知接入,并将故障注入测试和全链路可观测性融入开发流程,使线上发布故障率下降70%。
  • 实现的“HPA与自定义指标扩缩容”策略,基于业务QPS、应用队列深度等自定义指标,实现了工作负载的精准弹性伸缩,成功应对了数次突发流量高峰,同时节省了25% 的常态资源成本。
  • 深度研发了“集群可观测性栈”(Prometheus + Thanos + Loki + Grafana),实现了指标、日志、链路的统一采集、存储与告警,将故障平均发现时间(MTTD)缩短至2分钟以内。
项目经验
2022.07 - 2024.03
星途互动科技有限公司
运维开发工程师(资深)

电商大促高可用保障体系全链路升级项目

  • 项目背景:公司核心电商平台承载年GMV超100亿的业务,过往大促(如双11、618)依赖人工巡检与被动故障响应,SLA仅99.5%,曾因数据库慢查询、缓存击穿导致页面宕机3次,影响订单转化率。目标是构建“预防-监控-处置”全链路自动化保障体系,将大促SLA提升至99.95%以上。
  • 关键难题:1)多系统(订单、库存、支付、物流)耦合下,故障根因定位耗时平均15分钟;2)流量峰值(单秒10万QPS)下,资源弹性伸缩滞后,曾出现库存服务CPU飙升至90%未及时扩容;3)跨团队(开发、测试、运维)预案协同混乱,故障处置时职责不清。
  • 核心行动:1)主导基于Jaeger的全链路追踪平台建设,整合12个核心系统的trace数据,通过自定义标签(如订单ID、用户地域)实现故障秒级溯源,定位时间缩短至2分钟内;2)设计“历史流量+实时舆情”的动态容量预测模型(用Python实现LSTM算法),预测准确率达92%,联动阿里云弹性伸缩规则,将资源扩容时间从30分钟压缩至5分钟;3)开发混沌演练平台,覆盖“网络延迟、节点宕机、数据库主从切换”8类高频故障场景,推动制定《大促故障处置SOP》,并将跨团队演练频率从季度改为月度,协同效率提升40%。
  • 项目成果:大促期间SLA稳定在99.95%以上,故障响应时间从15分钟降至2分钟,年度因故障导致的订单损失减少约800万元;资源弹性成本降低18%(年节省云费用120万)。本人主导了全链路体系的架构设计与落地,推动跨部门建立了标准化的故障处置流程,成为公司大促保障的核心技术负责人。
2020.05 - 2022.06
星途互动科技有限公司
高级运维开发工程师

容器化微服务治理平台自主研发项目

  • 项目背景:公司微服务数量从20个增长至50+,依赖第三方容器平台(如某云ACK)不仅年费用超300万,且缺乏针对业务的流量治理、资源调度能力(如活动服务需优先分配资源)。目标是自主研发轻量化容器治理平台,支撑微服务高可用与成本优化。
  • 关键难题:1)第三方平台无法实现“按业务优先级”的资源抢占,活动高峰期常因资源竞争导致核心服务延迟;2)微服务间流量调度单一,无法支持灰度发布时的按用户分层放量;3)平台扩展性差,新增微服务需手动配置监控与熔断规则。
  • 核心行动:1)基于Kubernetes Operator模式开发“业务优先级调度模块”,通过自定义ResourceQuota与PriorityClass,实现活动服务在大促时自动抢占非核心服务资源,资源利用率从45%提升至65%;2)集成Istio服务网格,设计“用户标签+权重”的灰度发布策略,支持按新用户/老用户、地域分层放量,将灰度故障影响范围缩小至5%以内;3)构建自动化规则引擎,通过Prometheus采集的指标(如QPS、延迟)自动生成熔断与降级策略,无需人工干预,微服务故障次数减少50%。
  • 项目成果:平台上线后替代了第三方容器平台的核心功能,年节省费用300万;微服务平均延迟从80ms降至50ms,故障恢复时间从30分钟缩短至5分钟;平台可用性达99.99%,支持公司微服务数量扩张至80+。本人主导了平台的核心模块研发与架构设计,解决了微服务治理的关键痛点,推动公司技术栈从“依赖第三方”转向“自主可控”。
教育背景
2013.09 - 2016.06
XX美术附属中学
艺术特长班
通过每日速写训练(累计500+小时),夯实视觉表达基本功;作品《城市记忆》系列入选省级青年艺术展,验证用户情感共鸣设计能力,被XX美术馆收藏。
2016.09 - 2020.06
XX艺术学院
视觉传达设计(本科)
主攻品牌视觉系统课程(专业排名前10%),建立商业设计与用户行为关联模型;为XX茶饮品牌设计的“国风年轻化”视觉方案,助力客户线下店开业首月业绩提升35%,方案入选《中国新锐设计年鉴》。Adobe创意设计大赛全国一等奖。
奖项荣誉
  • 阿里云ACP云计算工程师认证
  • AWS Certified SysOps Administrator - Associate
  • 2023年度公司技术攻坚奖
自我评价
  • 以业务链路为核心构建云运维体系,从用户端到基础设施全链路预判风险,而非被动救火,保障核心服务99.99%可用。
  • 擅长从资源效能、架构冗余切入降本,曾重构实例规格与调度策略,助力云成本下降20%,支撑业务高速扩张。
  • 适配互联网敏捷需求,搭建自动化故障排查与回滚流程,将关键故障MTTR压至15分钟内,匹配研发迭代节奏。
  • 习惯用业务语言翻译运维要求,比如将“数据库QPS上限”转为“大促订单提交成功率保障”,推动跨团队目标对齐。
智能诊断
编写灵感
请选择需要查找的灵感类型
请选择灵感源泉
选择合适的内容插入后即可编辑调整
请在上方选择您需要获取的灵感类型
对话框
提示
说明