点击保存简历
模块
风格
模板
导入
  • 个人名称
  • 头像
  • 基本信息
  • 求职意向
  • 工作经历
  • 项目经验
  • 实习经验
  • 作品展示
  • 奖项荣誉
  • 校园经历
  • 教育背景
  • 兴趣爱好
  • 技能特长
  • 语言能力
  • 自我评价
  • 报考信息
  • 简历封面
  • 自荐信
陆明哲的照片
28岁
3年工作经验
13800138000
DB@zjengine.com
求职意向
云平台运维工程师
北京
薪资面谈
到岗时间另议
技能特长
沟通能力
执行能力
热情坦诚
文案能力
兴趣爱好
摄影
看书
阅读
跑步
陆明哲
昨天的经验是今天的基石,而今天的突破将成为明天的标准。
工作经历
2021.12 - 2023.07
小楷闪购科技有限公司
云原生可观测性工程师
  • 主导构建了公司新一代“基于eBPF的可观测性平台”,通过eBPF技术无侵入地采集应用网络流量、系统调用等指标,实现了代码零修改的全链路网络性能分析,精准定位了多个微服务间的网络性能瓶颈,将平均网络延迟优化了15%。
  • 利用eBPF开发了“持续性能剖析”工具,以极低的开销(<1%)持续采集生产环境应用的CPU、内存火焰图,帮助开发团队发现并优化了多个深层次的代码性能问题,使核心服务P99延迟降低20%。
  • 通过设计“智能根因分析”算法,能自动关联metrics, logs, traces和eBPF网络数据,在发生故障时快速定位问题是出在应用代码、网络、中间件还是资源层面,将平均故障定位时间(MTTR)缩短了60%。
  • 将该平台以“可观测性即代码”的方式提供给所有开发团队,通过简单的注解即可开启深度监控,极大地降低了使用门槛,提升了整个研发体系的可观测性水平。
2020.03 - 2021.11
小楷闪购科技有限公司
运维开发工程师
  • 维护和优化基于Prometheus的监控告警体系,处理了海量指标带来的存储和查询性能挑战,保障了系统的稳定性。
  • 深入学习了eBPF技术,并尝试编写了一些简单的工具用于网络抓包和性能分析,为后续的重大项目做好了技术储备。
  • 积极参与on-call轮值,处理线上故障,培养了敏锐的风险意识和应急处理能力。
项目经验
2022.05 - 2023.10
星途互娱
运维开发负责人

文娱业务低延迟高可用运维平台研发及规模化落地

  • 项目背景:公司文娱业务(直播、长视频、会员系统)用户量年增长40%,现有运维体系存在工具碎片化(分散的监控、配置、自动化工具)、故障排查耗时(平均45分钟/次)、资源成本超支(年度服务器成本占比营收18%)等痛点。核心目标是构建统一运维平台,实现“高可用保障、低延迟监控、自动化运维”,支撑业务快速迭代。我作为运维开发负责人,主导平台整体设计、跨团队需求对齐及落地推进。
  • 关键难题与技术方案:a) 多环境配置一致性难——传统手动配置易出错;b) 直播流低延迟监控缺失——传统Prometheus 60秒采集间隔无法满足端到端≤500ms延迟的实时追踪;c) 故障自愈覆盖不足——高频问题(如Pod重启、数据库连接池耗尽)仍需人工干预。针对性方案:采用Terraform+Ansible组合实现配置代码化;自研直播流延迟Exporter,整合CDN日志、应用埋点及网络探针数据,将采集间隔缩短至10秒;基于Python开发20+高频故障自愈剧本,联动告警系统自动修复。
  • 核心行动与创新:牵头组织研发、产品、运营3轮痛点调研,输出《运维痛点清单》及需求文档;设计“配置管理-监控告警-自动化运维-成本分析”微服务架构(Spring Cloud);带领5人团队完成Exporter开发、Terraform模板编写及自愈剧本调试;推动预发环境1个月灰度验证,再逐步推广至生产核心业务。
  • 项目成果与价值:平台上线6个月覆盖80%核心业务,故障排查时间降至8分钟内,自动化率从35%提升至75%;年度服务器成本降低22%(约节省1200万元),支撑“暑期直播季”零重大故障,用户观看延迟降低15%。我个人主导的平台架构获公司“年度技术创新奖”,成为新业务运维标准底座。
2020.08 - 2022.03
星途互娱
运维开发核心成员

短视频核心服务容器化迁移与弹性伸缩体系搭建

  • 项目背景:公司短视频业务爆发(月活从1亿增至3亿),传统虚拟机部署存在资源利用率低(30%)、扩容慢(15分钟/次)、交付周期长(每周2个服务)等问题。核心目标是将feed流、视频上传等核心服务迁移至Kubernetes,构建弹性伸缩体系。我作为运维开发核心成员,负责容器化适配、弹性策略设计及迁移落地。
  • 关键难题与技术方案:a) 老服务(Spring Boot 1.x)依赖本地文件系统及固定IP,迁移后服务发现失败、日志丢失;b) 流量波动大(热点事件QPS暴涨5倍),传统CPU指标HPA无法满足快速扩容;c) 迁移需保障业务连续性。解决方案:用Helm打包服务,定制化NFS解决文件依赖,通过Istio实现服务发现;构建多维度弹性指标(QPS+延迟+错误率+CPU),自定义HPA策略将扩容阈值从“CPU≥70%”调整为“QPS≥1万且延迟≥2秒”;制定“灰度迁移+回滚预案”,开发迁移状态监控面板。
  • 核心行动与创新:对12个核心服务做容器化评估,输出《迁移可行性报告》及“先易后难”路线图;开发自动化工具将虚拟机配置转为K8s YAML,减少人工错误;压测验证伸缩效果,调整指标权重;推动研发优化代码(增加缓存、减少DB连接)提升容器性能。
  • 项目成果与价值:3个月完成12个服务迁移,资源利用率从30%升至65%,扩容时间降至2分钟内;支撑峰值QPS从5万提至20万,无扩容故障;运维人力成本降低40%(原3人部署现1人自动化完成)。该弹性体系成为公司K8s集群标准配置,后续新服务默认采用。
教育背景
2013.09 - 2016.06
XX外国语学校
文科重点班(英语特长)
强化英语沟通能力(雅思7.0),建立跨文化协作基础;策划“模拟世界经济论坛”活动,主导团队完成10国经济政策分析报告,培养全球化商业视野与数据分析敏感度。
2016.09 - 2020.06
XX财经大学
金融学(本科)
聚焦公司金融与量化分析课程(GPA 3.8/4.0),掌握风险评估与资本运作模型;在XX证券实习期间,独立完成5家上市公司财报横向对比研究,提出的“现金流健康度评估指标”被部门采纳为风控补充工具。获CFA协会投资分析大赛华东区8强。
奖项荣誉
  • 信息系统运维管理工程师(高级)
  • 2023年度公司云平台项目攻坚奖
  • 2024年第一季度运维服务质量之星
自我评价
  • 深耕互联网云运维,以业务连续性为核心搭高可用体系,习惯从用户端体验反推策略,提前布局容灾弹性,避免被动救火。
  • 擅长数据驱动资源优化,从利用率到成本形成闭环,锚定业务增长平衡性能投入,让云资源支撑更多核心场景。
  • 故障处理不止恢复,更沉淀根因分析与流程改进机制,推动跨团队建故障预防共识,把单点问题转组织能力迭代。
  • 跨团队用业务语言解码技术约束,让产品开发快速理解运维边界,共定支撑业务目标的方案,降沟通成本。
智能诊断
编写灵感
请选择需要查找的灵感类型
请选择灵感源泉
选择合适的内容插入后即可编辑调整
请在上方选择您需要获取的灵感类型
对话框
提示
说明