当前模板已根据「DevOps工程师」岗位深度优化
选择其他岗位
开始编辑模板后,您可以进一步自定义包括:工作履历、工作内容、信息模块、颜色配置等
内置经深度优化的履历,将为你撰写个人简历带来更多灵感。
个人简历 RESUME
陆明哲
责任心不是口号,而是渗透在每个工作细节中的行动准则。
28岁
3年工作经验
13800138000
DB@zjengine.com
陆明哲的照片
求职意向
DevOps工程师
宁波
薪资面谈
一个月内到岗
工作经历
2023.07 - 2025.06
小楷电商科技有限公司
高级DevOps工程师

负责电商平台研发全生命周期的DevOps体系建设,覆盖需求交付、部署发布、监控运维全链路,主导自动化工具链研发与流程优化,保障业务系统高可用与成本可控。

  • 主导电商大促核心交易链路CI/CD流水线重构,基于Argo CD实现GitOps声明式部署,结合Jenkins X动态Agent池与缓存分层策略(Maven私服+Nexus制品库),将单次全量部署耗时从45分钟压缩至12分钟,故障回滚成功率从82%提升至98%;针对大促期间流量突增场景,设计流量染色+金丝雀发布方案,通过Istio服务网格实现版本间流量精准切分,保障活动期间交易成功率稳定在99.99%以上。
  • 推动容器化深度落地,基于K8s进行资源调度优化:通过分析Prometheus采集的CPU/Memory利用率数据,调整HPA(Horizontal Pod Autoscaler)缩放阈值并结合VPA(Vertical Pod Autoscaler)自动修正请求资源,将集群整体资源利用率从35%提升至62%,年节省云服务器成本约120万元;同步解决老服务容器化适配问题,开发Python脚本自动注入sidecar容器并转换传统iptables网络规则,完成20+微服务的平滑迁移。
  • 设计全链路监控告警体系,整合OpenTelemetry自动埋点、ELK日志分析及Grafana可视化看板,定义核心SLO(Service Level Objective)指标(如P99接口响应时间<500ms、错误率<0.1%),通过Alertmanager定制分级告警规则(P1级故障5分钟内触达负责人);上线后故障定位时间从平均45分钟缩短至8分钟,Q3季度P1级故障数量同比下降60%。
  • 主导DevOps文化渗透,推动开发团队采用IaC(Infrastructure as Code)实践:基于Terraform管理阿里云ECS/RDS资源,结合Terragrunt实现多环境配置复用,基础设施变更失败率从15%降至3%;引入Chaos Mesh开展混沌实验,模拟节点宕机、网络延迟等故障场景,推动关键服务平均恢复时间(MTTR)从25分钟缩短至7分钟。
2021.08 - 2023.06
小楷科技有限公司
DevOps工程师

负责公司级DevOps工具链搭建与流程规范制定,支撑多业务线研发交付效率提升,重点优化测试环境管理与自动化运维能力。

  • 从零搭建公司级CI/CD平台,基于GitLab CI与Ansible实现代码提交→单元测试→打包→预发布→生产的全自动化流程,支持Java/Python/Go多语言项目;通过动态分配GitLab Runner(K8s集群模式)解决资源竞争问题,日均处理构建任务500+,发布成功率从78%提升至92%,研发反馈“部署耗时感知”下降40%。
  • 优化测试环境管理痛点,设计Docker Compose+K8s Namespace的混合环境方案:开发阶段使用Docker Compose实现本地环境秒级启动,测试阶段通过K8s Namespace隔离多团队并行测试需求;同步开发环境自服务平台,支持测试人员自助申请/销毁环境,将环境准备时间从2小时缩短至15分钟,支撑产品迭代频率从每周1次提升至每日3次。
  • 构建自动化运维脚本库,用Python开发CMDB自动发现工具(集成SSH协议与SNMPv3),自动采集服务器、网络设备的基础信息并关联业务标签,CMDB数据准确率从85%提升至99%;结合Zabbix API实现监控项动态注册,当新服务上线时自动配置CPU/内存/磁盘告警规则,故障预警覆盖率从65%提升至90%。
2019.07 - 2021.07
小楷互联科技有限公司
运维开发工程师(初级)

负责电商平台后台系统的日常部署、监控维护及基础工具开发,支撑业务稳定运行并向自动化方向转型。

  • 优化日志收集流程,基于Filebeat+Kafka+Elasticsearch搭建实时日志管道,通过自定义Logstash过滤器清洗冗余字段(如去除重复请求ID),日志检索响应时间从30秒缩短至5秒;大促期间支撑技术团队快速定位支付接口超时问题,缩短故障处理时长20分钟。
  • 参与K8s集群初期搭建与维护,学习Calico网络插件配置与ETCD备份策略(每日全量备份+每小时增量备份至OSS);实现集群节点自动扩容(基于AWS Auto Scaling Group触发条件:CPU使用率>70%持续5分钟),保障双11期间系统承载量提升3倍无宕机。
  • 协助开发团队解决部署阻塞问题,推动引入Nginx Ingress Controller替代传统F5负载均衡,配置HTTPS证书自动续签(Cert-Manager集成Let’s Encrypt),实现证书管理自动化率100%;同时优化Ingress规则路由策略,使静态资源请求转发延迟降低20%。
项目经验
2022.05 - 2023.10
星途互动科技有限公司
运维开发工程师

社交业务分布式链路运维平台研发及规模化落地

  • 项目背景:公司社交产品MAU突破1亿后,业务链路涉及Java、Go、Python多语言服务,原链路追踪系统(Zipkin/Jaeger)数据分散、格式异构,故障定位需跨系统关联查询,平均耗时超40分钟,严重影响用户体验优化效率。我的核心目标是主导构建统一分布式链路运维平台,实现全链路数据整合、可视化与快速故障根因定位。
  • 关键难题:一是多源链路数据标准化融合,不同语言SDK采集的trace字段不一致;二是实时分析性能瓶颈,大促期间链路查询QPS峰值达5万次/秒,原有Elasticsearch集群延迟超2分钟;三是平台扩展性不足,需支持后续接入监控、日志等数据域。
  • 核心行动:1. 推动OpenTelemetry成为统一采集标准,主导改造12个核心服务SDK,定义跨语言trace schema实现数据归一化;2. 采用Flink做实时流计算,将trace按服务/接口聚合后写入ClickHouse,优化Bloom Filter二级索引,把查询延迟从120秒降至8秒内;3. 设计“数据域插件”架构,通过配置快速接入新运维数据源(如后续集成APM指标)。
  • 项目成果:平台覆盖85%核心服务,故障定位时间缩短至7分钟内,大促查询成功率从92%升至99.8%;推动运维从“被动排查”转“主动预警”,全年链路问题投诉下降62%。我的贡献是主导架构设计与核心模块开发,牵头完成10+服务SDK改造,解决多源数据融合关键问题。
2020.08 - 2022.03
星途互动科技有限公司
运维开发工程师

高并发活动系统自动化运维体系搭建

  • 项目背景:公司每年6次大型营销活动(周年庆/双11)的活动系统为微服务架构,依赖10+组件,原人工部署需4小时/次,常因依赖遗漏或配置错误失败,资源利用率仅40%。我的目标是搭建自动化体系,实现活动系统快速、稳定部署与资源动态调整。
  • 关键难题:一是微服务依赖复杂,人工梳理易出错;二是流量预估不准,大促需手动扩容,常资源浪费或性能瓶颈;三是缺乏统一回滚机制,部署失败恢复时间长。
  • 核心行动:1. 用Ansible写服务依赖拓扑剧本,结合Jenkins搭CI/CD流水线,实现代码提交→测试→部署全自动化,部署时间缩至35分钟;2. 用Prometheus采流量metrics,训练Prophet模型预测流量,联动K8s HPA自动调副本,资源利用率升至68%;3. 设计“灰度发布+自动回滚”策略,错误率超5%时1分钟内回滚。
  • 项目成果:支撑12次大型活动,部署失败率从15%降至0.8%,资源成本降32%;大促系统可用性保持99.95%以上,零运维操作导致的故障。我的贡献是主导流水线设计落地,实现流量预测模型工程化,优化回滚策略。
技能特长
沟通能力
执行能力
热情坦诚
文案能力
兴趣爱好
摄影
看书
阅读
跑步
试一下,换个颜色
选择配色
使用此模板创建简历
  • 支持电脑端、微信小程序编辑简历
  • 支持一键更换模板,自由调整字距行距
  • 支持微信分享简历给好友查看
  • 支持简历封面、自荐信、自定义简历模块
  • 支持导出为PDF、图片、在线打印、云端保存
该简历模板已内置
  • 个人名称
  • 头像
  • 基本信息
  • 求职意向
  • 工作经历
  • 项目经验
  • 实习经验
  • 作品展示
  • 奖项荣誉
  • 校园经历
  • 教育背景
  • 兴趣爱好
  • 技能特长
  • 语言能力
  • 自我评价
  • 报考信息
  • 简历封面
  • 自荐信
对话框
提示
说明