点击保存简历
模块
风格
模板
导入
  • 个人名称
  • 头像
  • 基本信息
  • 求职意向
  • 工作经历
  • 项目经验
  • 实习经验
  • 作品展示
  • 奖项荣誉
  • 校园经历
  • 教育背景
  • 兴趣爱好
  • 技能特长
  • 语言能力
  • 自我评价
  • 报考信息
  • 简历封面
  • 自荐信
RESUME
陆明哲的照片
陆明哲
昨天的经验是今天的基石,而今天的突破将成为明天的标准。
28岁
3年工作经验
13800138000
DB@zjengine.com
求职意向
云平台运维工程师
北京
薪资面谈
随时到岗
工作经历
2022.07 - 2024.06
小楷云智科技有限公司
高级云平台运维工程师

负责公司混合云(阿里云+私有云)平台全生命周期运维,涵盖K8s集群管控、跨云资源编排、大促高可用保障及云成本优化,支撑电商业务峰值20万QPS的核心场景。

  • 主导设计混合云K8s集群架构,基于Terraform抽象跨云资源模型,开发自定义Provider解决阿里云ECS与私有云OpenStack实例参数差异问题,实现‘一套代码多云部署’;集群部署耗时从4小时压缩至45分钟,多环境配置不一致故障率下降60%。
  • 为应对双11流量洪峰,引入KubeFed实现跨AZ服务联邦调度,结合Prometheus自定义告警规则(覆盖节点负载、Pod驱逐风险等12类指标),并通过HPA+CA动态扩缩容;大促期间集群可用性达99.99%,较去年同期提升0.9个百分点,未发生因运维问题导致的业务中断。
  • 推动云成本深度优化,基于AWS Cost Explorer与阿里云账单分析,将70%的EC2实例从按需付费转为3年预留+Spot混合模式,同步落地Karpenter自动扩缩容工具;年度云成本降低35%(约280万元),同时通过优先级队列+快速重建机制将Spot实例中断导致的业务影响控制在0.1%以内。
  • 牵头搭建云原生可观测性平台,集成OpenTelemetry SDK采集指标/日志/链路数据,定制Grafana仪表盘覆盖商品详情、订单支付等90%核心链路;结合Thanos实现监控数据长期存储与聚合查询,故障定位时间从平均30分钟缩短至5分钟内,存储成本降低40%。
2020.08 - 2022.06
小楷互联科技有限公司
云运维工程师

负责公司私有云平台(基于OpenStack改造)日常运维,支撑内部OA系统、商家SaaS服务及测试环境,聚焦稳定性保障与自动化能力构建。

  • 核心参与‘OpenStack向K8s迁移’项目,制定分批次迁移策略(先非核心服务后交易类服务),使用Velero完成300+存量服务的无状态迁移,迁移后资源利用率从30%提升至60%,单服务运维人力投入减少50%;针对MySQL等有状态服务,开发Operator兼容旧存储卷挂载逻辑,确保业务零感知。
  • 构建自动化运维流水线,基于Ansible编写角色模板(含CentOS初始化、Nginx/Tomcat部署、防火墙配置),集成Jenkins实现‘代码提交-测试-上线’全流程自动化;故障恢复时间从2小时缩短至15分钟,人工操作失误率下降85%。
  • 优化监控体系,部署ELK Stack集中管理500+服务器日志,配置Logstash过滤规则提取‘支付超时’‘接口500错误’等业务关键词,结合Alertmanager设置分级告警(P0级5秒推送钉钉群);重要故障发现时效从1小时提升至2分钟内,客户投诉率下降25%。
2018.07 - 2020.07
小楷科技有限公司
系统运维工程师

负责公司物理机与VMware虚拟化平台运维,保障研发测试环境及生产系统稳定,积累基础运维与问题排查经验。

  • 主导搭建VMware vSphere虚拟化平台,规划8节点ESXi集群、vSAN分布式存储及VRRP网络策略,支撑500+虚拟机运行;通过HA(高可用)与DRS(动态资源调度)配置,年故障停机时间少于2小时,达到SLA 99.95%要求。
  • 开发Python脚本自动化创建虚拟机模板(预装CentOS+GitLab+Jenkins),并集成到自研运维平台;测试环境交付周期从3天缩短至4小时,研发团队迭代效率提升30%。
  • 建立容量管理机制,每周分析CPU/内存/存储使用趋势,结合业务上线计划预测资源需求;提前3个月完成服务器扩容,生产环境资源冗余率从40%降低至15%,年硬件采购成本节省约80万元。
兴趣爱好
摄影
看书
阅读
跑步
语言能力
  • 英语(CET-6,具备英文技术文档阅读及国外厂商沟通能力)
自我评价
  • 深耕互联网云运维,以业务连续性为核心搭高可用体系,习惯从用户端体验反推策略,提前布局容灾弹性,避免被动救火。
  • 擅长数据驱动资源优化,从利用率到成本形成闭环,锚定业务增长平衡性能投入,让云资源支撑更多核心场景。
  • 故障处理不止恢复,更沉淀根因分析与流程改进机制,推动跨团队建故障预防共识,把单点问题转组织能力迭代。
  • 跨团队用业务语言解码技术约束,让产品开发快速理解运维边界,共定支撑业务目标的方案,降沟通成本。
智能诊断
编写灵感
请选择需要查找的灵感类型
请选择灵感源泉
选择合适的内容插入后即可编辑调整
请在上方选择您需要获取的灵感类型
对话框
提示
说明