当前模板已根据「数据中心运维工程师」岗位深度优化
选择其他岗位
开始编辑模板后,您可以进一步自定义包括:工作履历、工作内容、信息模块、颜色配置等
内置经深度优化的履历,将为你撰写个人简历带来更多灵感。
陆明哲
昨天的经验是今天的基石,而今天的突破将成为明天的标准。
28岁
3年工作经验
13800138000
DB@zjengine.com
陆明哲的照片
求职意向
数据中心运维工程师
武汉
薪资面谈
一个月内到岗
工作经历
2022.07 - 2025.06
小楷云智科技有限公司
数据中心运维工程师

负责公司数据中心增值业务承载系统(企业短信、视频短信、IoT连接管理平台)的7×24小时稳定运维,涵盖服务器集群、全闪存储阵列及SDN网络的监控、故障根因分析(RCA)与性能调优;主导增值业务端到端链路保障,联动研发解决业务层与基础设施的耦合问题;推动Python/Ansible自动化工具落地,降低人工干预率;基于时间序列预测模型优化资源分配,支撑业务峰值场景的弹性供给。

  • 针对企业短信平台大促期间发送量激增(峰值达12万条/秒)导致的延迟超标问题,基于Prometheus+Grafana构建分层监控体系——新增短信队列长度、网关转发延迟等定制指标,联动SDN控制器动态调整流量路径至备用链路;同步优化Zabbix告警规则(将阈值从“队列积压>1万条”前置到“>3千条”),配合自动化脚本来回滚异常配置,最终将SLA从99.9%提升至99.99%,单次大促故障时长从2.5小时压缩至30分钟内,支撑业务峰值收入增长40%。
  • 主导开发“服务器CPU过载自愈系统”——用Python调用Ansible Tower API,结合历史负载数据训练逻辑回归模型识别异常进程,当CPU利用率连续5分钟>85%时,自动触发“降频非核心进程+弹性扩缩容”动作;覆盖了82%的常见CPU故障场景,将MTTR(平均故障恢复时间)从30分钟降至2分钟内,年节省人工排查成本约18万元。
  • 为支撑IoT连接管理平台季度30%的业务增长,用Python编写“存储资源预测模型”——基于过去12个月的IOPS、吞吐量及业务用户数数据,用ARIMA算法预测未来季度的全闪存储需求;优化采购策略后,服务器与存储的冗余率从25%降至10%,直接节省硬件成本120万元,同时确保业务峰值时存储延迟仍低于1ms。
  • 协同增值业务研发团队解决视频短信卡顿问题:用Wireshark抓包分析发现CDN节点与数据中心间的TCP重传率达15%(行业阈值<5%),定位为QoS策略未优先标记视频流;调整数据中心交换机的DSCP值为EF(Expedited Forwarding),并将TCP窗口大小从16MB扩容至32MB,最终卡顿率降至0.1%以下,用户投诉量减少72%。
2020.03 - 2022.06
小楷通信技术有限公司
数据中心运维工程师

负责数据中心基础架构(X86服务器、EMC存储、Cisco网络设备)的日常运维,支撑语音验证码、企业彩印等核心增值业务的稳定运行;参与灾备方案设计与演练,保障业务连续性;优化监控覆盖度,提升故障预警能力;协助处理重大故障,缩短恢复时间。

  • 主导灾备体系从“冷备”向“热备”转型:用VMware SRM搭建跨机房的虚拟机复制环境,制定“分钟级切换”演练流程(每月1次全链路测试),将RTO(恢复时间目标)从4小时缩短至30分钟内,助力公司通过ISO 22301业务连续性管理体系认证,成为某头部金融客户的核心供应商。
  • 重构监控体系解决存储故障漏报问题:针对原有Zabbix模板仅监控存储利用率的缺陷,自定义IOPS波动、RAID卡缓存命中率等12项关键指标,结合ELK栈分析存储设备日志;提前3次预警“存储介质坏道”隐患,避免了2次可能导致业务中断的故障,年减少业务损失约50万元。
  • 处理企业彩印系统宕机故障:夜间系统突然不可用,经Percona Toolkit分析慢查询日志,定位到数据库服务器存在内存泄漏(由第三方插件未释放缓存导致);协同研发修复插件逻辑,同时新增“内存使用率+泄漏速率”双维度监控,将MTTR从2小时压缩至40分钟,后续同类故障发生率下降90%。
  • 优化虚拟机资源利用率:用VMware vRealize Operations分析300+台虚拟机的CPU/内存利用率,整合闲置VM(原利用率<20%),将服务器平均利用率从30%提升至50%,年节省机房电力成本约35万元,同时腾出15%的机架空间支撑新业务部署。
2018.07 - 2020.02
小楷信息科技有限公司
系统运维工程师(数据中心方向)

负责数据中心服务器、网络设备的日常维护,支撑企业邮箱、呼叫中心等初期增值业务运行;执行硬件巡检与固件升级,保障基础设施可靠性;协助搭建基础监控系统,提升运维效率。

  • 搭建公司首个自动化监控系统:用Nagios+NCurses组合实现服务器CPU、内存、磁盘的实时监控,替代原有人工巡检模式;设置分级告警(邮件→短信→电话),将故障发现时间从2小时缩短至5分钟内,支撑业务从试运营到正式上线的平稳过渡。
  • 处理存储服务器RAID卡故障:某台EMC存储服务器因RAID卡电池失效导致数据读取延迟高,用厂商提供的Navisphere Manager诊断工具定位问题,30分钟内完成RAID卡更换并恢复数据,未影响企业邮箱用户的收发信功能;后续推动“RAID卡健康度月度检查”纳入运维流程,年减少存储故障10余起。
  • 完成核心设备固件升级:针对数据中心Cisco交换机频繁出现的丢包问题(丢包率1%→影响视频会议质量),下载最新IOS-XE固件,采用“滚动升级”方式替换旧版本;升级后丢包率降至0.01%以下,网络可用性从99.9%提升至99.99%,支撑呼叫中心的语音通话质量提升。
  • 编写运维知识库:整理《数据中心硬件常见故障处理手册》《服务器固件升级操作指南》等文档,覆盖80%的日常运维场景;新员工培训周期从2周缩短至5天,团队整体故障处理效率提升40%。
项目经验
2022.03 - 2023.08
星途通信技术有限公司
电信网络运维高级工程师

5G+VR直播增值业务专属网络切片可靠性提升项目

  • 项目背景:公司为文旅行业提供的“5G+VR全景直播”增值服务是年度战略产品,但上线初期专属网络切片频繁出现时延抖动(峰值达200ms)、丢包率超1.5%的问题,导致用户体验差、客户投诉率达12%,核心目标是3个月内将切片端到端可靠性提升至99.99%,支撑全国10个重点景区的商用落地。我作为项目运维负责人,主导切片全生命周期运维体系搭建与故障根因闭环。
  • 关键难题:1)多域协同故障定位难——切片涉及接入网(gNodeB)、传输网(OTN)、核心网(UPF)跨域链路,传统分散监控工具无法关联告警;2)流量突发拥塞——VR直播峰值流量达10Gbps,切片静态带宽配置常出现拥塞;3)缺乏业务级SLA感知——现有运维仅关注网络指标,未关联VR业务卡顿、花屏等用户体验参数。
  • 核心行动:1)端到端拓扑穿透:梳理切片从用户设备到UPF的12个关键节点,打通SDN控制器、NSMF(切片管理器)与Prometheus监控数据,自研“跨域告警关联算法”,将原来45分钟的故障定位时间压缩至8分钟;2)动态带宽调优:结合LSTM模型预测VR流量峰值(准确率达92%),提前15分钟触发切片带宽弹性扩容(支持5-15Gbps动态调整);3)业务SLA映射:将网络时延、丢包率与VR业务卡顿率建立线性模型(R²=0.95),把业务级指标纳入运维监控阈值。
  • 项目成果:1)切片可靠性提升至99.995%(超目标50bps),VR直播卡顿率从8%降至1.2%,客户投诉率下降至1.5%;2)搭建的“5G切片业务级运维体系”覆盖公司12个地市的VR/AR增值业务,成为集团5GtoB运维标准;3)个人主导输出3份切片运维SOP、1套AI流量预测工具,获公司“年度技术创新奖”。
2020.05 - 2021.12
星途通信技术有限公司
电信网络运维工程师

传统短信增值业务网关高并发扩容及智能运维转型项目

  • 项目背景:公司短信验证码、营销通知等增值业务年增速达40%,原集中式短信网关处理能力仅5000条/秒,大促/节假日经常出现拥堵(延迟超5秒),投诉率高达1.2%,目标是6个月内将网关处理能力提升至2万条/秒,同时降低人工运维工作量30%。我从运维执行岗切入,负责架构优化与智能运维模块落地。
  • 关键难题:1)集中式架构瓶颈——原网关采用单节点处理,CPU利用率长期超90%,无法横向扩展;2)流量弹性不足——大促期间流量突增3-5倍,人工扩容耗时2小时以上;3)故障排查低效——依赖人工查看日志,平均故障定位时间达30分钟。
  • 核心行动:1)分布式架构改造:将原集中式网关拆分为10个分布式节点,基于Kafka消息队列做流量分片(每个节点处理2000条/秒),结合Docker容器化部署实现节点快速上线;2)弹性扩缩容方案:引入K8s编排,设置流量阈值(如CPU>70%)自动触发节点扩容,大促期间可10分钟内完成节点新增;3)智能故障预警:搭建ELK日志平台,自定义规则引擎(包含“发送失败率超5%”“队列积压超10万条”等12条规则),实现故障自动预警与根因推送。
  • 项目成果:1)网关处理能力提升至2.5万条/秒(超目标25%),大促期间短信延迟降至1秒以内,投诉率下降至0.3%;2)人工运维工作量减少40%,原本需要3人轮值的夜班优化为1人;3)输出的《短信网关智能运维方案》被集团推广至5个省份,个人从“故障响应者”转型为“方案设计者”,次年获晋升机会。
技能特长
沟通能力
执行能力
热情坦诚
文案能力
奖项荣誉
  • 数据中心基础设施运维工程师职业技能等级证书(高级)
  • 2022年度公司数据中心运维项目攻坚奖
  • 2023年度部门优秀技术员工
自我评价
  • 深耕电子/通信行业数据中心运维,熟稔通信设备与IT基建协同逻辑,具备全生命周期运维统筹能力。
  • 擅长用故障树分析法挖根源,推动建预防机制,降重复故障率。
  • 主动聚焦资源利用率与能耗优化,通过动态调度支撑业务扩容适配。
  • 习惯以技术语言衔接跨团队诉求,前置识别风险保服务连续性。
报考信息
填写报考学校
填写报考专业
科目1
分数1
科目2
分数2
科目3
分数3
科目4
分数4
试一下,换个颜色
选择配色
使用此模板创建简历
  • 支持电脑端、微信小程序编辑简历
  • 支持一键更换模板,自由调整字距行距
  • 支持微信分享简历给好友查看
  • 支持简历封面、自荐信、自定义简历模块
  • 支持导出为PDF、图片、在线打印、云端保存
该简历模板已内置
  • 个人名称
  • 头像
  • 基本信息
  • 求职意向
  • 工作经历
  • 项目经验
  • 实习经验
  • 作品展示
  • 奖项荣誉
  • 校园经历
  • 教育背景
  • 兴趣爱好
  • 技能特长
  • 语言能力
  • 自我评价
  • 报考信息
  • 简历封面
  • 自荐信
对话框
提示
说明