点击保存简历
模块
风格
模板
导入
  • 个人名称
  • 头像
  • 基本信息
  • 求职意向
  • 工作经历
  • 项目经验
  • 实习经验
  • 作品展示
  • 奖项荣誉
  • 校园经历
  • 教育背景
  • 兴趣爱好
  • 技能特长
  • 语言能力
  • 自我评价
  • 报考信息
  • 简历封面
  • 自荐信
个人简历 RESUME
陆明哲
在平凡的岗位上创造不平凡的价值,这是我的职业信仰。
28岁
3年工作经验
13800138000
DB@zjengine.com
陆明哲的照片
求职意向
DevOps工程师
宁波
薪资面谈
随时到岗
工作经历
2022.07 - 2024.06
小楷智课
DevOps工程师

负责公司直播+AI互动课堂系统的端到端DevOps体系建设,覆盖代码提交至生产部署全流程自动化,支撑日均10万+并发直播课的稳定迭代,推动研发、测试、产品跨团队DevOps文化落地

  • 主导设计基于GitLab CI/CD + Argo CD的双流水线体系,针对直播推流服务高可用要求拆分“功能验证-性能压测-灰度发布”三阶段,集成Prometheus+Grafana实现部署实时监控,将单次生产部署时间从45分钟缩至12分钟,季度故障次数下降60%
  • 核心参与AI互动课堂微服务容器化迁移,选用K8s进行资源编排,通过kube-state-metrics定位java服务堆外内存溢出问题,优化JVM参数并引入Sidecar容器监控GC状态,迁移后服务可用性从99.5%提至99.95%,资源利用率提升35%
  • 重点优化跨团队CI/CD协作流程,推动研发接入SonarQube代码质量门禁(强制“圈复杂度≤15”“单元测试覆盖率≥80%”),同时打通测试环境Argo Rollouts渐进式发布能力,让测试团队实时验证灰度版本用户反馈,需求交付周期缩短25%
  • 搭建基于ELK Stack的日志分析平台,针对直播课卡顿痛点设计“用户ID+直播间ID+时间戳”关联索引,结合Fluentd采集多服务日志,将问题定位时间从2小时缩至15分钟,支撑客服团队月均卡顿投诉量下降40%
2020.08 - 2022.06
小楷在线
DevOps工程师

负责公司K12在线题库系统DevOps基础建设,搭建自动化部署与监控体系,支撑系统从单体架构向微服务转型,保障百万级用户日常使用稳定性

  • 独立搭建Jenkins CI/CD流水线,实现Java单体应用编译、单元测试、Docker镜像构建、阿里云ECS部署全自动化,将每日批量部署时间从2小时压至30分钟,减少运维人力投入40%
  • 推动引入Zabbix作为基础设施监控工具,针对MySQL主从数据库慢查询配置日志采集与告警规则,定位索引缺失问题并优化,数据库QPS从1200提至2500,系统响应时间下降30%
  • 设计实施基于Nginx加权轮询的灰度发布方案,将新版本流量从5%逐步提升至100%,配合日志验证功能正确性,将版本回滚率从15%降至3%
  • 编写《DevOps操作手册》并推动团队培训,覆盖Jenkins维护、Zabbix告警处理、Docker镜像管理等,将新运维人员上手时间从1周缩至2天
2018.07 - 2020.07
小楷科技
运维工程师

负责公司官网及内部OA系统运维,逐步引入自动化工具减少重复劳动,探索DevOps实践支撑业务增长

  • 自学Python编写服务器巡检脚本,将每周人工巡检CPU、内存、磁盘改为每日自动运行并生成HTML报告,将故障预警时间提前50%,减少非计划停机30%
  • 推动官网从静态页面迁移至WordPress动态网站,搭建LAMP环境并配置Nginx反向代理实现动静分离,将首页加载时间从3.5秒缩至1.8秒
  • 参与内部OA系统Docker化尝试,将PHP应用打包为Docker镜像实现快速部署与扩容,支撑员工从500人增长至1200人的并发访问,未增加服务器数量
  • 协助研发搭建Git仓库并制定权限规则,推动代码提交规范落地,减少合并冲突次数,提升研发协作效率
项目经验
2022.03 - 2023.10
星途互娱(专注互联网文娱领域,旗下拥有3款月活超千万的手游产品)
运维开发工程师(全链路可观测方向)

星途互娱核心游戏业务全链路可观测体系从0到1落地项目

  • 项目背景:公司核心手游《星途纪元》用户量突破5000万后,故障排查平均耗时达45分钟,跨后端、网关、前端团队协作依赖口头传递日志,效率极低;同时业务侧无法快速关联“用户掉线”与“服务器CPU飙升”的因果关系。我的总体职责是主导平台架构设计、OpenTelemetry数据标准制定,以及推动业务团队接入与落地推广。
  • 关键难题:1)多源观测数据(Prometheus Metrics、ELK Logs、Jaeger Traces)格式不兼容,实时查询延迟高达12秒;2)业务自定义指标(如“角色副本加载时长”)需手动配置Schema,接入周期平均3天;3)故障定位需在3个工具间跳转,缺乏业务上下文关联。
  • 核心行动:1)牵头制定《星途互娱OpenTelemetry全链路埋点规范》,明确“服务-接口-业务事件”三级标签体系,推动12个业务团队完成40+微服务接入;2)基于ClickHouse设计“时序+日志+追踪”融合存储方案,通过“业务线ID+时间戳”双分区+ Bloom Filter索引,将查询延迟降至1.5秒内;3)开发Grafana定制插件,将业务标签(如游戏区服、角色ID)与观测数据关联,实现“用户投诉-链路追踪-服务器指标”的一键跳转。
  • 项目成果:故障排查时间从45分钟降至8分钟内,跨团队协作成本降低60%;支持《星途纪元》《星途战纪》等3款核心手游的日常运维,自定义指标接入效率提升70%(从3天缩至4小时);平台成为公司级可观测标准,支撑暑期档活动0重大故障,用户7日留存率较去年同期提升2%,间接带来1500万流水增量。
2020.06 - 2022.02
星途互娱
中级运维开发工程师(云原生自动化方向)

星途互娱混合云K8s运维自动化平台迭代升级项目

  • 项目背景:公司完成阿里云+私有云OpenStack混合云迁移后,原有运维依赖Shell脚本与人工操作,容器扩容需2小时,配置漂移率达18%。我的职责是负责平台容器化管理模块开发、CI/CD流水线集成,以及混合云资源调度优化。
  • 关键难题:1)混合云环境下,阿里云ECS与OpenStack虚拟机的资源调度策略不统一,导致部分节点利用率不足30%;2)K8s健康检查仅依赖进程存活,无法感知应用业务异常(如接口响应超时);3)原有GitOps流程缺乏权限校验,偶发误操作导致服务不可用。
  • 核心行动:1)开发混合云资源调度器,基于“资源利用率+成本模型”动态分配负载,将节点平均利用率提升至65%;2)定制K8s Operator,整合应用业务指标(如接口QPS、队列长度)作为健康检查标准,误报率从25%降至3%;3)基于Argo CD重构CI/CD流程,实现“配置变更-权限校验-灰度发布-回滚”的自动化闭环,权限违规操作次数降为0。
  • 项目成果:运维自动化率从55%提升至88%,容器扩容时间从2小时缩短至15分钟;支撑公司《星途纪元》新版本上线(峰值QPS达10万),未出现因运维操作失误导致的故障;年运维成本降低35%(约800万元),平台被纳入公司云原生技术中台,推广至全公司5个业务线。
技能特长
沟通能力
执行能力
热情坦诚
文案能力
兴趣爱好
摄影
看书
阅读
跑步
智能诊断
编写灵感
请选择需要查找的灵感类型
请选择灵感源泉
选择合适的内容插入后即可编辑调整
请在上方选择您需要获取的灵感类型
对话框
提示
说明