点击保存简历
模块
风格
模板
导入
  • 个人名称
  • 头像
  • 基本信息
  • 求职意向
  • 工作经历
  • 项目经验
  • 实习经验
  • 作品展示
  • 奖项荣誉
  • 校园经历
  • 教育背景
  • 兴趣爱好
  • 技能特长
  • 语言能力
  • 自我评价
  • 报考信息
  • 简历封面
  • 自荐信
陆明哲
用系统化的思维解决问题,用温度化的方式交付成果,这是我的工作准则。
28岁
3年工作经验
13800138000
DB@zjengine.com
陆明哲的照片
求职意向
数据库管理员 (DBA)
宁波
薪资面谈
到岗时间另议
工作经历
2022.07 - 至今
小楷电商科技有限公司
高级数据库管理员 (DBA)

负责公司核心交易链路MySQL集群(支撑日均1.2亿订单量)的全生命周期管理,涵盖性能瓶颈攻坚、异地多活容灾架构设计、故障根因定位及研发侧数据库规范赋能,边界是保障数据库99.99%可用性与大促期间的弹性扩展能力

  • 主导核心订单库(MySQL 8.0)大促前性能优化,面对QPS从8万飙升至15万时慢查询激增(占比12%)的问题,使用pt-query-digest分析慢日志定位到订单详情表联合索引失效及批量插入锁竞争;通过重构覆盖「订单状态+用户ID+创建时间」的复合索引,将批量插入改为分批次异步提交,慢查询率降至1.5%,大促期间数据库RT稳定在80ms内,支撑1.5倍预期订单峰值
  • 设计华东-华南双机房异地多活架构,基于MySQL Group Replication实现跨机房数据同步,结合ProxySQL做读写分离与流量路由;解决同步延迟导致的脏读问题,通过调整group_replication_member_weight参数+启用半同步复制,将延迟从500ms压至50ms内,完成3次机房故障演练,RTO从45分钟缩短至12分钟,实现业务零宕机切换
  • 推动数据库自动化运维体系建设,用Ansible整合部署/备份/监控流程,新库上线时间从4小时压缩至30分钟;引入Prometheus+Grafana搭建实时监控平台,自定义InnoDB缓冲池命中率、锁等待次数、复制延迟等指标,异常自动告警将故障定位时间从1小时缩至15分钟,全年数据库可用性达99.99%
  • 赋能研发团队规范落地,主导制定《电商业务数据库设计手册》(含索引/分库分表/SQL编写规范),通过季度培训+技术评审,将研发侧慢查询占比从30%降至8%,减少生产环境非必要压力,间接提升应用响应速度20%
2020.05 - 2022.06
小楷零售科技服务有限公司
数据库管理员 (DBA)

负责零售业务MySQL/Redis集群的日常运维,涵盖稳定性保障、性能调优及数据安全管控,边界是支撑日均3000万用户行为数据的存储与查询需求

  • 重点优化用户行为日志库(MySQL 5.7)写入性能,面对日均2000万条日志写入导致的磁盘IO瓶颈(利用率85%),调整innodb_flush_log_at_trx_commit为2(结合每日全量备份)+启用binlog压缩,写入TPS从1.2万提升至3.5万,IO利用率降至60%,同时保证RPO<5分钟的数据可靠性
  • 解决分库分表后跨库查询问题,针对16个分库的用户订单数据,用ShardingSphere构建中间件层实现跨库聚合查询与全局唯一ID生成;优化分布式执行计划,将跨库查询响应时间从2秒缩至300ms,支撑营销活动用户订单统计需求
  • 完善数据安全体系,部署Percona Audit Plugin记录所有DML/DDL操作,定期开展数据脱敏演练(对手机号/身份证号做AES加密存储),全年未发生数据泄露,通过公司信息安全合规检查
  • 主导处理一次生产宕机事故,分析错误日志发现是innodb_buffer_pool_size过小(8G)导致内存溢出,快速重启实例+扩容至32G,结合备份恢复1小时内数据,业务恢复时间25分钟;后续推动自动化参数调优脚本开发,避免同类问题复发
2018.03 - 2020.04
小楷数字技术有限公司
初级数据库管理员 (DBA)

协助资深DBA完成内部管理系统数据库运维,涵盖MySQL集群部署、备份恢复、监控告警及简单性能优化,边界是保障系统7×24小时稳定运行

  • 负责OA系统数据库(MySQL 5.6)日常运维,制定「每日全量+xtrabackup每小时增量」备份策略,全年备份成功率100%;模拟数据丢失场景验证恢复流程,确保RTO<30分钟
  • 优化审批流程表慢查询,添加「审批人ID+审批状态+创建时间」复合索引,将查询时间从5秒缩至500ms,提升员工审批效率30%
  • 搭建Nagios监控平台,监控MySQL连接数/CPU/磁盘空间,设置80%连接数阈值告警,全年及时处理3次连接数飙升问题,避免数据库宕机
  • 参与schema变更管理,审核研发SQL变更的索引合理性与事务长度,将变更导致的线上故障从每月2次降至0次,保障系统稳定性
项目经验
2022.05 - 2023.10
星途互娱(专注游戏分发与社交娱乐的互联网企业)
运维开发工程师(核心研发负责人)

游戏分发平台全链路运维自动化平台研发及规模化落地

  • 项目背景:星途互娱游戏分发平台承载亿级用户日常访问,原有运维体系依赖分散的Shell脚本与人工操作,存在部署耗时久(单次全量部署需4小时)、故障定位慢(平均30分钟/次)、容量规划靠经验等问题,严重影响业务迭代效率与用户体验。核心目标是通过全链路自动化平台实现“部署-监控-故障自愈-容量管理”闭环,支撑平台高并发与快速迭代需求。我的职责是主导平台整体架构设计、关键模块开发及跨团队落地推动。
  • 关键难题:1)平台需兼容物理机、虚拟机、K8s容器等多异构环境,原有监控数据分散在不同系统,难以统一关联分析;2)故障自愈需基于多维度数据(metrics/logs/traces)快速定位根因并执行修复,现有规则引擎缺乏业务场景适配性;3)容量规划需精准预测业务峰值(如新游上线、周末活动)带来的资源需求,传统线性预测模型误差率超30%。
  • 核心行动与创新:1)设计“统一数据层+场景化引擎”架构:整合Prometheus(监控)、ELK(日志)、Jaeger(链路追踪)数据至ClickHouse,构建全链路数据湖;针对游戏业务周期性特点,基于XGBoost模型融合历史流量、活动排期、用户行为数据,开发动态容量预测模块,将误差率降至8%以内;2)故障自愈引擎引入“规则+机器学习”双决策模式:通过规则引擎处理常见故障(如Pod重启、磁盘满),用LSTM模型识别异常流量模式(如DDoS前兆),自动触发对应修复动作(如扩容、流量切换);3)主导开发部署流水线模块,支持蓝绿部署、灰度发布等策略,集成健康检查与回滚机制,确保发布安全。
  • 项目成果:平台上线后,全量部署时间从4小时缩短至15分钟,故障定位时间降至5分钟内,容量利用率提升20%;支撑平台完成12次大型版本迭代与6次峰值流量考验(最高QPS达800万),未发生因运维问题导致的业务宕机。我个人主导了平台核心功能研发,推动开发、测试、产品团队协同,确保平台覆盖80%以上运维场景,年节省运维人力成本约30万元。
2020.08 - 2022.04
星途互娱
运维开发工程师(中级)

游戏CDN节点智能运维系统研发及故障降本

  • 项目背景:星途互娱拥有2000+分布在北上广深及海外地区的CDN节点,原有运维模式依赖人工巡检与告警阈值触发,存在无效告警率高(日均120条,有效率仅40%)、故障排查耗时久(平均25分钟/节点)等问题,导致节点 downtime 每月超10小时,影响用户下载速度与播放体验。我的职责是负责故障诊断与智能告警模块的研发,支撑系统实现“精准告警-根因定位-自动修复”能力。
  • 关键难题:1)CDN节点日志量大(单节点日均产生5GB访问日志),传统ELK检索效率低,难以快速提取故障特征;2)不同节点的故障场景差异大(如海外节点网络波动、国内节点带宽拥塞),通用规则引擎无法适配;3)告警阈值设置依赖经验,容易出现“狼来了”效应,导致运维人员忽略关键告警。
  • 核心行动与创新:1)开发日志聚合分析模块:用Fluentd收集CDN节点日志,通过Elasticsearch的索引优化(如按地域、节点类型分词)与Kibana的可视化仪表盘,实现日志的快速检索与特征提取;2)构建场景化故障诊断模型:针对海外节点,用关联规则挖掘网络延迟与丢包率的相关性,识别跨境链路故障;针对国内节点,基于决策树模型分析带宽利用率与请求成功率的关系,定位拥塞源;3)实现告警分级与降噪:通过机器学习模型对告警进行优先级排序,将无效告警过滤率提升至70%,同时推送关键告警至运维人员的钉钉/企业微信,附带根因分析与修复建议。
  • 项目成果:系统上线后,CDN节点故障 downtime 每月降至6小时以内,无效告警数量减少60%,运维人员处理单节点故障的时间从25分钟缩短至8分钟;年节省故障处理成本约20万元,同时提升了用户下载成功率达15%。我主导了故障诊断模块的研发,优化了日志处理流程,推动与CDN厂商的API对接,实现部分故障的自动修复(如重启边缘节点)。
技能特长
沟通能力
执行能力
热情坦诚
文案能力
自我评价
  • 深耕互联网数据库全生命周期管理,以业务峰值稳定性为核心,习惯用「业务影响倒推」预判风险,平衡可用性与扩展性。
  • 擅长索引调优、慢查询治理等性能优化,将「主动防御」融入日常运维,减少突发故障对业务的影响。
  • 能与开发、产品同频对话,把技术语言转化为业务价值,推动解决数据一致性与迭代效率的矛盾。
  • 紧跟云原生、分布式技术趋势,主动沉淀方法论赋能团队,助力组织数据库能力持续升级。
智能诊断
编写灵感
请选择需要查找的灵感类型
请选择灵感源泉
选择合适的内容插入后即可编辑调整
请在上方选择您需要获取的灵感类型
对话框
提示
说明