点击保存简历
模块
风格
模板
导入
  • 个人名称
  • 头像
  • 基本信息
  • 求职意向
  • 工作经历
  • 项目经验
  • 实习经验
  • 作品展示
  • 奖项荣誉
  • 校园经历
  • 教育背景
  • 兴趣爱好
  • 技能特长
  • 语言能力
  • 自我评价
  • 报考信息
  • 简历封面
  • 自荐信
陆明哲
昨天的经验是今天的基石,而今天的突破将成为明天的标准。
28岁
3年工作经验
13800138000
DB@zjengine.com
陆明哲的照片
求职意向
数据库管理员 (DBA)
宁波
薪资面谈
三个月内到岗
工作经历
2020.07 - 2022.06
小楷生活服务科技有限公司
初级数据库管理员(DBA)

负责电商平台核心MySQL数据库集群日常运维,保障服务稳定性,配合研发团队完成SQL优化及故障排查,支撑电商大促、日常订单提交等峰值场景的数据库支撑工作

  • 主导分析电商618大促期间订单库慢查询问题,使用Percona Toolkit提取3天慢日志(累计120GB),定位到23条高频SQL存在索引缺失及行锁竞争问题,通过新增覆盖索引、调整事务粒度优化后,QPS平均延迟从50ms降至15ms,大促期间订单提交成功率从88%提升至99.2%
  • 搭建基于Prometheus+Grafana的数据库监控体系,整合连接数、慢查询占比、主从复制延迟、磁盘IO利用率等12项核心指标,设置三级告警阈值(如主从延迟超10s触发P1告警、连接数超80%触发P2告警),将故障平均响应时间从30分钟缩短至5分钟内,全年因监控遗漏导致的故障次数为0
  • 配合研发完成用户中心数据库分库分表落地,使用ShardingSphere-Proxy实现按用户ID哈希分片(分4库16表),将单库数据量从1.2亿条拆分至3000万条/库,单表数据量控制在1500万条以内,解决了原单库写入QPS上限1200的问题,支撑用户注册量月均增长20%
2022.07 - 2024.06
小楷生活服务科技有限公司
资深数据库管理员(DBA)

负责公司南北两地数据中心MySQL多活架构设计与运维,主导性能深度优化及自动化工具开发,支撑业务从1000万DAU增长至3000万DAU的数据库扩容与高可用需求

  • 主导设计跨AZ的MySQL Group Replication多活架构,替代原有的主从同步方案,通过调整group_replication_member_weight参数实现自动故障转移,两地数据中心数据同步延迟≤50ms,全年数据库可用性从99.9%提升至99.99%,未发生因数据同步问题导致的业务中断
  • 针对双11期间商品库CPU利用率过高(峰值95%)问题,通过sys schema分析innodb_row_lock_waits及temp_table_usage指标,定位到促销活动SQL频繁创建临时表导致IO消耗,优化SQL语句减少临时表使用(将子查询改为join),并将InnoDB buffer pool size从40G调整至服务器内存的70%(64G),CPU利用率降至65%,支撑单日订单量突破500万笔
  • 自主开发数据库自动化运维工具,基于Ansible Tower实现数据库部署(含主从同步配置)、版本升级(5.7→8.0)及参数配置的标准化,将人工操作步骤从15步减少至3步,部署效率提升80%;同时通过SaltStack实现配置文件集中管理,避免了因my.cnf配置不一致导致的3次主从同步中断故障
2024.07 - 至今
小楷生活服务科技有限公司
高级数据库管理员(DBA)/数据库团队负责人

统筹公司全链路数据库治理,涵盖架构优化、成本管控、团队技术指导及云原生转型,支撑业务向Serverless、分布式架构演进

  • 推动数据库成本优化项目,梳理全量86个MySQL实例,将低效的单实例(日均QPS<100)迁移至腾讯云TDSQL-C(Serverless),结合业务峰谷(早8点-晚10点扩容至100节点、其余时间缩容至10节点),全年数据库成本降低30%,同时保障了大促期间弹性扩容需求
  • 主导云原生数据库架构转型,引入TiDB分布式数据库替换原有的分库分表方案,支撑用户行为日志库从日均10TB数据增长至50TB,通过TiDB的水平扩展能力新增10个节点,查询延迟稳定在20ms以内,解决了分库分表带来的跨库join复杂、维护成本高的问题
  • 建立数据库团队技术培训体系,每月组织技术分享(如MySQL 8.0窗口函数、TiDB分布式事务原理、慢查询优化实战),覆盖团队8名成员,团队成员通过TiDB认证工程师考试占比从0提升至75%;同时制定《数据库操作规范》《故障处理SOP》,将人为操作失误导致的故障占比从15%降至3%
  • 负责重大故障复盘与改进,针对2024年9月缓存穿透导致的数据库压力骤增事件(CPU峰值98%),推动研发增加热点数据预加载机制(提前将TOP1000商品数据加载至Redis),并在数据库层启用读写分离(从库承担30%读请求),后续同类事件发生率降低90%,数据库CPU峰值下降40%
项目经验
2022.05 - 2023.10
星途互娱(专注游戏分发与社交娱乐的互联网企业)
运维开发工程师(核心研发负责人)

游戏分发平台全链路运维自动化平台研发及规模化落地

  • 项目背景:星途互娱游戏分发平台承载亿级用户日常访问,原有运维体系依赖分散的Shell脚本与人工操作,存在部署耗时久(单次全量部署需4小时)、故障定位慢(平均30分钟/次)、容量规划靠经验等问题,严重影响业务迭代效率与用户体验。核心目标是通过全链路自动化平台实现“部署-监控-故障自愈-容量管理”闭环,支撑平台高并发与快速迭代需求。我的职责是主导平台整体架构设计、关键模块开发及跨团队落地推动。
  • 关键难题:1)平台需兼容物理机、虚拟机、K8s容器等多异构环境,原有监控数据分散在不同系统,难以统一关联分析;2)故障自愈需基于多维度数据(metrics/logs/traces)快速定位根因并执行修复,现有规则引擎缺乏业务场景适配性;3)容量规划需精准预测业务峰值(如新游上线、周末活动)带来的资源需求,传统线性预测模型误差率超30%。
  • 核心行动与创新:1)设计“统一数据层+场景化引擎”架构:整合Prometheus(监控)、ELK(日志)、Jaeger(链路追踪)数据至ClickHouse,构建全链路数据湖;针对游戏业务周期性特点,基于XGBoost模型融合历史流量、活动排期、用户行为数据,开发动态容量预测模块,将误差率降至8%以内;2)故障自愈引擎引入“规则+机器学习”双决策模式:通过规则引擎处理常见故障(如Pod重启、磁盘满),用LSTM模型识别异常流量模式(如DDoS前兆),自动触发对应修复动作(如扩容、流量切换);3)主导开发部署流水线模块,支持蓝绿部署、灰度发布等策略,集成健康检查与回滚机制,确保发布安全。
  • 项目成果:平台上线后,全量部署时间从4小时缩短至15分钟,故障定位时间降至5分钟内,容量利用率提升20%;支撑平台完成12次大型版本迭代与6次峰值流量考验(最高QPS达800万),未发生因运维问题导致的业务宕机。我个人主导了平台核心功能研发,推动开发、测试、产品团队协同,确保平台覆盖80%以上运维场景,年节省运维人力成本约30万元。
2020.08 - 2022.04
星途互娱
运维开发工程师(中级)

游戏CDN节点智能运维系统研发及故障降本

  • 项目背景:星途互娱拥有2000+分布在北上广深及海外地区的CDN节点,原有运维模式依赖人工巡检与告警阈值触发,存在无效告警率高(日均120条,有效率仅40%)、故障排查耗时久(平均25分钟/节点)等问题,导致节点 downtime 每月超10小时,影响用户下载速度与播放体验。我的职责是负责故障诊断与智能告警模块的研发,支撑系统实现“精准告警-根因定位-自动修复”能力。
  • 关键难题:1)CDN节点日志量大(单节点日均产生5GB访问日志),传统ELK检索效率低,难以快速提取故障特征;2)不同节点的故障场景差异大(如海外节点网络波动、国内节点带宽拥塞),通用规则引擎无法适配;3)告警阈值设置依赖经验,容易出现“狼来了”效应,导致运维人员忽略关键告警。
  • 核心行动与创新:1)开发日志聚合分析模块:用Fluentd收集CDN节点日志,通过Elasticsearch的索引优化(如按地域、节点类型分词)与Kibana的可视化仪表盘,实现日志的快速检索与特征提取;2)构建场景化故障诊断模型:针对海外节点,用关联规则挖掘网络延迟与丢包率的相关性,识别跨境链路故障;针对国内节点,基于决策树模型分析带宽利用率与请求成功率的关系,定位拥塞源;3)实现告警分级与降噪:通过机器学习模型对告警进行优先级排序,将无效告警过滤率提升至70%,同时推送关键告警至运维人员的钉钉/企业微信,附带根因分析与修复建议。
  • 项目成果:系统上线后,CDN节点故障 downtime 每月降至6小时以内,无效告警数量减少60%,运维人员处理单节点故障的时间从25分钟缩短至8分钟;年节省故障处理成本约20万元,同时提升了用户下载成功率达15%。我主导了故障诊断模块的研发,优化了日志处理流程,推动与CDN厂商的API对接,实现部分故障的自动修复(如重启边缘节点)。
技能特长
沟通能力
执行能力
热情坦诚
文案能力
奖项荣誉
  • 数据库系统工程师
  • 2023年度公司数据库项目攻坚奖
  • 2024年市级DBA技能竞赛三等奖
自我评价
  • 深耕互联网DBA领域,习惯从业务链路依赖设计数据库高可用方案,容量与容灾策略均锚定业务增长节奏,避免无效冗余。
  • 擅长分层拆解慢查询根因——从应用逻辑到索引再到存储引擎,不止修复问题,更推动业务流程适配数据库特性。
  • 践行“故障前置”理念,用自动化监控捕捉趋势异常,主导建立关键指标预警体系,压缩故障响应至分钟级。
  • 作为数据库与跨团队“技术翻译器”,能把QPS瓶颈转化为业务可理解约束,推动研发、产品对齐技术目标。
报考信息
填写报考学校
填写报考专业
科目1
分数1
科目2
分数2
科目3
分数3
科目4
分数4
智能诊断
编写灵感
请选择需要查找的灵感类型
请选择灵感源泉
选择合适的内容插入后即可编辑调整
请在上方选择您需要获取的灵感类型
对话框
提示
说明