当前模板已根据「数据平台开发工程师」岗位深度优化
选择其他岗位
开始编辑模板后,您可以进一步自定义包括:工作履历、工作内容、信息模块、颜色配置等
内置经深度优化的履历,将为你撰写个人简历带来更多灵感。
陆明哲的照片
28岁
3年工作经验
13800138000
DB@zjengine.com
求职意向
数据平台开发工程师
苏州
薪资面谈
随时到岗
技能特长
沟通能力
执行能力
热情坦诚
文案能力
兴趣爱好
摄影
看书
阅读
跑步
陆明哲
昨天的经验是今天的基石,而今天的突破将成为明天的标准。
工作经历
2022.07 - 2024.06
小楷数据科技
数据平台开发工程师

负责电商平台数据底层存储与计算组件开发,支撑用户行为分析、交易报表等核心数据应用,保障平台稳定性与处理效率。

  • 主导设计混合存储架构,基于HDFS与对象存储(OSS)实现冷热数据分层,通过Hadoop Archive压缩冷数据(占比35%)并结合生命周期策略自动迁移,年存储成本降低42%,同时保障热数据查询延迟稳定在50ms内。
  • 优化Spark on K8s调度逻辑,针对日均5000+离线任务设计动态资源分配策略(基于YARN队列水位感知),并通过调整Shuffle分区数(从200提升至500)与压缩算法(Snappy转ZSTD),将任务平均完成时长从48分钟压缩至26分钟,集群资源利用率提升28%。
  • 搭建元数据血缘追踪系统,集成Apache Atlas与平台SQL解析器,实现从ODS到ADS全链路字段级血缘可视化,数据问题定位耗时从平均2小时缩短至20分钟,支撑业务方快速排查指标异常。
  • 解决大促期间数据积压问题,通过预计算热点分区(如用户日活TOP1000商品)与动态扩容Spark Executor(基于Prometheus指标触发),保障双11当天20亿条日志在3小时内完成清洗入仓,较去年同期提速50%。
2024.07 - 2025.06
小楷科技
高级数据平台开发工程师

聚焦数据平台多租户能力建设,支持零售、本地生活等多业务线复用,推动平台从单一业务支撑向跨域服务转型。

  • 设计基于K8s Namespace的容器化资源隔离方案,结合租户配额系统(CPU/内存/存储三级限制)与动态扩缩容策略(HPA根据队列负载自动调整),支撑12条业务线同时在线,集群资源利用率从38%提升至65%,年服务器成本节省约300万。
  • 开发统一权限管理模块,对接企业LDAP与RBAC模型,实现表级/字段级权限细粒度控制(支持正则表达式匹配字段),上线后数据越权访问事件清零,同时通过权限缓存(Redis+本地Caffeine)将鉴权耗时从80ms降至15ms。
  • 优化实时计算链路,针对订单实时看板场景,重构Flink作业状态后端(RocksDB转增量Checkpoint+OSS持久化),并将窗口计算从滚动窗口改为滑动窗口(步长1分钟),使大促期间订单实时更新延迟从5秒降至1.8秒,支撑前端页面秒级刷新。
  • 主导解决多租户资源竞争问题,通过设计优先级队列(核心业务优先)与任务超时熔断机制(超过30分钟自动kill并重试),将关键任务成功率从92%提升至99.6%,非核心任务吞吐量提升40%。
2025.07 - 至今
小楷科技
数据平台技术负责人

统筹数据平台从离线向实时化、湖仓一体架构转型,支撑全公司数据驱动决策,覆盖用户增长、智能营销、风险控制等核心场景。

  • 主导湖仓一体平台落地,整合Iceberg数据湖(存储原始明细数据)与ClickHouse实时数仓(支撑聚合查询),通过Flink CDC同步业务库变更,实现ETL流程节点减少60%,复杂指标查询性能提升3倍(从分钟级到秒级),已支撑用户分群、漏斗分析等10+AI模型训练需求。
  • 推动自动化运维体系建设,基于Prometheus+Grafana搭建全链路监控(覆盖Hadoop/Spark/Flink/Kafka等20+组件),自定义告警规则150+条(如Shuffle失败率>5%、Flink TaskManager内存使用率>80%),故障平均修复时间(MTTR)从2小时缩短至12分钟,年度P0级故障次数从7次降至0次。
  • 牵头制定《数据平台开发规范V3.0》,包含代码质量(SonarQube覆盖率≥80%)、性能压测(核心任务QPS需达业务峰值1.5倍)、灰度发布(先跑10%流量验证)等12项标准,上线后生产环境事故率同比下降82%,新功能上线周期缩短30%。
  • 支撑AI场景数据需求,开发特征工程平台(集成Feast特征存储与MLflow实验管理),提供数据清洗、特征计算、在线推理全流程能力,将算法团队取数耗时从周级降至小时级,模型迭代频率从每月1次提升至每周2次,推动用户流失预测模型AUC从0.78提升至0.85。
项目经验
2022.03 - 2023.08
星途互动科技有限公司
大数据分析负责人

星途短视频用户行为全链路实时分析平台建设

  • 项目背景:公司短视频业务快速增长,但原离线Hive分析系统存在2-4小时延迟,无法支撑运营团队对热点事件、用户流失的实时响应,也无法为推荐系统提供分钟级更新的实时特征。核心目标是从0到1搭建秒级延迟的用户行为全链路实时分析平台,覆盖埋点接入、数据清洗、指标聚合到多端输出的全流程,支撑运营决策与推荐优化。我在项目中担任总负责人,统筹需求、架构设计与落地。
  • 关键难题:①跨端(APP/小程序/H5)埋点格式不统一,导致数据清洗耗时且易出错;②实时计算中1小时以上长窗口的状态管理易引发内存溢出与性能瓶颈;③高并发下(峰值15万/秒事件)数据一致性难以保障。技术上,我主导用Protobuf定义32类用户行为(观看、点赞、评论、分享、完播)的统一Schema,推动产品、客户端团队完成20+端的埋点改造;选择Flink CDC从Kafka实时消费数据,结合RocksDB状态后端与增量Checkpoint机制,将状态存储成本降低40%同时保障容错;设计“滑动窗口(1分钟)+会话窗口(30分钟无行为断开)”组合策略,解决长窗口与短周期指标的精准计算问题。
  • 核心行动:①牵头梳理《用户行为埋点规范》,建立“事件-属性-枚举值”三级标准,通过自动化校验工具拦截90%以上的脏数据;②针对实时聚合指标(如实时完播率、互动转化率)的性能瓶颈,优化Flink算子并行度(从8并行提升至24并行)与内存管理策略,将单节点处理能力从5万/秒提升至18万/秒;③构建分层数据架构:ODS层(Kafka存储原始事件)→DWD层(Flink实时清洗去重)→DWS层(按用户/内容/场景聚合实时指标)→ADS层(对接BI工具Tableau、推荐系统Flink Job),确保数据链路的低耦合与高扩展性。
  • 项目成果:平台上线后,实时处理延迟稳定在500ms内,支持峰值12万/秒事件处理;沉淀“直播间实时互动率”“短视频实时完播转化漏斗”“用户实时流失预警”等15个核心运营指标,帮助运营团队在某热点事件中快速调整推荐策略,相关视频曝光量提升45%;推荐系统实时特征更新频率从天级提升至分钟级,驱动短视频整体点击率增长18%。我个人主导了架构设计与关键模块开发,解决了跨端数据一致性与实时状态管理的核心问题,该平台已成为公司短视频业务的“实时决策大脑”。
2020.06 - 2021.12
星途互动科技有限公司
大数据开发工程师

星途社区内容标签体系与实时推荐引擎优化

  • 项目背景:公司社区推荐系统依赖离线静态标签(每日凌晨更新),无法捕捉用户实时兴趣变化——例如用户刚观看“新手化妆教程”,推荐结果仍以“美食测评”为主,导致点击率仅7.2%,用户留存率下滑。我的目标是重构内容标签体系,实现标签动态更新,并优化推荐引擎的数据链路,提升推荐的时效性与精准度。项目中我负责标签实时化改造与推荐数据层优化。
  • 关键难题:①离线标签无法反映用户近期行为,导致推荐“过时”;②内容标签以粗粒度(如“美妆”“美食”)为主,缺乏细粒度分类(如“美妆-新手教程”“美食-烘焙测评”),推荐泛化严重;③实时数据链路长(行为→日志→计算→标签更新需40分钟),无法支撑推荐的实时性。技术上,我引入BERT细粒度内容分类模型,对社区100万+条内容进行重新打标,建立“一级标签+二级细粒度标签”的体系(如“美妆”下含25个二级标签);用Flink实时处理用户近15分钟的行为(播放、点赞、评论),动态调整内容与用户的标签权重(如实时观看“新手教程”的用户,“美妆-新手”标签权重提升至80%);优化数据链路,用Kafka替代原有的ActiveMQ,将消息传递延迟从15分钟降至3分钟。
  • 核心行动:①牵头梳理社区内容的细粒度标签体系,联合内容运营团队标注50万条样本,训练BERT模型实现自动化打标,标签准确率从75%提升至92%;②开发实时标签计算模块,用Flink的KeyedProcessFunction实现“用户行为→标签关联→权重更新”的实时流程,支持每秒10万+条行为的处理;③对接推荐系统,将实时标签特征占比从20%提升至50%,优化特征工程中的“近期兴趣得分”计算逻辑(采用指数衰减加权,突出最近30分钟的行为)。
  • 项目成果:推荐点击率提升至8.9%(增长24%),用户日均使用时长增加18分钟;内容标签覆盖率从68%提升至96%,覆盖更多垂类内容;实时标签计算延迟降至8分钟内,支撑推荐的“实时兴趣捕捉”。我个人设计了动态标签体系与实时数据链路,推动推荐系统从“离线静态”向“实时动态”升级,该项目使社区用户30日留存率提升12%,成为社区业务的核心优化案例。
教育背景
2014.09 - 2017.06
XX实验高级中学
文科综合班
通过辩论社核心训练(市级最佳辩手),形成结构化表达与快速信息整合能力;发起“乡村中学读书角”公益项目,协调多方资源覆盖8所学校,验证项目0-1落地方法论。
2017.09 - 2021.06
XX师范大学
汉语言文学(本科)
深耕内容创作与传播理论(核心课程优秀率90%),建立用户心理洞察方法论;运营校级公众号期间,通过内容策略调整使粉丝量3个月增长200%(1.5万→4.5万),输出《高校新媒体爆款公式》被20+社团采用。获全国大学生新媒体运营大赛银奖。
奖项荣誉
  • 中级大数据开发工程师职业技能等级证书
  • 2023年度公司优秀技术员工
  • 2024年Q2项目攻坚奖
自我评价
  • 深耕互联网数据平台全链路开发,擅长从业务需求倒推底层架构,用“分层解耦+弹性扩展”解决高并发数据流转瓶颈。
  • 始终站在业务侧拆解数据诉求,将抽象指标转化为可落地方案,确保数据能力匹配业务决策节奏。
  • 主动挖掘隐性数据痛点,不局限于执行,曾牵头梳理跨部门口径问题,推动统一元数据管理机制落地。
  • 擅长用技术语言衔接业务与工程团队,快速对齐认知差异,让平台更贴合实际使用场景。
试一下,换个颜色
选择配色
使用此模板创建简历
  • 支持电脑端、微信小程序编辑简历
  • 支持一键更换模板,自由调整字距行距
  • 支持微信分享简历给好友查看
  • 支持简历封面、自荐信、自定义简历模块
  • 支持导出为PDF、图片、在线打印、云端保存
该简历模板已内置
  • 个人名称
  • 头像
  • 基本信息
  • 求职意向
  • 工作经历
  • 项目经验
  • 实习经验
  • 作品展示
  • 奖项荣誉
  • 校园经历
  • 教育背景
  • 兴趣爱好
  • 技能特长
  • 语言能力
  • 自我评价
  • 报考信息
  • 简历封面
  • 自荐信
对话框
提示
说明