这是用于演示写法的虚构简历。姓名、任职经历和成果均为创作,并非真实员工的履历。
冯红梅
从事将批处理迁移到支持依赖与回填的编排系统与为高频业务问题发布认证数据集与责任人的数据工程师。主要实践领域:SQL · 数据管道 · 源目标核对 · 分区重放。
工作经历
Thermo Fisher
上海 · 中国
数据工程师
2022年3月 - 至今
- 构建将运营导出数据加载到整理表的Azure数据管线,明确SQL合并键及迟到规则,验证重处理不会产生重复记录。
- 为数据管线加入SQL对账与隔离检查,保留带原因码的拒收行,在上游结构变更进入报表层前定位问题。
- 为数据管道增加源目标行数核对和迟到数据处理,在不重复已完成记录的前提下重放中断分区。
- 主导通过分区SQL测试数据修复Airflow ETL恢复路径,解决重复加载并完成不改变下游业务键的重放。
- 通过Spark行数核对构建Python数据管道检查,将迟到分区调查从45分钟缩短至18分钟并发布Azure重跑指南。
腾讯
深圳 · 中国
数据工程师
2019年1月 - 2022年2月
- 负责为高频业务问题发布认证数据集与责任人。使处理时间持续保持在约定运营窗口内。
- 调查发布指标与源记录之间的差异,追踪改变总体的转换步骤,用可复现查询修正计算。
- 比较最近成功刷新和失败运行,区分源数据缺失与转换错误,仅重跑受影响时间段,并保留原查询与修正结果供复核。
重点项目
数据工程师独立案例研究
项目负责人
2024年2月 - 2024年6月
- 负责为大型转换实现增量模型与分区裁剪
- 生成含重复、迟到和更正值的合成源记录,编写行数及键唯一性断言,记录各案例对报告指标的预期影响。
- 将分析输出与手工计算参考表核对,追踪差异所在的转换步骤,在修正查询旁保留数据字典与重跑说明。
- 主导通过手算参考验证合成数据,解决重复键导致的虚增并完成重现修正总额的笔记本。
教育经历
西安电子科技大学
西安 · 中国
计算机科学与技术 工学学士
2013年9月 - 2017年6月
相关课程:算法、操作系统、数据库、计算机网络
技能
岗位能力
SQL · 数据管道 · 源目标核对 · 分区重放

