proginn1010306225
1天前在线
全职 · 800/日  ·  17400/月
工作时间: 工作日19:30-23:00、周末08:00-22:00工作地点: 远程
服务企业: 0家累计提交: 0工时
聊一聊

APP聊一聊

个人介绍

我是程序员客栈的 coolby,7 年数据开发 / 数仓经验,独立负责过多套大型数据项目的设计、落地与上线验收。

擅长 vibe coding:曾以约一周时间完成大型项目开发、验收并通过上线。能用 Cursor / Claude Code 等工具高效推进从建模、ETL、质量到可视化的端到端交付。

【云平台与大数据】

精通阿里云大数据体系(MaxCompute、DataWorks、RDS、OSS、Dataphin),熟悉 ClickHouse、Amazon S3、StarRocks、DolphinScheduler 等主流数仓与调度平台,具备生产环境建设与优化能力。

【BI 可视化】

熟练搭建 Quick BI、Power BI、观远 BI 等报表与经营看板,能将指标口径落到可复用的数据模型与可视化方案。

【编程与 SQL】

熟悉 Shell、Java、Python,具备扎实的 SQL 编写与调优能力,可独立完成复杂离线/实时链路与问题排查。

【大数据框架】

掌握 Hadoop 生态,理解 HDFS、MapReduce、YARN;熟练使用 Spark、Hive 做离线处理,使用 Flink 做实时流处理。

【同步与消息】

熟悉 Kafka、Flume、DataX、Flink CDC 等,能稳定构建批流一体的数据通道。

【专业认证】

持有阿里云大数据 ACP 证书。

工作经历

  • 2025-02-25 -2026-07-11上海梭翱数据智能工程师

    1. 主导 StarRocks 数仓模型设计与迭代,统一核心业务口径,沉淀可复用的建模规范与文档,降低跨需求口径不一致与返工成本。 2. 搭建任务强弱分级 + DQC 数据质量监控体系,将及时性、准确性门禁前置到日常调度与告警闭环,减少「数错了才发现」的被动救火。 3. 承接指标平台底层数据建设,保障指标口径可溯源、可复用,为上层报表与分析提供稳定、一致的数据底座。 4. 独立完成 SP 归因逻辑设计与上线,并主导新老埋点日志平滑切换,保证归因链路在切换期业务连续、结果可验收。 5. 深度使用 AI 工具提效交付,覆盖报表生成、SQL 优化与问题排查,显著压缩需求从提出到交付的周期。 6. 负责日常值班与数仓运维,持续优化告警规则与响应路径,缩短故障发现到处置的时间,提升线上稳定性。 7. 优化 ETL 与存储策略(冷热分层、生命周期管理),在保障查询体验的前提下降低计算与存储成本。 8. 以 Cursor / Claude Code / Hermes 等工具做 vibe coding,一人端到端搭建数仓智能化平台:覆盖智能抽数、智能运维、智能告警等能力,将传统多系统手工链路收敛为可发

  • 2023-06-09 -2025-02-21上海数禾信息科技有限公司数仓开发工程师

    1. 主导 StarRocks / Dataphin 数仓模型设计与迭代,统一核心业务口径,沉淀建模规范与模型文档,降低跨需求口径不一致与返工。 2. 制定任务强弱分级规则,搭建 DQC 数据质量监控体系(含自定义规则),保障核心表产出的及时性、准确性与完整性。 3. 承接指标与分析底层数据建设,面向业务设计 DWT 宽表与 ADS 结果层(如轻/重资产、获客渠道等),支撑报表与经营分析。 4. 主导获客一站式改造:梳理新老表映射,覆盖下游约 400 张表、4000+ 任务的平替重构与验数,完成获客宽表层重建并平滑上线。 5. 推动成本与时效优化:任务治理、中间表清理、冷热分层与生命周期管理、代码逻辑优化及项目空间资源管控,在保障产出的前提下降低计算与存储成本。 6. 负责日常值班与服务台答疑,优化告警与响应路径,缩短故障发现到处置时间,提升线上稳定性。 7. 基于 ADS 数据集搭建观远 BI 看板,提升业务自助分析效率。 8. 深度使用 AI 工具(Cursor / Claude Code 等)提效日常交付,覆盖报表生成、SQL 优化与问题排查;并独立推进数仓智能化相关能力建设(智

  • 2020-09-15 -2023-06-07新略数智(杭州)科技有限公司 大数据开发工程师

    1. 基于 DataWorks + MaxCompute 负责数据仓库建模与优化,统一多品牌/多平台数据口径,沉淀可复用的表结构与数据字典。 2. 主导「策略分析中心」「用户分析中心」两大模块数据建设与 Quick BI 可视化交付,支撑营销策略洞察与用户运营分析。 3. 对接 API / RPA / SFTP / Kafka 等多源采集入仓,完成 ODS→清洗加工→ADS 全链路 ETL,并按业务频率设计分区与增量/全量策略。 4. 面向高频多场景输出结果表,合理设计纵表/横表形态,降低下游使用复杂度;数据落地 RDS / ClickHouse,并配置加速与预计算,保障报表性能。 5. 独立承接品牌定制化报表开发、需求迭代与定期数据更新维护,使用 Python 脚本高效取数与校验。 6. 持续维护需求与交付文档,保障需求可追溯、口径可复用,提升跨角色协作效率。

教育经历

  • 2016-07-01 - 2020-07-01河南理工大学物联网本科

资质认证

语言

中文可口语交流
0
1
2
3
4
5

技能

Python熟练
Java精通
MySQL精通
0
1
2
3
4
5
0
1
2
3
4
5
作品
数仓智能运维

作品一:同步任务四步向导。登记数据源→配置规则→规则/AI生成DDL·DataX·DS参数→验证发布到调度→一键初始化同步,并给出DataX/视图进度与行数字段比对报告。实例上,发布后即可在平台内完成首批灌数与核对,不必再切多个控制台手工触发、手工对行数。作品二:数据质量监控。表规则/模板(含自写S

0
2026-07-28 18:43
更新于: 2天前 浏览: 6