DataMiner_Tian
刚刚活跃
全职 · 300/日  ·  6525/月
工作时间: 工作日09:00-23:00、周末09:00-23:00工作地点: 远程
服务企业: 0家累计提交: 0工时
聊一聊

APP聊一聊

个人介绍

我是程序员客栈的邱天,一名数据挖掘 & NLP 工程师;

我毕业于南京中医药大学,就职于某大型通信运营商,担任数据挖掘工程师;

负责过 "22亿+条招投标数据生命周期串联与去重"、"AI算力潜客挖掘与评分模型"、"基于大模型的新闻相关度评分与精准推荐" 等生产级项目的开发落地;

熟练使用 Python、SQL、PySpark、机器学习、大模型与提示词工程;

如果我能帮上您的忙,请点击"立即预约"或"发布需求"!

工作经历

  • 2026-06-19 -2026-08-31数据分析师数据分析师

    我负责整体建模与工程实现,设计"初筛→直接打分→剩余回归打分→分省归一"流水线。针对注册资本长尾分布采用"对数变换 + 5%/95% 分位截断 + 线性映射",构建企业名称关键字库并与爬虫数据关联。难点是多源异构数据对齐与不同省份客户量级差异下的打分公平性,最终形成可月更的推荐资产.

教育经历

  • 2023-09-01 - 2026-06-18南京中医药大学软件工程硕士

语言

中文母语水平
英语可口语交流
西班牙语可口语交流
0
1
2
3
4
5
0
1
2
3
4
5

技能

Python精通
MySQL精通
Torch精通
Spark精通
0
1
2
3
4
5
0
1
2
3
4
5
作品
百亿级招投标数据生命周期串联与分组模型

①数据质检与标准化:对22亿+条标讯排查字段缺失与异常,制定项目名称/招标单位清洗规则,剔除生命周期冗余词并独立提取期数、批数字段;②三步分组归集:按"招标公告基准归集→全量招标数据归集→中标及后续数据归集"层层复用,生成唯一fam_id,并处理编号复用、招标人缺失等兜底场景;③状态打标与溯源:四种

1
2026-08-31 16:22
更新于: 24分钟前 浏览: 1