wvllm
10小时前在线
全职 · 300/日  ·  6525/月
工作时间: 工作日19:00-24:00、周末07:00-24:00工作地点: 远程
服务企业: 0家累计提交: 0工时
聊一聊

APP聊一聊

个人介绍

我是程序员客栈的wvllm,一名Python 全栈开发 / 数据采集与大模型应用工程师;

我毕业于吉林工师,担任过上海梭翱信息技术有限公司的爬虫开发工程师,担任过上海迪爱斯信息技术有限公司的大模型研发工程师;

负责过【多端分布式爬虫系统】、【垂直领域大模型微调与 RAG 知识库】、【多智能体协作平台】的开发;

熟练使用 Python、Scrapy/Playwright、Frida/Android 逆向、LangChain/LlamaIndex、vLLM/量化部署;

如果我能帮上您的忙,请点击“立即预约”或“发布需求”!

工作经历

  • 2024-01-01 -至今上海迪爱斯信息技术有限公司大模型研发工程师

    核心职责:负责大模型在垂直业务场景的落地应用,涵盖数据构建、模型微调、RAG 检索增强、Agent 编排及推理性能优化。 领域大模型微调与对齐: 基于 LLaMA / Qwen / ChatGLM 等开源基座,针对 XX 垂直领域构建指令微调数据集(含数据清洗、去重、质量过滤),完成 SFT + LoRA/QLoRA 微调,领域任务准确率从基座的 62% 提升至 89%。 引入 RLHF / DPO 进行偏好对齐,优化模型在业务场景下的回答风格与安全性,人工评估满意度提升 37%。 RAG 检索增强系统: 搭建从文档解析 → 切分 → 向量化 → 检索 → 重排 → 生成的完整 RAG 链路,支持 PDF、Word、网页、数据库 等多源异构数据的知识入库。 针对检索精度问题,引入 混合检索(BM25 + 向量)、Rerank 重排 与 Query 改写,召回率从 71% 提升至 93%,幻觉率下降 58%。 使用 Milvus / Faiss / Elasticsearch 构建向量索引,支撑千万级知识库的高效检索,平均响应时间控制在 800ms 以内。 Agent 编

  • 2022-06-01 -2023-12-31上海梭翱信息技术有限公司python 爬虫工程师

    核心职责:负责多端(Web / Android / 小程序)数据采集系统的架构设计与反爬对抗,并探索大模型在采集链路的落地应用。 多端采集架构设计:主导搭建基于 Scrapy-Redis + Celery 的分布式采集平台,统一调度 Web 端(PC/H5)与 Android 端的采集任务,支持 Docker 容器化动态扩容,日均处理请求量达 千万级,多端数据入库准确率维持在 99% 以上。 Web 端反爬对抗: 针对目标站点的 JS 逆向、TLS 指纹(JA3)、滑块验证码、动态字体加密等高级风控,完成多套定制化绕过方案,核心站点采集可用率从 60% 提升至 99.5%。 熟练使用 Playwright/Selenium 处理复杂 SPA 页面渲染,并结合 mitmproxy 进行流量拦截与参数还原。 Android 端逆向与采集: 负责 Android App 的数据抓取与协议还原,熟练使用 Frida、Xposed 进行 Hook 注入、脱壳与动态调试,成功还原 App 的加密签名算法与通信协议。 通过 Jadx、IDA Pro 进行静态分析,结合 模拟器群控(如

教育经历

  • 2019-09-01 - 2023-06-01吉林工程技术师范学院测控技术与仪器本科

资质认证

语言

中文母语水平
英语无工具书面交流
0
1
2
3
4
5
0
1
2
3
4
5

技能

Python精通
0
1
2
3
4
5
更新于: 9小时前 浏览: 1