个人介绍
可开发网站数据***以及网页等前端(全栈开发数据爬取)
工作经历
2026-01-01 -至今自由职业爬虫
项目一:针对抖音电商/娱乐直播间,实时抓取用户在直播间内的礼物赠送明细(含礼物ID、价值、赠送用户ID及时间戳),为主播运营提供实时战报数据 · 逆向分析与抓包:利用 Charles/Fiddler 对抖音App端进行HTTPS抓包,分析Protobuf协议及二进制数据流,成功解析出礼物赠送的实时接口。 · 反爬对抗(签名破解):针对抖音接口常见的 X-Gorgon、X-Khronos 等加密签名参数,通过Hook技术或算法逆向,编写Python脚本模拟生成有效请求签名,绕过服务端校验。 · 高并发实时采集:采用 WebSocket 长连接维持心跳,结合 Asyncio + Aiohttp 异步框架,同时监听数十个高人气直播间的礼物消息 项目二 爬取前程无忧、智联招聘、BOSS直聘等主流招聘网站的职位信息(含岗位描述、薪资、公司名称、学历要求等),构建垂直领域的招聘数据分析库。 核心职责与技术实现: · 多平台适配与动态渲染:针对各平台不同的页面结构,采用 Scrapy 框架作为核心调度器。对于动态加载的页面(如Ajax接口),使用 Selenium/Playwright 驱动无头
教育经历
2024-09-01 - 2028-07-12江苏理工学院软件工程本科已认证
本科软件工程在读,熟练Vue3、Node.js、MySQL技术栈,独立完成校园外卖全栈项目***+后台管理系统共用一套后端,熟悉前后端分离开发,可独立完成小程序定制、管理系统开发、接口联调、部署维护等工作。
语言
技能

1.项目有哪些具体功能模块:①自动化登录模块:基于Playwright启动真实Chromium浏览器,读取douyin_state.json本地缓存的登录态,首次运行需在浏览器中手动登录,之后免登录复用Cookie,支持密码登录和扫码登录两种方式。②反检测模块:集成playwright-stealt

①爬虫抓取模块(scrape_lightweight.py):基于curl_cffi异步并发,模拟Chrome131浏览器指纹,自动轮转代理池,支持断点续爬,可抓取猿急送平台所有兼职项目数据(标题、预算、工时、状态、描述等)。②智能过滤模块:内置黑名单关键词库,自动排除高难度(架构/专家/底层)、违



