个人介绍
我是程序员客栈的Hunger,一名正在找爬虫实习岗的在读本科生;
我就读于上海电力大学;
能熟练进行JS逆向分析和补环境,熟悉webpack、ob混淆、RPC、WASM等技术,能独立完成部分中高阶难度的网站逆向工作
工作经历
2024-09-01 -2025-06-01云数爬虫实习生
1. 负责电商/资讯类网站的数据采集工作,基于 Python + Requests + BeautifulSoup / XPath 编写并维护 10+ 个定向爬虫脚本,覆盖商品信息、价格、评论等核心字段,日均稳定采集数据约 5 万条。 2. 针对反爬机制较强的站点,引入 User-Agent 池、代理 IP 池及请求频率控制策略,将单站点请求成功率由约 75% 提升至 95% 以上;对部分动态渲染页面,使用 Selenium + Chrome Headless 完成 JS 渲染与数据提取。 3. 参与构建基于 Scrapy 的分布式爬虫框架,结合 Redis 实现请求队列的去重与调度,在多台服务器上部署后,整体采集效率较单机模式提升约 3 倍。 4. 负责清洗与预处理采集数据,处理缺失值、异常值和重复数据,并通过正则表达式完成字段标准化;将清洗后的数据存储至 MySQL,并按业务需求定期导出 CSV 供分析团队使用。 5. 编写爬虫运行日志与异常报警模块,对超时、封禁、解析失败等情况进行捕获与记录,配合定时任务(crontab)实现每日自动运行,降低人工干预频率。 6. 与后端、数据分
教育经历
2024-09-01 - 2028-07-01上海电力大学信息安全本科
资质认证
语言

1.Webpack混淆JS逆向分析分析云片网前端app.xxx.js的Webpack构建结构定位滑块模块加载入口(webpackJsonp/__webpack_require__)提取关键函数:滑块图片URL解密逻辑轨迹加密函数校验参数签名生成算法2.滑块缺口智能识别(ddddOCR)自动下载背





