hunger_爬虫
1月前来过
全职 · 300/日  ·  6525/月
工作时间: 工作日16:00-20:00、周末10:00-18:00工作地点: 远程
服务企业: 0家累计提交: 0工时
聊一聊

APP聊一聊

个人介绍

我是程序员客栈的Hunger,一名正在找爬虫实习岗的在读本科生;

我就读于上海电力大学;

能熟练进行JS逆向分析和补环境,熟悉webpack、ob混淆、RPC、WASM等技术,能独立完成部分中高阶难度的网站逆向工作

工作经历

  • 2024-09-01 -2025-06-01云数爬虫实习生

    1. 负责电商/资讯类网站的数据采集工作,基于 Python + Requests + BeautifulSoup / XPath 编写并维护 10+ 个定向爬虫脚本,覆盖商品信息、价格、评论等核心字段,日均稳定采集数据约 5 万条。 2. 针对反爬机制较强的站点,引入 User-Agent 池、代理 IP 池及请求频率控制策略,将单站点请求成功率由约 75% 提升至 95% 以上;对部分动态渲染页面,使用 Selenium + Chrome Headless 完成 JS 渲染与数据提取。 3. 参与构建基于 Scrapy 的分布式爬虫框架,结合 Redis 实现请求队列的去重与调度,在多台服务器上部署后,整体采集效率较单机模式提升约 3 倍。 4. 负责清洗与预处理采集数据,处理缺失值、异常值和重复数据,并通过正则表达式完成字段标准化;将清洗后的数据存储至 MySQL,并按业务需求定期导出 CSV 供分析团队使用。 5. 编写爬虫运行日志与异常报警模块,对超时、封禁、解析失败等情况进行捕获与记录,配合定时任务(crontab)实现每日自动运行,降低人工干预频率。 6. 与后端、数据分

教育经历

  • 2024-09-01 - 2028-07-01上海电力大学信息安全本科

语言

中文母语水平
英语无工具书面交流
0
1
2
3
4
5
0
1
2
3
4
5

技能

Flask了解
C++熟悉
PHP熟悉
C熟悉
Django熟悉
Python掌握
0
1
2
3
4
5
0
1
2
3
4
5
作品
云片滑块基础版绕过

1.Webpack混淆JS逆向分析​分析云片网前端app.xxx.js的Webpack构建结构定位滑块模块加载入口(webpackJsonp/__webpack_require__)提取关键函数:滑块图片URL解密逻辑轨迹加密函数校验参数签名生成算法2.滑块缺口智能识别(ddddOCR)​自动下载背

0
2026-07-13 22:16
下载次数:0
¥1000
赢商大数据品牌招商信息采集系统

围绕“品牌–分类关系数据”的采集与管理,主要实现了以下功能:1.定向网页数据采集针对赢商大数据平台的品牌列表页进行定向爬取;覆盖82个品牌分类、共238个品牌,累计采集2268条品牌–分类对应关系数据。2.请求去重与状态管理引入Redis​作为分布式请求队列与去重组件;基于Redis集合(Set)记

0
2026-07-13 14:36
下载次数:0
¥100
新手贴,接爬虫相关项目

本人接单新手,价格优惠,随时有空,有需求找我,没需求也可以唠嗑

更新于: 07-13 浏览: 38