立项原因:旨在解决手动重复操作网页采集资源的繁琐操作,练习浏览器自动化技术。(因为自己在学习爬虫并且平时在网址上看的时候加载3秒看一秒,仅限个人学习哦)行业场景:个人技术学习场景,模拟完整网页业务链路,练习网页元素定位、网络抓包、批量任务处理,用于自动化脚本开发练习。
点击空白处退出提示
立项原因:旨在解决手动重复操作网页采集资源的繁琐操作,练习浏览器自动化技术。(因为自己在学习爬虫并且平时在网址上看的时候加载3秒看一秒,仅限个人学习哦)行业场景:个人技术学习场景,模拟完整网页业务链路,练习网页元素定位、网络抓包、批量任务处理,用于自动化脚本开发练习。
1. 浏览器自动化:自动访问网站首页,完成搜索、选集,自动跳转播放页面;
2. 网络抓包监听:监听页面网络请求,捕获视频相关资源链接;
3. 下载模块:支持单集下载、多集循环批量下载,具备超时重试、异常捕获逻辑;
4.GUI 可视化窗口:实现桌面窗口交互,通过按钮完成任务,脱离黑控制台操作;
5. 页面容错:处理页面超时、刷新重试、页面元素加载异常等网页常见问题。
项目主要使用 for、while 循环完成业务逻辑,正在学习函数与类进行代码重构。本项目仅用于个人编程技术学习研究。
本人完成本项目核心元素获取,抓包,循环返回,下载等脚本开发。使用Python语言,基于Playwright实现浏览器自动化,完成页面访问、元素点击、页面跳转、网络请求监听抓包;使用CustomTkinter开发GUI桌面交互窗口(AI完成窗口化按钮等脚本,本人现还没完全理解透彻);使用requests库实现文件下载,通过for、while循环实现选集遍历、批量下载业务逻辑。
开发过程中解决页面加载超时、页面弹窗干扰、网络请求监听时机、下载任务卡死重试等难点。当前项目以循环逻辑为主,后续计划用def函数、class类对代码做重构优化(现上传是使用AI完成我交代的功能后并非本人手搓)。本项目仅作为个人编程技术学习练习使用(本人刚学2个月技术有限还是超级菜鸡)。




评论