精通电商、招聘、房产等公开网站数据采集,擅长动态页面抓取与数据清洗,高效交付结构化数据。
点击空白处退出提示
精通电商、招聘、房产等公开网站数据采集,擅长动态页面抓取与数据清洗,高效交付结构化数据。
基于Scrapy框架与Playwright自动化引擎,实现动态网页数据抓取、登录态维持及反爬策略应对。擅长电商、招聘、房产等公开数据采集,完成数据清洗、结构化导出,确保高效稳定交付。
使用异步爬虫获取豆瓣电影排行榜的电影名称和评分信息(1-10页),其网址为:https://movie.douban.com/top250
爬取猫眼电影今日票房(今日大盘-->查看更多里面)的数据【综合票房:影片,综合票房,票房占比,排片场次】四个数据
目标url:https://www.maoyan.com/
①.获取当页的类利用python爬取猫眼电影今日票房(今日大盘-->查看更多里面)的数据【综合票房:影片,综合票房,票房占比,排片场次】四个数据
②.实时爬取综合票房中的 影片、综合票房、票房占比、排片场次四个数据【获取当前调用的实时数据】
③.将获取到的数据写入Excel表格中或者数据库中保存
使用所学爬虫技术爬取某政策大数据平台(最少10页)
①.获取文章标题、内容、发布机构、技术领域、以及发布时间
②.可自定义标题搜索,例如:人工智能
③.数据存储到excel表格里面或者入库
目标url:https://www.spolicy.com/



评论