抖音个人账号喜欢&收藏视频批量抓取工具开源项目

我要开发同款
广义开发2026年08月25日
7阅读

技术信息

语言技术
Python
系统类型
Web
行业分类
开发工具内容平台
开源地址
https://github.com/K-bot-bug/douyin-scraper
授权协议
MIT许可

功能介绍

1. 项目有哪些具体功能模块:
① 自动化登录模块:基于 Playwright 启动真实 Chromium 浏览器,读取 douyin_state.json 本地缓存的登录态,首次运行需在浏览器中手动登录,之后免登录复用 Cookie,支持密码登录和扫码登录两种方式。
② 反检测模块:集成 playwright-stealth 库,修改 navigator.webdriver 等自动化特征指纹,模拟真实 Chrome 浏览器行为,有效规避抖音平台的自动化检测。
③ 双 Tab 数据抓取模块:自动依次导航到「喜欢」和「收藏」两个 Tab 页面,通过监听网络响应接口(aweme/feed API)实时收集视频数据,无需解析 DOM 页面元素。
④ 智能滚动加载模块:自动向下滚动页面触发分页加载,持续滚动直到连续 5 次高度无变化判定为加载完毕,最多滚动 100 次防止无限循环。
⑤ 数据导出模块:每个 Tab 的视频数据分别导出为 JSON(含完整字段)和 CSV(含常用字段)两份格式,便于后续分析或导入其他工具。

2. 项目的主要功能描述:
本项目解决个人用户无法批量导出抖音「喜欢」和「收藏」视频数据的痛点。用户只需配置一次账号密码,脚本即可全自动完成登录、翻页、数据抓取、结果导出全流程,相比手动逐个视频复制链接的方式,效率提升数十倍。输出数据包含视频标题、播放/点赞/评论/收藏/分享数、封面图、播放链接等关键字段,可直接用于个人内容回顾、数据分析、素材整理等场景。项目依赖简单(仅 Python 3 个库),代码结构清晰,适合作为 Playwright 自动化和网页数据采集的学习实践项目,完整体现了浏览器自动化、网络请求监听、数据清洗导出等多项核心技能。

示例图片

声明:本文仅代表作者观点,不代表本站立场。如果侵犯到您的合法权益,请联系我们删除侵权资源!如果遇到资源链接失效,请您通过评论或工单的方式通知管理员。未经允许,不得转载,本站所有资源文章禁止商业使用运营!
下载安装【程序员客栈】APP
实时对接需求、及时收发消息、丰富的开放项目需求、随时随地查看项目状态

评论