抖音视频批量下载工具 douyin-downloader 完整上手指南:去水印、批量抓取、增量更新一次搞定

📅 2026/8/17 21:36:02
抖音视频批量下载工具 douyin-downloader 完整上手指南:去水印、批量抓取、增量更新一次搞定
抖音视频批量下载工具 douyin-downloader 完整上手指南去水印、批量抓取、增量更新一次搞定【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader你是不是也遇到过这些糟心事刷到一条喜欢的视频想存下来结果带了一串水印画质还糊想收集某个博主的所有作品做素材库只能一条条手动下载点得手抽筋好不容易写了个爬虫脚本没过几天接口就失效白忙活一场如果这些场景让你感同身受那今天这个开源工具douyin-downloader值得你花五分钟了解一下。它是一个开箱即用的抖音批量下载工具支持去水印下载视频、图集、合集和音乐自带进度显示、失败重试、数据库去重和浏览器兜底哪怕你完全不懂代码也能轻松上手。这个工具到底能干什么一句话总结粘贴一个抖音链接剩下的交给它。它支持的内容类型相当全面单个作品视频、图文笔记、合集、音乐原声直接贴链接就能下博主主页一键下载某个作者发布过的全部作品点赞列表下载博主公开点赞过的内容合集与音乐整本合集、某首原声下的所有视频直播支持实时录制直播间FLV/HLS 流也能下载直播回放下载下来的不只是视频本体封面图、背景音乐、作者头像、原始 JSON 元数据都会一并保存方便你后期整理归档。3 步跑通你的第一次下载整个上手过程比想象中简单不需要理解任何底层原理跟着做就行。第一步克隆项目并安装依赖先在终端里执行git clone https://gitcode.com/GitHub_Trending/do/douyin-downloader cd douyin-downloader pip install -r requirements.txt如果要使用自动获取 Cookie 的功能还需要安装浏览器驱动用于模拟浏览器登录pip install playwright playwright install第二步准备 CookieCookie 相当于你进入抖音的通行证。工具提供了两种方式方式一自动获取推荐python tools/cookie_fetcher.py --config config.yml运行后会自动打开浏览器你扫码登录抖音工具自动提取并保存所需的 Cookie 信息全程不用手动复制粘贴。方式二手动配置如果自动获取失败可以登录抖音网页版按 F12 打开开发者工具从网络请求里复制 Cookie 字符串粘贴到config.yml的cookies字段中。第三步写配置文件并运行新建一个config.yml这是最基础的配置link: - https://www.douyin.com/user/MS4wLjABAAAAxxxx # 博主主页链接可写多个 path: ./Downloaded/ # 下载保存目录 mode: - post # post发布作品like点赞mix合集music音乐 number: post: 50 # 最多下载 50 个作品0 表示不限 thread: 5 # 并发线程数网速好可以调大 retry_times: 3 # 下载失败重试次数 database: true # 开启数据库去重然后运行python run.py -c config.yml看到上面的界面说明你已经跑通了整个流程。工具会自动识别链接类型、拉取作品列表、并发下载最后给你一份统计总结。进阶玩法让工具更懂你的需求基础版能跑通之后下面的配置能帮你把工具打磨得更顺手。1. 文件命名与目录整理默认情况下每个作品会生成独立文件夹里面放着视频、封面、音乐、头像和 JSON 元数据长这样Downloaded/ └── 作者昵称/ └── post/ └── 2024-02-07_作品标题_aweme_id/ ├── 2024-02-07_作品标题_aweme_id.mp4 ├── 2024-02-07_作品标题_aweme_id_cover.jpg ├── 2024-02-07_作品标题_aweme_id_music.mp3 └── 2024-02-07_作品标题_aweme_id_data.json命名规则可以完全自定义filename_template: {date}_{title}_{id} # 文件名模板 folder_template: {date}_{title}_{id} # 文件夹模板 author_dir: nickname # 作者目录nickname / sec_uid / nickname_uid folderstyle: true # 按作品建子文件夹可用变量有{id} {title} {author} {author_id} {date} {year} {month} {day}等注意模板里至少要包含{id}避免文件名重复互相覆盖。date默认取作品发布时间而不是下载时间方便你按发布时间归档。2. 增量下载只抓新的不碰旧的配合 SQLite 数据库工具会自动记录下载历史。开启增量模式后重复运行同一个任务只会下载新增作品increase: post: true # 发布作品增量 like: true # 点赞作品增量 mix: true # 合集增量 music: true # 音乐增量这对需要定期同步博主内容的场景特别实用——不用每次全量重下省时间也省流量。3. 浏览器兜底翻页被风控时的救星抖音对翻页请求有风控很多人只抓 20 条作品就停了。工具内置的浏览器兜底策略可以缓解这个问题当 API 接口翻页受限时自动切换到模拟浏览器滚动采集拿到完整的作品 ID 列表后再通过详情接口逐个补全数据。browser_fallback: enabled: true # 开启兜底 headless: false # 建议关闭无头模式 max_scrolls: 240 # 最大滚动次数 wait_timeout_seconds: 600遇到风控弹窗时如果headless设为false浏览器窗口会弹出来你需要手动完成验证比如滑块不要立刻关掉窗口等它跑完就行。4. 视频转文字给素材自动生成文稿如果你需要给视频写摘要或做内容检索可以开启转写功能用 OpenAI 的 Whisper 模型把视频音频转成文本transcript: enabled: true model: gpt-4o-mini-transcribe response_formats: - txt - json api_key_env: OPENAI_API_KEY5. 评论采集与直播录制想研究作品的互动情况可以开启评论采集每个作品会额外生成一份*_comments.jsoncomments: enabled: true include_replies: false max_comments: 500录制直播也很简单把链接换成直播间地址即可link: - https://live.douyin.com/123456789 live: max_duration_seconds: 3600 # 最大录制 1 小时0 表示录到主播下播 chunk_size: 65536 idle_timeout_seconds: 306. 下载完成通知下载任务比较久的时候可以配置通知让工具在完成或失败时主动告诉你。支持 Bark、Telegram 和企业微信 Webhooknotifications: enabled: true on_success: true on_failure: true providers: - type: bark url: https://api.day.app/YOUR_DEVICE_KEY sound: bell三个真实应用场景场景一自媒体团队的竞品素材库假设你的团队每天要盯 10 个同行的账号整理他们发布的新视频用于内容分析。传统做法是专人每天手动翻主页、逐条下载一天至少耗 2 个小时。用 douyin-downloader 的配置思路link: - https://www.douyin.com/user/账号A - https://www.douyin.com/user/账号B # ... 更多账号 mode: - post increase: post: true # 只抓新发布的配合数据库去重 thread: 6每天定时跑一次配合 crontab 或任务计划程序几分钟就能拿到全部新增素材人力成本基本降到零。场景二研究人员的短视频样本采集社会学或传播学的研究经常需要按关键词批量采集样本。工具支持搜索和热搜榜功能python run.py --search 猫咪 --search-max 100 -p ./研究数据/ python run.py --hot-board 30 -p ./研究数据/还可以用时间范围过滤只收集指定时间段内的作品start_time: 2024-01-01 end_time: 2024-12-31采集完成后download_manifest.jsonl清单文件里记录了每个作品的发布日期、作者、标题、标签、文件路径等结构化信息直接导入 Excel 或分析软件就能做交叉统计。场景三培训机构的案例资料库教育机构想沉淀 1000 条教学短视频按学科分类存放。做法是配置多个教育类博主的链接开启按作者建目录link: - https://www.douyin.com/user/数学老师 - https://www.douyin.com/user/语文老师 mode: - post - mix # 连合集一起下 author_dir: nickname_uid # 昵称加ID防止改名后目录分裂 filename_template: {date}_{title}_{id}资料库建成后还可以开启转写功能给每节课生成文字稿方便老师按关键词检索教学片段。桌面版 Douzy不想敲命令就用它如果你对命令行完全不感冒项目还附带了一个桌面客户端 Douzy把上述功能搬进了图形界面粘贴即下载把链接粘进输入框点检测就能识别链接类型可视化任务中心每个任务的进度、状态、耗时一目了然作品档案SQLite 数据库管理下载历史支持多维度筛选桌面版目前还在内测阶段界面和功能会持续迭代适合不熟悉命令行的普通用户。常见问题排查下载速度慢怎么办先降低thread并发数试试5 左右比较稳妥再检查网络是否稳定。如果遇到 IP 被限流可以配置代理proxy: http://127.0.0.1:7890Cookie 失效了工具会自动检测登录态失效时提示重新登录。你也可以手动重跑一次 Cookie 获取命令python tools/cookie_fetcher.py --config config.yml个别视频下载失败常见原因有视频被删除、设为私密、网络中断或接口限流。工具会自动跳过失败项继续下载不会中断整个任务。想看详细日志就加--verbose参数。只能抓到 20 条作品这是翻页风控的典型表现。确认browser_fallback.enabled是true、headless是false风控弹窗出现后手动完成验证再放它继续跑。使用前必读合规提醒douyin-downloader 的设计初衷是辅助个人学习、研究分析、非商业性内容整理等合法场景。请务必注意只下载自己有权使用的内容下载后注明来源不要用于商业性分发、二次传播或恶意竞争不要大规模高频抓取干扰平台正常服务尊重内容创作者的版权和平台的用户协议工具内置了频率控制机制请求间隔、并发上限、每日配额这也是对平台规则的基本尊重。技术本身是中立的关键看怎么用。总结与下一步把 douyin-downloader 的核心价值浓缩成一句话一次配置持续自动。从去水印下载到数据库去重从浏览器兜底到增量更新它把手动下载视频这件琐碎事变成了一条可重复、可自动化、可管理的流水线。接下来你可以按这个节奏动手克隆项目跑通第一个视频的下载把config.yml调成适合自己场景的参数试用增量下载、浏览器兜底等进阶功能需要图形界面就试试桌面版 Douzy遇到问题就查看日志、调整参数多在社区里交流使用经验。希望这个工具能帮你把时间花在更有价值的事情上。【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考