3 步整理无水印视频:抖音批量下载工具上手
【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具,去水印,支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader
逐个点开视频、等加载、手动保存,存完还得满硬盘找文件,手工存档的痛谁懂。Douyin Downloader 是一个 Python 写的抖音批量下载工具,贴一条主页链接就能把作品、喜欢、合集连同素材一起抓下来。
能帮你做什么
你只需贴一条竞品作者的主页链接,配好mode: post和条数,就能批量拉取他最新的无水印视频——每个作品单独建文件夹,视频、封面、BGM、metadata.json一应俱全,按作者昵称加 ID 归档,直接进你的素材库。
你只需在配置里加一行start_time: "2024-01-01"这样的时间过滤,就能只拉 2024 年之后的作品;再打开increase增量模式,第二次运行只抓新发布的,老内容不会重复下载。
此外还能开着comments把每条评论(可含二级回复)采成 JSON,配合--search关键词搜索和--hot-board热搜榜导出,话题研究可以直接落成结构化数据。如果你不想敲命令,仓库同源的 Douzy 桌面版把关注列表同步也做成了可视化操作:
上手三步
第一步,克隆并装依赖,Python 3.8+ 即可:
git clone https://gitcode.com/GitHub_Trending/do/douyin-downloader cd douyin-downloader pip install -r requirements.txt第二步,把config.yml精简到这几行:
link: - https://www.douyin.com/user/MS4wLjABAAAAxxxx path: ./Downloaded/ mode: - post number: post: 50 thread: 5第三步,跑起来:
python run.py -c config.yml如果提示需要登录,先执行 Cookie 自动获取,浏览器里登录后回终端按 Enter 即可写入配置:
python -m tools.cookie_fetcher --config config.yml⚡ 从贴链接到看到文件落盘,全程不超过五分钟。
核心机制白话拆解
去重:每条作品入队前,它先查 SQLite 下载账本(一个记录已抓 aweme_id 的本地库),再看本地文件在不在。两者命中任一就跳过,没命中才下载并记账。这就是重跑不重复、increase增量必须开database: true的原因。
限流与重试:所有 API 请求先过限速闸(默认 2 请求/秒,防 IP 被封);失败按 1s → 2s → 5s 指数退避重试;写文件时再比对 Content-Length,字节数对不上就删掉残文件重来,所以目录里不会出现半截的 mp4。
浏览器兜底:API 翻页被限制时(典型症状是只拉到 20 条),它自动弹出一个浏览器窗口,你人工过掉验证码,浏览器接着自动滚动页面收集作品 ID,然后程序无缝继续下载。
配置怎么选
| 配置项 | 轻量 | 标准 | 全量 |
|---|---|---|---|
thread | 2 | 5 | 5 |
database | false | true | true |
music/cover/avatar | false | true | true |
comments | 关 | enabled(max 500) | enabled + replies |
| 时间过滤 / 增量 | 不配 | start_time | start_time+increase |
轻量档:只关心视频本体,带宽和磁盘都紧,别下封面、音乐和头像。
标准档:日常竞品素材收集,数据库去重加分目录归档,资源一次拉全。
全量档:配合定时任务做自动化素材管理,评论入库、增量更新,让本地库长期保鲜。
并发数设几个合适?多数人 3~5 就够,线程再大容易触发平台限制,反而更慢。
踩坑速查
只拉到 20 条作品现象:主页抓取总是停在 20 条。 原因:抖音的反爬机制限制了 API 翻页深度。 解决:开browser_fallback.enabled: true且headless: false,浏览器弹出后手动过验证,程序会自动滚页收集。
Cookie 频繁失效现象:昨天还能跑,今天就 403 或返回空数据。 原因:抖音会定期轮换 Cookie 校验机制。 解决:重跑python -m tools.cookie_fetcher --config config.yml更新;长期任务建议配合proxy分摊账号压力。
速度慢、失败多现象:进度条爬得慢,失败任务不断出现。 原因:线程数偏大触发了限流。 解决:把thread降到 3~5,还不稳就配代理,或挑网络空闲时段跑。
失败集中时先看任务中心(Douzy 桌面版)能定位到具体哪条链接挂了,再对症重试。
写在最后
单视频、主页批量、合集、音乐、直播录制、REST API 服务模式这条主链路它都覆盖了,代码按 core / control / storage 三层组织,想深挖某个机制也好定位。完整配置项参考和场景示例见仓库里的 README.zh-CN.md,另有 Dockerfile 可直接容器化部署。
【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具,去水印,支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考