
抖音批量下载工具指南3步跑通无水印视频与主页【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloaderdouyin-downloader 是一个开源的抖音批量下载工具支持视频、图文、合集、音乐、直播和整个作者主页的无水印下载带进度展示、失败重试、SQLite 去重和浏览器兜底。适合需要批量收集素材的内容创作者、做数据采集的研究者以及想把它集成进自己工作流的开发者。能力全景先看适不适合你维度覆盖内容内容类型短视频、图文/图集、合集、音乐原声、直播录制、作者主页批量、收藏夹核心能力无水印优先、最高码率自动挑选、并发下载、指数退避重试、数据库文件双重去重、增量下载、浏览器兜底、完整性校验数据产出视频文件 封面/音乐/头像/JSON 元数据、评论 JSON、搜索与热搜 JSONL、下载清单 manifest运行形态命令行 YAML 配置、REST API 服务模式--serve、Docker典型场景竞品账号作品归档、话题样本采集、评论数据获取、直播存档、个人收藏备份不想看命令行的话它还有一个桌面客户端 Douzy内测中粘贴链接直接下载任务中心可视化跟踪进度最短路径上手全程三件事装依赖、拿 Cookie、跑一条命令。git clone https://gitcode.com/GitHub_Trending/do/douyin-downloader cd douyin-downloader pip install -r requirements.txt然后复制config.example.yml为config.yml自动获取 Cookie会打开浏览器登录抖音后回终端按 Enter自动写回配置python -m tools.cookie_fetcher --config config.yml最小可运行配置一个作者主页前 50 条作品link: - https://www.douyin.com/user/MS4wLjABAAAAxxxx path: ./Downloaded/ mode: - post number: post: 50 thread: 5 retry_times: 3 database: true运行python run.py -c config.yml看到进度条走完、Downloaded/作者名/post/下出现按日期_标题_ID命名的文件夹就算跑通了。能力拆解从链接到二次利用拿到链接。把链接丢进link即可工具自动识别 9 种链接形态单视频/video/、图文/note/或/gallery/、合集/collection/、音乐/music/、用户主页/user/、当前账号收藏夹/user/self?showTabfavorite_collection以及v.douyin.com短链含裸 host。短链不用手动还原。下载过程。默认 5 并发、2 请求/秒限速、失败按 1s/2s/5s 指数退避重试。视频源自动选无水印版本并从bit_rate档位里挑最高码率下载后按 Content-Length 校验不完整会自动清理重试。关键场景是翻页被风控卡住时browser_fallback默认开启且非 headless会弹真实浏览器让你手动过一次验证避免只能抓到 20 条。文件落地。默认目录结构按作者/模式/日期_标题_ID三层组织每个作品一个子目录内含视频本体cover、music、json、avatar默认关闭按需开启默认全开会多出几倍文件。开启database: true后SQLite 记录下载历史再次运行同一配置自动跳过已下载内容increase控制各模式是否只拉新增作品适合定时任务。Downloaded/ ├── download_manifest.jsonl └── 作者名/ └── post/ └── 2024-02-07_作品标题_aweme_id/ ├── ...mp4 / _cover.jpg / _music.mp3 / _data.json二次利用。这是批量下载比单条下载值钱的地方评论采集comments.enabled: true每个作品旁生成*_comments.jsoninclude_replies: true可带二级回复请求量翻倍按需开数据导出python run.py --search 关键词 --search-max 100或--hot-board 30直接落 JSONL不下载媒体只要元数据视频转写transcript.enabled: trueOPENAI_API_KEY视频旁生成transcript.txt/json集成到系统python run.py --serve起 REST APIPOST /api/v1/download提交链接、GET /api/v1/jobs/{job_id}查状态桌面版同样基于这套后端任务中心里可以直接看成功/失败统计、重试失败项、一键打开输出目录进阶调优大流量并发thread调到 8 左右、retry_times: 5、timeout放宽带宽紧张时反而降并发更稳。定期追更增量模式配 crontab每天只拉新作品0 2 * * * cd /path/to/douyin-downloader python run.py -c config.yml download.log 21预期效果第二天早上Downloaded/里只有新增作品已下载的秒级跳过。画质与流量二选一video_quality支持original探测上传原片可能比最高转码档大数倍每条多一次探测请求、highest默认、1080p/720p等定档。要素材存档选 original只要可播选 highest。代理与推送proxy: http://127.0.0.1:7890对 API 和媒体下载同时生效notifications支持 Bark/Telegram/Webhook下载完成推手机长任务不用盯终端。时间窗过滤start_time/end_timeYYYY-MM-DD直接限定作品发布时间范围采集特定时间段样本时不用自己筛。避坑速查问题常见原因解法主页只能抓到 20 条翻页触发风控browser_fallback.enabled: true且headless: false弹窗出现后手动过验证别急着关窗口Cookie 失效登录态过期重跑python -m tools.cookie_fetcher --config config.yml想重下某作品但被跳过数据库和本地文件双重去重文件目录和dy_downloader.db里的记录要一起删单删一边不生效终端日志刷屏进度阶段日志未静默progress.quiet_logs: true调试时再加-v部分作品失败作品被删/设私密、网络中断工具自动跳过继续用-v看日志定位或加retry_times收藏夹模式注意两条硬限制collect/collectmix只能下载当前登录 Cookie 对应账号的收藏且必须单独使用不能和post/like等混在一个mode里。使用边界个人学习研究、非商业内容分析、学术数据采集、个人数据管理是合理用途商业性分发、侵权二次传播、大规模爬取干扰平台服务不在范围内。工具内置限速默认 2 请求/秒保持默认并发和间隔别为了快把参数拉满。行动清单克隆仓库装好依赖和config.example.yml跑通一个单视频链接用cookie_fetcher自动写入 Cookie替换成你的作者主页链接批量拉 50 条打开database: true和increase配一条 crontab 验证增量追更需要元数据的话开启json和comments把 JSONL/JSON 接到你的分析流程里第一次跑之前先读一遍 README.zh-CN.md 的限制说明浏览器兜底目前只覆盖post模式这一点会影响你对 like/mix 模式的预期。【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考