手把手配置抖音批量下载:从去水印到增量归档一步到位
2026/9/17 19:15:34 网站建设 项目流程

手把手配置抖音批量下载:从去水印到增量归档一步到位

【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具,去水印,支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader

想备份某个作者主页的全部作品,却只能一条条手动保存?Douyin Downloader(douyin-downloader)是一款实用的抖音批量下载工具:粘贴一个主页或作品链接,无水印视频、图文、合集、音乐一次抓完,还带增量去重与元数据归档。

能力总览:这款抖音批量下载工具能做什么

六项核心能力一张表说清,日常用得上手两列就够了。

能力解决什么问题如何开启
主页批量下载不用逐个复制作品链接link填作者主页,modepost/like/mix/music
无水印 + 高清源存下最清晰的原片默认自动选无水印源;video_quality可设original探测原画
增量下载重复运行不重下,只取新作品increase.post: true(默认开)+database: true
浏览器兜底翻页被风控挡住只能拿 20 条browser_fallback.enabled: true,弹窗人工过验证
元数据归档保留发布日期、标题、JSON、评论、转写json: truecomments.enabled: truetranscript.enabled: true
下载历史可查追得回何时下过什么、存在哪database: true,SQLite 自动记录

参数细节可查仓库里的 中文 README 和带完整注释的 config.example.yml。

📥 三分钟上手:装好、登录、跑完第一次下载

三步:装依赖、拿 Cookie、运行。

第 1 步:装。需要 Python 3.8+,Windows / macOS / Linux 均可:

git clone https://gitcode.com/GitHub_Trending/do/douyin-downloader cd douyin-downloader pip install -r requirements.txt cp config.example.yml config.yml

第 2 步:Cookie 登录设置。推荐自动获取:运行python -m tools.cookie_fetcher --config config.yml,程序会打开浏览器,登录抖音后回终端按 Enter,Cookie 就自动写进配置;已有 Cookie 则手动填进config.ymlcookies字段。想用浏览器兜底的话,先执行pip install playwrightpython -m playwright install chromium

第 3 步:跑首次下载。把作者主页链接写进配置的link,然后:

python -m tools.cookie_fetcher --config config.yml python run.py -c config.yml

作品默认按Downloaded/作者名/post/落盘,文件名带发布日期 + 标题 + 作品 ID,目录结构清晰可查。

⚙️ 功能深潜:增量下载、风控兜底、元数据归档怎么配

这三项是它区别于普通链接解析工具的地方。

1. 增量下载:第二次运行只取新作品

干什么:核对本地文件与数据库记录,跳过已下载作品,缺失的自动补下。

怎么开increase.post: true(默认开启)+database: true;磁盘文件缺失时由redownload_missing_files: true决定是否重下。

效果:同一份配置反复跑不重不漏,直接挂成每周定时任务。

2. 浏览器兜底:翻页被风控卡住时自动开浏览器抓

干什么:API 分页被拦截(典型症状“只抓到 20 条”)时,自动启动浏览器滚动采集,并支持人工过验证码。

怎么开browser_fallback.enabled: trueheadless: false(显示窗口便于手动验证);失败重试retry_times: 3、限速rate_limit: 2均为默认值。

效果:大批量抓单个作者主页时,不再卡在第一页。

3. 元数据归档:每个作品一套可追溯数据

干什么:每个作品落一份完整文件,同时生成download_manifest.jsonl清单和 SQLiteaweme表,记录标题、发布时间、路径、任务计数。

怎么开folderstyle: true(默认)为每作品建独立子目录;json: true存原始元数据,comments.enabled: true抓评论 JSON,transcript.enabled: true做语音转写(仅视频作品,需OPENAI_API_KEY)。

效果:素材库不是一堆视频,而能按标题、作者用 SQL 检索,下载历史随时可查。

实战场景:三类人的配置模板

对号入座即可,配置都是现成字段。

场景一:自媒体 / 竞品追踪,持续建素材库

  • link写多个作者主页,modepostincrease.post: true开增量
  • number.post限制条数,0 为不限;thread调并发
  • 效果:每周跑一次只下新作品,素材库持续生长不膨胀。

场景二:普通用户,个人收藏夹备份

  • link/user/self?showTab=favorite_collectionmodecollect(必须单独使用,不能与 post 等混用)
  • cover: true顺带存封面
  • 效果:收藏夹整库落到本地,线上内容变了也有底档。

场景三:内容研究者,视频 + 评论 + 转写全归档

  • comments.enabled: true并设max_comments上限,transcript.enabled: true做语音转写
  • start_time/end_time圈定时间范围(格式YYYY-MM-DD
  • 效果:每个作品变成视频 + 评论 JSON + 转写文本的完整档案,可直接进分析流程。

⚠️ 避坑手册:四个常见错误与修复

坑大多集中在风控、Cookie 和重下规则上。

报错现象原因解决办法
主页只下到约 20 条就停翻页触发风控确认browser_fallback.enabled: trueheadless: false,弹窗里手动完成验证,别提前关窗口
认证失败、作品拉不到Cookie 过期重跑python -m tools.cookie_fetcher --config config.yml重新登录
转写文件没生成没开启、作品是图文(图文不转写)或密钥缺失确认transcript.enabled: true,配好OPENAI_API_KEYresponse_formatstxt
想重下却不触发双重检查规则:只删库不生效、只删文件才生效同时删本地作品文件夹与数据库记录,方法见 README 的“重新下载”一节
文件重名互相覆盖命名模板缺{id}filename_template保持{date}_{title}_{id}{id}保唯一

收尾

Douyin Downloader 把“一条条收藏”变成“批量归档”,素材库从此可增量、可检索、可追溯。本工具仅限个人学习、研究、备份用途使用,请尊重创作者权益。

【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具,去水印,支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询