news 2026/9/20 4:34:06

抖音批量下载怎么跑:无水印下载一份配置跑通主页备份与直播录制的完整指南

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
抖音批量下载怎么跑:无水印下载一份配置跑通主页备份与直播录制的完整指南

抖音批量下载怎么跑:无水印下载一份配置跑通主页备份与直播录制的完整指南

【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具,去水印,支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader

想把喜欢的抖音视频、图文、直播长期留下来?你需要一个默认无水印下载、自动跳过已存内容、断了能续跑的工具。douyin-downloader就是这样一个命令行抖音批量下载工具:给它一条链接和一份 YAML 配置,视频、封面、原声会自动归档进本地目录,去重与续跑的逻辑它替你处理。

对号入座:它到底能帮你存什么

你要存的东西入口(link + 配置)落到本地的产物
单条视频link/video/{aweme_id}无水印 mp4,可选封面、原声、JSON 元数据
图文笔记link/note/{note_id}按顺序归档的图片,原声一并保存
作者整个主页/user/{sec_uid}+mode按"作者 / 内容类型 / 单条作品"分层目录
自己的收藏夹与收藏合集/user/self?showTab=favorite_collection+collect/collectmix登录账号里收藏内容的本地副本
一整场直播live.douyin.com/{room_id}FLV 文件 + 房间信息 JSON
评论、热搜、关键词数据comments.enabled: true/--hot-board/--search*_comments.json、JSONL 文件

只想存几条视频?看到"跑通第一条"那节就可以停了;要建一个能长期挂着的本地档案库,重点读后面的旋钮、保障和排障几节。

把它装起来,先拿到登录态

环境要求只有 Python 3.8+,macOS、Linux、Windows 都能跑:

git clone https://gitcode.com/GitHub_Trending/do/douyin-downloader cd douyin-downloader pip install -r requirements.txt

成功信号:终端里没有红色报错行,就是环境就绪。

接下来拿登录态。抖音大量内容只对登录账号可见,Cookie 缺失时请求基本全军覆没,所以这步是跑通前最关键的一步。项目内置浏览器自动抓取脚本,不用手动从开发者工具里复制:

pip install playwright python -m playwright install chromium python -m tools.cookie_fetcher --config config.yml

浏览器窗口弹出后扫码登录,回到终端按 Enter,Cookie 会直接写进配置。

成功信号config.ymlcookies段下的msTokenttwid等字段不再是占位符。如果浏览器弹出后卡住,先确认playwright install chromium那步是否执行成功。脚本实现见 tools/cookie_fetcher.py。

跑通第一条无水印下载

cp config.example.yml config.yml

config.example.yml 里每个字段都带中文注释。打开config.yml,把link改成你想下的一条视频,确认cookies已填入:

link: - https://www.douyin.com/video/760412345678901234567 path: ./Downloaded/

然后启动:

python run.py -c config.yml

成功信号有两个:终端打印完成统计;Downloaded/下出现以作者名命名的目录,里面躺着无水印 mp4。

不想改文件也能临时覆盖配置:-u追加链接、-t调并发、-p换输出目录。

python run.py -c config.yml -u "https://www.douyin.com/video/760412345678901234567" -t 8

成功信号:跑完在作者目录下多出这条作品,速度体感不明显变慢。

三种最常用的下载姿势

主页备份

主页链接放进link,在mode里勾要抓的内容类型,number给每种模式设上限(0不限)。post / like / mix / music 可以混着一次跑完,跨模式自动去重:

link: - https://www.douyin.com/user/MS4wLjABAAAAxxxx mode: - post - mix number: post: 50 # 只抓 50 条作品 mix: 20

跑完后该博主的作品与合集会分别归档进作者/post/作者/mix/

成功信号:终端统计里各模式数量与number一致,本地目录结构完整。一个坑要先记住:collect/collectmix(收藏夹与收藏合集)必须单独使用,不能和上面四种模式混写,且只支持当前登录 Cookie 对应的账号。

整场直播录制

直播间链接直接写进link,程序自动拉流,不用开录屏软件:

link: - https://live.douyin.com/123456789 live: max_duration_seconds: 3600 # 0 = 录到主播下播

无论录满时长、主播下播还是你手动 Ctrl+C,已录字节都会保留,存为Downloaded/{作者}/live/下的 FLV,并附一份房间元数据 JSON。

成功信号live/目录下 FLV 文件大小随直播持续增大。官方把这个接口标为 experimental,极端直播场景可能有兼容问题,重要场次建议同时人工备份一份。

只导热搜或关键词数据

不做文件下载、只收数据时,两条命令搞定:

python run.py --hot-board 30 -p ./Downloaded python run.py --search "猫咪" --search-max 100 -p ./Downloaded

结果分别落在Downloaded/hot_board/Downloaded/search/下的 JSONL 文件,可以直接喂给 pandas 或 jq 做二次筛选。成功信号:对应目录出现新的.jsonl文件,条数符合上限设置。

桌面端 Douzy 基于同一套后端:粘贴链接即下载、同步关注、任务中心统一管理,目前内测中,截图可当功能参考:

配置旋钮逐个讲:拧了会发生什么

分层看,必填的只有三项:linkpathcookies。其余按需调。

常用层

旋钮默认拧了之后
mode[post]决定主页抓哪几类:作品 / 喜欢 / 合集 / 音乐
number.post见模板每种模式的数量上限,0不限
music/cover/avatar/jsonfalse是否顺带存原声、封面、头像、元数据
start_time/end_timeYYYY-MM-DD过滤发布时间,可分段抓
thread5并发数,网络稳可试 8
video_qualityhighesthighest取最高转码档;original额外探测原画

进阶层

  • database: true+database_path:每次下载写进 SQLite,下次运行自动跳过已下内容;
  • increase.post等:增量下载,磁盘上已存在的媒体直接跳过,删掉文件则下次重下;
  • browser_fallback:翻页被风控截断时自动开浏览器,headless: false时弹窗里可以手动过验证码;
  • retry_times+ 默认 2 请求/秒限速:失败按 1s/2s/5s 指数退避自动重试;
  • notifications:跑完推 Bark / Telegram / Webhook,适合挂机长任务;
  • transcript:调 OpenAI 把视频转写成 txt/json,图文笔记不生成转写。

挂一夜不翻车:三个必开的保障

批量任务跑几十分钟,最怕中途崩掉白跑,或者硬盘堆出重复文件。记住这组搭配:

  1. 去重双保险。database: true记历史 +increase按磁盘文件跳过。判断逻辑是"数据库记录 + 本地文件"双重检查:只删库不清文件不会触发重下,两者都清才会重新下载。想重下某条被跳过的作品,把本地文件夹和库中记录一起清掉,具体 sqlite3 命令参考 README.zh-CN.md 的"重新下载"一节。
  2. 重试兜底。retry_times: 3配上内置指数退避,网络抖动不会留下缺口;下载还有 Content-Length 完整性校验,残文件自动清理并重试。
  3. 并发循序渐进。thread从 5 起步,网络稳定再提到 8。一上来拉满容易触发风控,反而比慢一点更慢。

卡住了先查这张表

现象多半是先做什么
主页停在 20 条左右翻页触发风控确认browser_fallback.enabled: trueheadless: false,在弹窗里手动过验证码;或按start_time/end_time分段抓
请求突然大面积失败Cookie 过期重跑python -m tools.cookie_fetcher --config config.yml刷新登录态
硬盘里堆出重复文件没开数据库去重database: true,配合increase走增量
某条被跳过,想重下去重机制跳过了它删本地对应文件夹 + 删库中记录,再运行
进度输出很吵日志未静默progress.quiet_logs: true;排查时临时加-v--show-warnings
整体速度慢并发与重试偏保守thread提到 8、retry_times给 3,逐步上调

现在就跑起来的 5 步

  1. 先用单条视频链接验证 Cookie 和网络,再上主页批量;
  2. 测试期把number.post设成 1~5,跑通后再放开到 0;
  3. 不同任务分配置(config_test.ymlconfig_daily.yml),别共用一份;
  4. Cookie 失效是常态,把它当周期性维护项,而不是故障;
  5. 长任务加notifications推送,跑完手机就能收到。

本项目仅供技术学习与个人数据管理使用。请在合法合规的前提下使用,尊重内容版权与创作者权益。

【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具,去水印,支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/9/20 4:32:59

交通规划四阶段法标准答案的建模逻辑与参数校验方法

简介:本资源是交通规划课程配套的课后习题标准答案详解PDF,面向高校交通工程、城市规划及相关专业本科生与考研学生,用于巩固出行生成、OD分析、交通流量预测等核心知识点。文件共1个PDF(236KB),内容涵盖8道…

作者头像 李华
网站建设 2026/9/20 4:30:48

AI智能体工作台WorkBuddy:从任务编排到自动化实战

这两年 AI Agent 工具越来越多了,但我发现多数人还是把 AI 当聊天框用:问一句答一句,用完就关。直到我花了两周时间把 WorkBuddy 塞进真实工作流里,才意识到“对话式 AI”和“工作台型 Agent”的差别有多大。WorkBuddy 不是又一个…

作者头像 李华
网站建设 2026/9/20 4:30:19

RPA+AI Agent如何落地?科大讯飞AstronRPA架构与实战解析

什么时候你会开始觉得传统RPA不够用了?不是它跑不动,而是它只能按规则跑。页面换个按钮位置,它就死给你看;遇到一段语义模糊的客服留言,它只能整段抓下来,抽不出关键信息。这是我做自动化流程这几年最深的体…

作者头像 李华
网站建设 2026/9/20 4:29:33

Colibri:面向MoE模型的轻量级C语言推理调度引擎

1. Colibri不是蜂鸟,是前沿MoE推理引擎的代号最近在几个AI底层技术社区里频繁看到“colibri”这个词,它既不是生物学里的蜂鸟属(Colibri),也不是某个新出的UI框架或前端库——而是当前大模型推理领域一个正在快速演进的…

作者头像 李华
网站建设 2026/9/20 4:29:30

Langflow:拖拽式构建AI工作流的低代码平台实战指南

最近一直在折腾本地 AI 应用,最头疼的不是模型本身,而是这些模型怎么串起来。写个文档问答机器人,先要装 LangChain、处理文本切分、对接向量库、设计 prompt 模板,换一个模型又得调半天代码。直到有一天我打开了一个叫 Langflow …

作者头像 李华