news 2026/9/20 15:45:03

抖音无水印批量下载入门:3步跑通 douyin-downloader 的主页全量抓取

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
抖音无水印批量下载入门:3步跑通 douyin-downloader 的主页全量抓取

抖音无水印批量下载入门:3步跑通 douyin-downloader 的主页全量抓取

【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具,去水印,支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader

如果你保存抖音视频,到现在还停留在"截图带水印"的阶段,那你可能需要 douyin-downloader 了。这是一款主打抖音无水印批量下载的工具:粘一个作者主页链接,它会按顺序把作品抓下来,附带上封面、原声,还会自动跳过已经下载过的内容。下面是给新手的 3 步上手教程。

先说句实话:从 2026 年 8 月起,抖音风控分两次收紧,命令行能直连的接口被收窄了一部分,比如点赞、收藏夹、单个作品、合集、音乐,主页作品翻页也需要浏览器兜底才能取全。具体哪些能用、哪些受限,以仓库 README 的限制说明为准。但不影响主流程:主页作品、热搜、搜索、评论、直播这几块依然可用。

三步装好抖音无水印下载环境

1. 克隆仓库,装依赖

先确认本机有 Python 3.8 以上版本,然后克隆仓库并安装运行所需的依赖:

git clone https://gitcode.com/GitHub_Trending/do/douyin-downloader cd douyin-downloader pip install -r requirements.txt

浏览器兜底现在几乎是必选项,顺手把 playwright 也装上:

pip install playwright python -m playwright install chromium

2. 建配置文件,顺手拿 Cookie

把仓库里自带的配置模板复制成你自己的配置文件,所有默认值可以参考 config.example.yml:

cp config.example.yml config.yml

再运行内置的 Cookie 获取器。它会弹出一个浏览器,你手动登录一次抖音,登录完成回终端按 Enter,Cookie 就会自动写进配置文件:

python -m tools.cookie_fetcher --config config.yml

3. 跑第一个批量任务

config.yml里填上作者链接,然后一条命令启动:

python run.py -c config.yml

也可以不走配置文件,直接在命令行追加链接,用 8 个并发下载:

python run.py -u "https://www.douyin.com/user/MS4wLjABxxxx" -t 8 -p ./Downloaded

默认输出在Downloaded/作者名/post/下,按"日期_标题_作品ID"建目录,每个作品自带封面、原声和 JSON 元数据。同后端的桌面版 Douzy 提供了更直观的可视化操作(内测中,下面截图为演示数据):

挑 3 个高频场景实际跑一遍

场景一:把博主主页作品全量收下来

背景:想完整备份某个作者的作品,不想一条条手动复制链接。

关键配置:填作者主页链接,模式选post,数量设 0 表示不限量,并打开浏览器兜底:

link: - https://www.douyin.com/user/MS4wLjABxxxx mode: - post number: post: 0 thread: 8 browser_fallback: enabled: true headless: false

预期效果:程序分页抓取作品,按设置的并发下载。翻到风控卡点时会自动弹出浏览器窗口,你手动过一下验证,程序接着往下抓,不用从头重跑。

场景二:长期追更同一作者,只下载新作品

背景:想每周追更同一个博主,每次都全量跑一遍太浪费时间和空间。

关键配置:打开增量开关,配合 SQLite 数据库记录下载历史:

increase: post: true database: true

预期效果:第二次运行时只抓上次之后的新作品,已下载的内容通过"数据库记录 + 本地文件"双重去重直接跳过。几百个作品的账号,追更通常几分钟就能跑完。

场景三:导出热搜榜和关键词搜索结果

背景:不想要视频文件,只想要结构化数据做选题或分析。

关键配置:不用动配置文件,两条命令直接出结果:

python run.py --hot-board 30 -p ./Downloaded python run.py --search "猫咪日常" --search-max 100 -p ./Downloaded

预期效果:结果落到Downloaded/hot_board/Downloaded/search/下的 JSONL 文件,文件名带时间戳,直接喂给其他分析工具就能用。

桌面版还会同步收藏夹、喜欢列表等账号内容,可以整个合集一键下载(collect 模式的限制详见 README.zh-CN.md):

抖音批量下载常用配置速查

配置项作用适合谁
modepost作品 /like点赞 /mix合集 /music音乐 /collect收藏夹所有批量场景
number.*各模式数量上限,0 表示全量控制下载量
increase.*增量开关,只抓新作品长期追更
thread并发数,默认 5平衡速度与风控
start_time/end_timeYYYY-MM-DD时间过滤只收集某一时段作品
browser_fallback.*浏览器兜底,对付翻页风控主页全量收集
progress.quiet_logs进度阶段静默日志,避免刷屏在意终端体验
database/database_pathSQLite 去重与历史记录增量下载的前提
proxyAPI 请求与媒体下载的代理网络不稳定
comments.enabled按作品采集评论,可含二级回复观点与数据分析

5 个高频坑:现象、原因、解法

坑 1:只抓到 20 条左右的作品就停了原因:抖音翻页风控,限制了一次能翻的页数。 解决:把browser_fallback.enabled设为trueheadless设为false,浏览器弹窗出现后手动完成验证,别急着关窗口。

坑 2:请求直接 403,提示被 Argus 风控拦截原因:2026 年 8、9 月起抖音对部分直连接口加了门禁,换 Cookie、多次重试都没用。 解决:受影响的下载改走浏览器兜底或桌面版 Douzy,具体接口清单以 README 限制说明为准。

坑 3:Cookie 隔几天就失效原因:Cookie 会过期,风控也会刷新登录态。 解决:重新跑一次获取器:

python -m tools.cookie_fetcher --config config.yml

坑 4:想重下某个作品,却提示已跳过原因:去重是"数据库记录 + 本地文件"双重判断,一边有记录另一边就不会重下。 解决:删掉本地目录,同时清掉数据库记录:

rm -rf "Downloaded/作者名/post/"*_<作品ID>/ sqlite3 dy_downloader.db "DELETE FROM aweme WHERE aweme_id = '<作品ID>';"

坑 5:进度条和日志混在一起,满屏刷屏原因:各阶段日志同时输出。 解决:保持配置里的progress.quiet_logs: true;调试时再临时给命令行加-v看详细日志。

进阶能力:值得翻一翻的部分

前面三步跑顺之后,可以看看这些能力,每项在仓库里都有对应配置项:

  • 评论采集comments.enabled: true,可含二级回复,输出在作品旁的*_comments.json
  • 直播录制:支持live.douyin.com房间链接,主播下播或中断时已录数据会保留
  • 视频转写:调用 OpenAI Transcriptions API 自动产出 txt/json 字幕,仅对视频作品生效
  • REST API 服务模式python run.py --serve --serve-port 8000,把下载变成可被其他程序调用的 HTTP 接口
  • 完成通知:Bark / Telegram / Webhook 推送下载结果,适合挂机长任务
  • Docker 部署:仓库自带 Dockerfile

源码按模块组织,下载器、模式策略、去重逻辑都在 core/ 目录下,想搞懂浏览器兜底是怎么翻过风控的,那里是最直接的入口。

先把最省事的那份带走

这套工具把"手动复制链接、截图带水印、人工整理文件"变成了"粘链接、等完成"的背景任务:文件按作者自动归档,封面原声齐全,数据库记得你下载过的每一样东西。

你的下一步动作就一行命令:

python run.py -c config.yml

最后提醒一句:下载仅用于个人学习、研究和整理自己的数据,不要转传播或商用他人的原创内容,并遵守抖音的服务条款与平台风控规则。

【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具,去水印,支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/9/20 15:45:00

RapidOCR 快速上手指南:3 步装好开源 OCR 文字识别工具

RapidOCR 快速上手指南&#xff1a;3 步装好开源 OCR 文字识别工具 【免费下载链接】RapidOCR &#x1f4c4; Awesome OCR multiple programing languages toolkits based on ONNX Runtime, OpenVINO, MNN, PaddlePaddle, TensorRT and PyTorch. 项目地址: https://gitcode.c…

作者头像 李华
网站建设 2026/9/20 15:44:58

ONNX External Data 完全指南:加载、转换、校验与底层原理

人工智能深度学习机器学习 【免费下载链接】onnx Open standard for machine learning interoperability 项目地址&#xff1a; https://gitcode.com/gh_mirrors/onn/onnx 点击查看 免费下载 External Data 是 ONNX 标准中把张量数据从模型文件&#xff08;.onnx protobuf&…

作者头像 李华
网站建设 2026/9/20 15:44:53

前端2秒生成500页矢量PDF:Rust+WASM实战与性能优化

1. 这个标题到底在说什么先把标题拆开看。“前端2秒生成500页矢量PDF”&#xff0c;核心信息有三层&#xff1a;第一&#xff0c;动作发生在前端&#xff0c;不是后端渲染完再传给浏览器&#xff1b;第二&#xff0c;产物是矢量PDF&#xff0c;不是截图拼出来的位图&#xff1b…

作者头像 李华
网站建设 2026/9/20 15:44:51

移动端智慧商城H5项目复盘:从技术选型到性能优化实战

简介&#xff1a;面向移动端开发学习者的一份 Vue2 电商实战资源&#xff0c;以智慧商城为完整业务场景&#xff0c;覆盖组件化开发、响应式布局、接口封装与状态管理等多个核心议题&#xff0c;适合有一定前端基础、希望提升工程化能力的读者。资源压缩包约四十点八九兆&#…

作者头像 李华
网站建设 2026/9/20 15:44:36

中文网络安全运营语料库:构建、清洗与开源打包实践

简介&#xff1a;中文网络安全运营领域开源语料库是一份面向网络安全研究人员、一线运营工程师及高校学生的轻量级语料包&#xff0c;内容兼顾基础概念与高级防护策略&#xff0c;涵盖案例复盘、安全事件报告及策略规划等场景&#xff0c;既能帮助新手建立安全运营框架&#xf…

作者头像 李华
网站建设 2026/9/20 15:44:31

安全隐患识别实战:从彩图手册到现场排查的完整闭环

简介&#xff1a;这份《安全隐患识别&#xff08;彩图&#xff09;》PDF手册&#xff0c;面向企业安全管理人员、一线作业人员及安全培训讲师&#xff0c;聚焦生产现场常见违规操作与风险点&#xff0c;通过彩图标注方式直观展示叉车维修未锁定、起重吊钩保险损坏、登高作业未系…

作者头像 李华