抖音批量下载怎么做:douyin-downloader 完整上手指南
抖音批量下载怎么做douyin-downloader 完整上手指南【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader做抖音批量下载这件事手动一条条存太慢网上解析器画质又差还带水印。douyin-downloader 是个命令行工具专干抖音无水印下载和批量导出单个视频、图集、合集、音乐原声、作者主页、收藏夹都能下自带 SQLite 台账去重和浏览器兜底还可选 REST 服务模式和桌面端 Douzy内测中。下面按装好 → 日常跑 → 调优 → 排错的顺序把我踩过的坑一次讲清。装好一个能跑的抖音批量下载环境依赖三步走git clone https://gitcode.com/GitHub_Trending/do/douyin-downloader cd douyin-downloader pip install -r requirements.txt pip install playwright python -m playwright install chromium前两条装 Python 依赖最后一条装真实浏览器环境——浏览器兜底和自动抓 Cookie 都靠它。Cookie 用脚本自动抓Cookie 是调抖音接口的门票建议用自带脚本获取python -m tools.cookie_fetcher --config config.yml脚本会弹出一个浏览器让你登录登录完回终端按回车Cookie 就自动写进配置了脚本源码见 tools/cookie_fetcher.py。懒得装浏览器也行网页版抖音登录状态下从开发者工具里复制 Cookie 粘贴到配置里。Cookie 失效的表现是接口频繁报错重跑一次上面的脚本即可。最小配置一个文件跑起来link: - https://www.douyin.com/user/MS4wLjABAAAAxxxx path: ./Downloaded/ mode: [post] number: post: 20 thread: 5 retry_times: 3 database: truelink是要处理的链接mode决定下什么number是每个模式下限多少条0 表示不限thread是并发数。python run.py -c config.yml跑完之后Downloaded/下每个作品一个文件夹无水印视频、封面、原声音频、作者头像和一份 JSON 元数据标题、点赞数、作者等都在里面另有一份download_manifest.jsonl总清单。日常使用批量下载、去重与兜底三种批量模式怎么选mode: [post, like, mix] number: post: 50 # 博主作品 50 条 like: 0 # 博主点赞 0全部 mix: 20 # 博主合集 20 条post是作品列表like是博主自己点赞的内容mix是合集同一个作品在多个模式间出现时只下一次。收藏夹导出是独立入口link: - https://www.douyin.com/user/self?showTabfavorite_collection mode: [collect] number: collect: 0collect导出收藏夹里的视频collectmix导出收藏的合集。注意登录态 Cookie 只对自己账号有效且这两种模式必须单独跑不能和其他模式混在一个任务里。去重下载台账 本地文件双保险database: true时工具会在 SQLite 里记一本下载台账历史随时可查。日常更常用的是increase开关increase: post: true打开后本地目录里已有的文件会被直接跳过——同一个配置每周跑一遍只补新增内容不用手动对账。反过来删掉某个视频文件下次跑就会把这一条补回来因为台账里有、磁盘上没了会被判定为需要重试。翻页被风控时自动切浏览器API 翻页遇到风控时常见症状是只抓到二十条左右就停了。工具会自动降级弹出真实浏览器模拟滚动加载绕过后再接回 API 下载browser_fallback: enabled: true headless: falseheadless: false会保留浏览器窗口风控验证出现时你手动完成即可别急着关。目前这套兜底在post模式下最稳like/mix/music仍主要依赖 API 翻页这是已知边界。顺带提三个常用周边comments.enabled: true可给每条作品附一份评论 JSON可选含二级回复live.douyin.com/房间号支持直播录制实验功能中断时已录下的部分会保留视频下载完还能调转写 API 自动生成文字稿。这些配置项的完整说明见 README.zh-CN.md。进阶配置并发、时间窗与任务推送几个我常用的旋钮thread按网速调5~10 起步慢就降retry_times调到 5 能救回不少网络抖动导致的失败proxy可填代理地址应对 IP 受限start_time/end_time按日期框住抓取范围YYYY-MM-DD只想下某段时间的内容时很有用。长任务跑完不想守着的话可以配notifications推送支持 Bark、Telegram 和 Webhook企业微信/飞书/钉钉机器人地址直接可用失败时也会推一条方便定位是哪个作者出了问题。命令行侧两个轻量的采集手段python run.py --search 咖啡探店 --search-max 100 -p ./Downloaded python run.py --hot-board 30 -p ./Downloaded第一条按关键词搜视频、结果写成本地 JSONL 文件第二条抓热搜榜前 30 条都适合做选题和数据采集的前置步骤。另外加--serve --serve-port 8000可以把工具挂成 REST 服务供外部系统提交下载任务需先装 fastapi 和 uvicorn。常见问题与排错只下到二十条左右翻页风控截断了。确认browser_fallback.enabled: true且headless: false弹窗出现后手动完成验证再让它继续验证期间别关浏览器。只下了几十个文件夹/进度刷屏前者多为风控或 Cookie 问题先按上面两条处理后者加-v参数看详细日志或用progress.quiet_logs控制进度阶段的日志噪音。想强制重新下载判断依据是本地文件和数据库记录双重检查只删库不删文件不会触发重下。最简单的彻底重来rm -rf Downloaded/ dy_downloader.db删掉输出目录和台账下次运行等于全新开始只补个别条目就删对应作品文件夹即可。这套工具适合谁适合按作者、合集、收藏夹批量做无水印存档需要评论、元数据、直播录制等附加产出的研究者或运营习惯命令行、想放进定时任务里跑的人。 不适合希望全程无人值守、一次不弹验证就跑完全量的人风控弹窗时仍需人工介入打算把下载内容直接公开发布的商业用途——这类用途请先拿到版权方授权。 桌面端 Douzy 与它共用同一套后端目前内测稳定后命令行场景可以基本被替代。 最后提醒一句把它用在技术研究、学习和个人内容管理范围内遵守平台规则与版权要求内容归属和法律责任都由使用者自己承担。【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考