3 条命令搭好私有抖音视频素材库:主页、直播到评论的批量无水印下载指南
3 条命令搭好私有抖音视频素材库主页、直播到评论的批量无水印下载指南【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader你收藏过一批教程视频一个月后再也找不全官方 App 又只允许带水印保存。douyin-downloader 是一个抖音批量下载工具喂给它主页、合集或直播间链接它会自动挑选无水印源并发抓取把每个作品写进 SQLite 记录文件下次运行只增量同步新作品。这个工具能抓什么、强在哪内容类型触发方式本地产物用户主页作品/user/链接 post模式mp4、封面、原声、data.json合集 / 收藏夹/collection/链接按作品分目录原声音频/music/链接mp3直播live.douyin.com/{room_id}flv 房间元数据快照评论 / 搜索数据comments配置或--search参数*_comments.json、search/*.jsonl几条值得先知道的技术点自动挑最高清对比多路视频源的 bit_rate码率数组保存码率最高的那一路文件。并发加重试默认 5 路并发失败按 1s / 2s / 5s 间隔退避重试限流 2 请求/秒降低撞风控的概率。增量同步SQLite 下载记录与本地文件名里的 aweme_id作品唯一标识双重比对只捞新作品。浏览器兜底API 翻页被风控截断时自动弹出 Chromium 窗口手动过一遍验证码即可继续翻页。同一套后端还打包了桌面版 Douzy内测中定位是单个作品下载和可视化任务管理本仓库的 CLI 专注主页批量、直播录制和数据采集按需选择即可。从装依赖到跑通首次下载只需三步第 1 步拉代码装依赖Python 3.8 即可。复制出来的config.yml是之后所有配置的载体git clone https://gitcode.com/GitHub_Trending/do/douyin-downloader cd douyin-downloader pip install -r requirements.txt cp config.example.yml config.yml第 2 步扫码登录拿到 Cookie 首次使用最容易卡住的一步没有有效 Cookie 时作品列表往往只能翻到 20 条就停。用自带脚本扫码登录一次搞定pip install playwright python -m playwright install chromium python -m tools.cookie_fetcher --config config.yml扫码后回终端按 EnterCookie 会自动写回config.yml过期就重跑这条命令。第 3 步首次运行python run.py -c config.yml也可以不改文件临时追加链接与参数-u追加链接、-t并发数、-p下载目录。跑通后终端显示 Rich 进度条文件落在Downloaded/下。实战场景主页批量、直播存档、评论数据场景一把整个主页搬进本地素材库适合短视频创作者跟踪竞品更新link: - https://www.douyin.com/user/MS4wLjABAAAAxxxx mode: - post number: post: 50执行后文件按Downloaded/作者名/post/日期_标题_aweme_id/组织每个作品自带 mp4、封面、原声和 data.json点赞数、发布时间一并写进 JSON。场景二直播回放一键存档适合课程运营留存整场直播link: - https://live.douyin.com/123456789 live: max_duration_seconds: 00表示录到主播下播。已录字节保留为Downloaded/{作者}/live/下的 flv 文件旁边附*_room.json元数据快照HLS 源则保存 playlist需要时再用 ffmpeg开源音视频处理工具二次合成。场景三给作品批量收集评论数据适合数据分析师做舆情分析前先留原始料comments: enabled: true max_comments: 500配合python run.py --search 关键词 --search-max 100可先把关键词命中的作品清单导出到search/下的 jsonl 文件筛选后再决定下载哪批评论文件生成在媒体文件旁。参数调优与代码改造入口参数默认值说明thread5并发任务数家庭宽带 5~8 比较稳再高容易撞限流retry_times3重试次数配合 1s/2s/5s 退避rate_limit2每秒 API 请求数网络复杂时调低更保守proxy空代理地址API 请求与媒体流都走它browser_fallback.max_scrolls240翻页兜底的最大滚动轮数翻页浅就调大并保持headless: false方便手动过验证文件组织也可自定义path定根目录默认按「作者名/模式/日期_标题_aweme_id」三级归档关闭folderstyle可拍平。下载历史全在dy_downloader.db用sqlite3直接查。 代码模块化程度高改造入口明确core/user_modes/post / like / mix / music 四种下载模式用策略模式承载新增内容类型时加一个策略类并注册即可。auth/cookie_manager.py封装 Cookie 生命周期短链与主页链接解析在 core/url_parser.py。想对接前端或自动化流水线加--serve --serve-port 8000起 REST 服务见 server/app.pyPOST/api/v1/download提交任务、GET 查询状态。常见坑与对应解法 按症状对照基本能覆盖日常 90% 的问题症状原因修复作品只抓到 20 条就停API 翻页被风控截断开启browser_fallback.enabled: true浏览器窗口出现后手动过验证码单个链接报 403Blocked by ArgusSecurityPlugin抖音 2026-08 起对单条接口加了风控门禁非浏览器请求被拒主页作品改用 post 模式加浏览器兜底单个作品走桌面版 Douzy删了本地文件下次运行仍跳过数据库记录还在双重去重生效sqlite3 dy_downloader.db DELETE FROM aweme WHERE aweme_id aweme_id;列表抓空、下载全部失败config.yml里 Cookie 过期重跑python -m tools.cookie_fetcher --config config.yml现在就跑起来扫码跑通 cookie_fetcher拿到有效 Cookie。把想留存的主页链接填进config.yml。执行python run.py -c config.yml。完成后主页、直播、评论都会按「作者名/模式/日期_标题」自动归档点赞数与发布时间写进 JSON增量同步只捞新作品——那批教程视频不用录屏硬扛素材库从下一条视频开始自己长。【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考