抖音批量下载实操教程:十分钟跑通第一次下载

发布时间:2026/9/15 11:29:36
抖音批量下载实操教程:十分钟跑通第一次下载 抖音批量下载实操教程十分钟跑通第一次下载【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader粘贴一个博主的主页链接douyin-downloader——一个开源的抖音无水印下载工具——会把它的作品成批拉到本地磁盘默认保存无水印视频封面、音乐、JSON 元数据、下载清单都能顺带落盘已下载过的作品自动跳过。整个抖音批量下载流程就是一个 YAML 配置文件加一条命令适合要备份素材的创作者、要采集样本的研究者以及想把某位博主作品留在本地的任何人。以下截图来自基于同一套后端的桌面客户端 Douzy内测中CLI 版在终端里用 Rich 进度条显示下载进度。这个项目是什么一个配置文件搞定抖音批量下载一句话说清它是把「填链接」当输入、把「成批落盘的文件和元数据」当输出的抖音内容批量下载工具。核心能力就四句多类型识别视频、图文、合集、音乐、收藏夹、直播、直播回放、短链等 9 类链接都能解析双重去重SQLite 数据库 本地文件名双重检查增量下载默认开启浏览器兜底API 翻页受限时自动降级到浏览器继续完整落盘视频、封面、音乐、头像、JSON 元数据、download_manifest.jsonl下载清单十分钟跑通第一次下载四步命令直接照抄即可。1安装依赖需要 Python 3.8克隆后装依赖清单git clone https://gitcode.com/GitHub_Trending/do/douyin-downloader cd douyin-downloader pip install -r requirements.txt2拿 CookieCookie 是浏览器的登录凭证抖音的接口基本不接待匿名请求所以第一步是拿到它。官方方式是用本地浏览器登录一次、自动抓取pip install playwright python -m playwright install chromium python -m tools.cookie_fetcher --config config.yml浏览器窗口弹出后登录抖音回终端按 Enter程序会把凭证写进配置文件。自动抓取失败的话从浏览器开发者工具里手动复制 Cookie 字符串贴进配置文件的cookies字段也行。3填配置先复制示例配置再改几个关键项cp config.example.yml config.ymllink: - https://www.douyin.com/user/MS4wLjABAAAAxxxx path: ./Downloaded/ mode: - post number: post: 50 thread: 5 retry_times: 3link是博主主页地址mode: post表示下载其发布的作品也可填 like/mix/musicnumber.post: 50表示本次抓 50 条0表示不限。4运行并看结果python run.py -c config.yml跑完在Downloaded/{作者}/post/{日期}_{标题}_{作品ID}/下按作品分目录存放每条作品一个视频文件另按开关附带封面、音乐、头像、JSON这几项默认关闭默认只存视频本体避免平白多出几倍文件。你能用它做成的五件事批量备份一位博主的全部作品想把某位博主的内容完整留在本地就把主页链接写进link把mode展开成多项一次下完mode: - post - like - mixpost 是发布作品、like 是点赞作品、mix 是合集跨模式同一个作品不会重复下载increase默认为 true之后重复运行同一配置只补新增不重拉旧内容。只下某个时间窗内的高清作品做专题分析时往往不要全量只想要最近三个月的。填start_time/end_timeYYYY-MM-DD格式圈出时间窗再配number控制条数start_time: 2026-01-01 end_time: 2026-06-30 video_quality: originalvideo_quality默认highest最高转码档改original会探测上传原片比最高转码档大则优先下原片代价是每条作品多一次探测请求也可以直接指定1080p、720p这类档位。把收藏夹整体导出本地收藏攒得多了怕丢可以按当前登录账号把收藏夹整体搬下来link: - https://www.douyin.com/user/self?showTabfavorite_collection mode: - collect两条限制要留意收藏夹模式只支持当前 Cookie 对应的账号且collect/collectmix必须单独使用不能和 post/like/mix/music 混写在同一个mode里。顺带采集评论数据做内容研究时评论区往往比视频本体还有用。打开comments后每条作品会在媒体文件旁多生成一个*_comments.jsoncomments: enabled: true include_replies: false # true 会多拉每条评论的二级回复 max_comments: 500 # 0 不限做话题检索还有两条命令行捷径不用写配置python run.py --search 关键词 --search-max 100 -p ./Downloaded和python run.py --hot-board 30 -p ./Downloaded结果都导出成 JSONL。 录制重要直播需要留档的直播把live.douyin.com房间链接贴进link即可FLV 可直接播放主播下播或你 CtrlC 中断时已录制的字节会保留.tmp 文件自动提升为正式文件并附带直播间元数据快照live: max_duration_seconds: 0 # 0 录到主播下播 idle_timeout_seconds: 30直播录制目前是实验性功能HLS 源只保存 playlist 文件需要用 ffmpeg 后处理。它凭什么稳批量任务不会下到一半就废批量下载最怕的就是中途崩掉、留下半截文件这个项目把对策写进了流程里双重去重。每条已下载作品记入 SQLite默认dy_downloader.db程序同时扫描本地文件名里的作品 ID。文件和记录都在就跳过文件缺失就补下——中断后重跑不重复、不遗漏。限速与重试。默认 2 请求/秒的速率限制、3 次重试、指数退避1s、2s、5s平台收紧时它是降速而不是崩溃失败的单条自动跳过不拖住整个批次。浏览器兜底。API 翻页被限制时典型症状是只能抓到 20 条browser_fallback默认开启会启动真实浏览器继续收集作品 ID 并补全详情headless: false留给人工过验证码的余地。注意这个兜底目前只对post模式做了完整验证。完整性校验。每个文件下载后按 Content-Length 比对不完整的自动清理并重试坏文件进不了库。代码按 cli/core/storage/control 等模块分层链接解析逻辑可以直接翻 core/url_parser.py架构细节见 PROJECT_SUMMARY.md。常用配置速查最常改的几项配置项作用默认值什么时候改mode下载模式post/like/mix/music/collect/collectmixpost下点赞、合集、音乐、收藏夹时number.post各模式数量上限0 为不限0想控制抓取量时start_time/end_time按发布时间过滤YYYY-MM-DD空不限只抓某段时间的作品video_quality画质original/highest/lowest 或指定分辨率highest要原片改original省流量改lowestthread并发下载数5弱网下失败多就调低到 3retry_times失败重试次数3网络不稳时调大proxyAPI 与媒体下载的 HTTP/HTTPS 代理空遇到 IP 限流时browser_fallback.headless浏览器兜底是否无头false需人工过验证码时保持 falsefilename_template文件/目录命名模板须含{id}{date}_{title}_{id}想按作者、分辨率等组织文件名时comments.enabled是否顺带采集评论false分析需要评论数据时完整清单看 config.example.yml每项都带中文注释。翻车现场自救指南挑最常见的四个翻车现场统一按「现象 → 原因 → 解法」说。现象每次抓取都停在 20 条作品。原因翻页触发风控。 解法确认browser_fallback.enabled: true、headless: false浏览器弹窗后手动完成验证别急着关窗口。现象下载集体失败或提示登录态异常。原因Cookie登录凭证过期了。 解法重跑python -m tools.cookie_fetcher --config config.yml。现象删了数据库重跑却还是跳过、没有新文件。原因去重是双通道——数据库记录不是唯一依据程序还会扫描本地文件名里的作品 ID。 解法本地文件和数据库记录要一起删重下单条作品删掉文件名含该作品 ID 的目录再对库执行DELETE FROM aweme WHERE aweme_id ...;。现象开了转写却没生成 txt/json。原因转写只对视频作品生效图文不会生成或 API key 没配好。 解法确认transcript.enabled: true、下载的是视频、OPENAI_API_KEY或transcript.api_key有效、response_formats包含txt或json。收尾仓库的免责声明写得很直白本项目仅用于技术研究、学习交流与个人数据管理不得用于侵犯他人隐私、版权或其他合法权益的用途大批量抓取时也保持默认的 2 请求/秒限速别刻意调高并发去试探平台。用出 bug 或有功能想法直接向项目仓库提 Issue会写代码的话PR 也欢迎核心逻辑都在 core/ 目录下结构不难读。【免费下载链接】douyin-downloaderA practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser fallback support. 抖音批量下载工具去水印支持视频、图集、合集、音乐(原声)。项目地址: https://gitcode.com/GitHub_Trending/do/douyin-downloader创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

关于本文作者

来自尧图内容编辑团队

尧图内容编辑团队 内容团队

尧图内容编辑团队

本文由尧图网络内容编辑团队执笔。团队由资深项目经理、前端工程师与设计师组成,所有内容均来自亲手交付的真实项目,先讲清问题、再给出可落地的解法。尧图深耕北京网站建设十年,服务过京华建材集团、智造科技等各行业客户,把一线经验沉淀为可复用的行业观察。

  • 十年建站经验,覆盖建材、制造、服务、文创等
  • 项目经理把关选题与事实准确性
  • 工程师与设计师联合撰写专业细节
  • 统一编辑规范,保证文风与排版一致
  • 每月复盘转化数据,迭代选题方向

延伸阅读

相关资讯与近期热门内容

深度阅读推荐

建站决策前值得细读的三篇

网站改版的5个关键决策
2024-08-12

网站改版的5个关键决策

什么时候该改版、改到什么程度、如何避免流量掉光,京华建材集团改版复盘给出答案。

获取专属建站方案

看完文章,把您的行业与预算告诉我们,免费获取一份量身定制的官网建设方案与报价。

立即免费咨询