XHS-Downloader 3 步上手:小红书批量下载的自定义命名与归档实操指南
【免费下载链接】XHS-Downloader小红书(XiaoHongShu、RedNote)链接提取/作品采集工具项目地址: https://gitcode.com/gh_mirrors/xh/XHS-Downloader
用脚本攒了 300 条小红书笔记,打开下载文件夹,里面全是一串日期开头、谁发布的都看不出来的 heic 文件。XHS-Downloader 就是为这种小红书批量下载场景准备的:它能提取作品链接、解析下载地址、把图文视频文件落盘到本地,命名规则、归档方式、下载节奏全部可调。
能力速览
- 提取小红书作品链接与下载地址,图文、视频、动图都能下
- 自定义文件命名格式,支持发布时间、作者昵称、点赞数等十几个字段
- 按作者自动归档到独立文件夹,作者改昵称也会自动同步
- 剪贴板监听模式:浏览器里复制链接,文件自动开始下载
第一次运行:从终端到第一个文件
打开终端,进入项目目录。如果还没拿到代码,先克隆仓库:git clone https://gitcode.com/gh_mirrors/xh/XHS-Downloader
然后两条命令:
uv sync --no-dev uv run main.py你看到的是一个终端界面:顶部提示"请输入小红书图文/视频作品链接",下面一排按钮。把一个笔记链接粘进输入框(多个链接用空格隔开),点"下载作品文件"。几秒钟后,日志区逐行打印出每个文件"下载成功"。
打开项目目录下的Volume/Download,第一个文件已经躺在里面了。
配置文件Volume/settings.json首次运行后自动生成,后面要调的所有参数都在这个文件里。
命名规则:让文件自己"说话"
命名规则在配置文件的name_format这一行。默认值是发布时间 作者昵称 作品标题,为什么这么配?发布时间放最前,文件夹里按时间排序天然成立;作者昵称防止多个人的作品混在一起;标题兜底可读性。
支持的字段远不止这三个:作品标题、作品描述、作品标签、发布时间、最后更新时间、作者昵称、作者ID、作品ID、作品类型,还有点赞数量、收藏数量、评论数量、分享数量这类数据字段。字段之间用空格分隔。
三种典型方案:
| 方案 | 生成效果 | 适合谁 |
|---|---|---|
发布时间 作者昵称 作品标题(默认) | 20250619 美食家小明 夏日冰饮指南.jpg | 通用,按时间线管理 |
作品标题 点赞数量 收藏数量 | 夏日冰饮指南 1024 96.heic | 按热度筛选内容的人 |
配合author_archive开启作者归档 | Download/美食家小明/20250619 夏日冰饮指南.jpg | 追更固定创作者的人 |
第二种方案值得多说一句:把点赞数写进文件名,三个月后翻文件夹时不用点开文件就能回忆起"这条当时很火"。数据字段是它和纯文本命名器的差别。
批量下载的三种姿势
追更一个创作者:把author_archive设为true,每个作者的作品会自动存进以作者命名的独立文件夹。某个作者改昵称后,已下载文件的名称会被程序自动更新。配合mapping_data还能给作者起别名,比如把一长串昵称映射成"老王"。
挑着下:图文作品想只留第 1、3、5 张图?用命令行模式:
python main.py -u "作品链接" -i "1 3 5"TUI 输入框里也可以一次粘贴多个链接,空格分隔,程序只下载你给的那几条。
一次性拉一批:按M键开启剪贴板监听。之后只要你在浏览器里复制作品链接,程序就自动开始下载,不用回到终端。适合边刷边收集的场景。
下载不卡的 3 个旋钮
chunk,水管的粗细:控制每次从服务器拉取的数据块大小,默认 2MB。带宽好的机器调大一点,大文件完成得更快;网络一般就保持默认。
max_retry,断线后的自动重拨:请求失败时重试的最大次数,默认 5 次。手机热点、公司网络这种不稳定的环境,可以适当调大,多数抖动会被重试消化掉。
proxy,换一条线路走:设置代理后,所有请求都从代理出去。注意项目内置了请求延时机制防止频率过高,这是刻意为之,别为了快把重试和延时全关掉,容易触发风控。
改完这些参数,重启程序生效。TUI 界面里按S也能改常用项,保存配置即落盘。
踩坑速查
视频清晰度比网页上低?多半是没配 Cookie。网页版 Cookie 是非必需的,但不填的话视频只能拿到低分辨率文件。F12 打开开发者工具,在网络面板里找到请求头里的 Cookie 复制过来,填进配置的cookie字段。
同一作品第二次下载直接被跳过?这是download_record在起作用,它记住了已下载的作品 ID。想重新下,删掉下载记录数据库里对应的 ID 再来。
下载报"获取数据失败"?作品链接里带着日期信息,太久远的链接会被风控。重新进笔记页面复制一个新链接再试。
批量下载中途速度突然变慢?先确认全局代理工具没在捣乱——系统级代理有时会劫持请求导致失败。把全局代理关掉,只用配置里的proxy参数。
下一步可以做的事
如果你下载量稳定下来了,试试把 CLI 模式接进系统定时任务:每天凌晨拉一次关注的创作者,第二天早上文件已经就位。想更深度一点,项目里的example.py演示了如何用代码直接驱动整个下载流程,参数和配置文件一一对应,改成你自己的自动化脚本只是变量赋值的事。API 模式和 MCP 模式也内置好了,前者方便写服务端调用,后者可以直接接给 AI 助手用。
仓库地址:https://gitcode.com/gh_mirrors/xh/XHS-Downloader,建议从develop分支拉代码,有改动可以提 Pull Request 参与共建。
【免费下载链接】XHS-Downloader小红书(XiaoHongShu、RedNote)链接提取/作品采集工具项目地址: https://gitcode.com/gh_mirrors/xh/XHS-Downloader
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考