news 2026/8/22 18:52:04

XHS-Downloader 3 步上手:小红书批量下载的自定义命名与归档实操指南

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
XHS-Downloader 3 步上手:小红书批量下载的自定义命名与归档实操指南

XHS-Downloader 3 步上手:小红书批量下载的自定义命名与归档实操指南

【免费下载链接】XHS-Downloader小红书(XiaoHongShu、RedNote)链接提取/作品采集工具项目地址: https://gitcode.com/gh_mirrors/xh/XHS-Downloader

用脚本攒了 300 条小红书笔记,打开下载文件夹,里面全是一串日期开头、谁发布的都看不出来的 heic 文件。XHS-Downloader 就是为这种小红书批量下载场景准备的:它能提取作品链接、解析下载地址、把图文视频文件落盘到本地,命名规则、归档方式、下载节奏全部可调。

能力速览

  • 提取小红书作品链接与下载地址,图文、视频、动图都能下
  • 自定义文件命名格式,支持发布时间、作者昵称、点赞数等十几个字段
  • 按作者自动归档到独立文件夹,作者改昵称也会自动同步
  • 剪贴板监听模式:浏览器里复制链接,文件自动开始下载

第一次运行:从终端到第一个文件

打开终端,进入项目目录。如果还没拿到代码,先克隆仓库:git clone https://gitcode.com/gh_mirrors/xh/XHS-Downloader

然后两条命令:

uv sync --no-dev uv run main.py

你看到的是一个终端界面:顶部提示"请输入小红书图文/视频作品链接",下面一排按钮。把一个笔记链接粘进输入框(多个链接用空格隔开),点"下载作品文件"。几秒钟后,日志区逐行打印出每个文件"下载成功"。

打开项目目录下的Volume/Download,第一个文件已经躺在里面了。

配置文件Volume/settings.json首次运行后自动生成,后面要调的所有参数都在这个文件里。

命名规则:让文件自己"说话"

命名规则在配置文件的name_format这一行。默认值是发布时间 作者昵称 作品标题,为什么这么配?发布时间放最前,文件夹里按时间排序天然成立;作者昵称防止多个人的作品混在一起;标题兜底可读性。

支持的字段远不止这三个:作品标题作品描述作品标签发布时间最后更新时间作者昵称作者ID作品ID作品类型,还有点赞数量收藏数量评论数量分享数量这类数据字段。字段之间用空格分隔。

三种典型方案:

方案生成效果适合谁
发布时间 作者昵称 作品标题(默认)20250619 美食家小明 夏日冰饮指南.jpg通用,按时间线管理
作品标题 点赞数量 收藏数量夏日冰饮指南 1024 96.heic按热度筛选内容的人
配合author_archive开启作者归档Download/美食家小明/20250619 夏日冰饮指南.jpg追更固定创作者的人

第二种方案值得多说一句:把点赞数写进文件名,三个月后翻文件夹时不用点开文件就能回忆起"这条当时很火"。数据字段是它和纯文本命名器的差别。

批量下载的三种姿势

追更一个创作者:把author_archive设为true,每个作者的作品会自动存进以作者命名的独立文件夹。某个作者改昵称后,已下载文件的名称会被程序自动更新。配合mapping_data还能给作者起别名,比如把一长串昵称映射成"老王"。

挑着下:图文作品想只留第 1、3、5 张图?用命令行模式:

python main.py -u "作品链接" -i "1 3 5"

TUI 输入框里也可以一次粘贴多个链接,空格分隔,程序只下载你给的那几条。

一次性拉一批:按M键开启剪贴板监听。之后只要你在浏览器里复制作品链接,程序就自动开始下载,不用回到终端。适合边刷边收集的场景。

下载不卡的 3 个旋钮

chunk,水管的粗细:控制每次从服务器拉取的数据块大小,默认 2MB。带宽好的机器调大一点,大文件完成得更快;网络一般就保持默认。

max_retry,断线后的自动重拨:请求失败时重试的最大次数,默认 5 次。手机热点、公司网络这种不稳定的环境,可以适当调大,多数抖动会被重试消化掉。

proxy,换一条线路走:设置代理后,所有请求都从代理出去。注意项目内置了请求延时机制防止频率过高,这是刻意为之,别为了快把重试和延时全关掉,容易触发风控。

改完这些参数,重启程序生效。TUI 界面里按S也能改常用项,保存配置即落盘。

踩坑速查

视频清晰度比网页上低?多半是没配 Cookie。网页版 Cookie 是非必需的,但不填的话视频只能拿到低分辨率文件。F12 打开开发者工具,在网络面板里找到请求头里的 Cookie 复制过来,填进配置的cookie字段。

同一作品第二次下载直接被跳过?这是download_record在起作用,它记住了已下载的作品 ID。想重新下,删掉下载记录数据库里对应的 ID 再来。

下载报"获取数据失败"?作品链接里带着日期信息,太久远的链接会被风控。重新进笔记页面复制一个新链接再试。

批量下载中途速度突然变慢?先确认全局代理工具没在捣乱——系统级代理有时会劫持请求导致失败。把全局代理关掉,只用配置里的proxy参数。

下一步可以做的事

如果你下载量稳定下来了,试试把 CLI 模式接进系统定时任务:每天凌晨拉一次关注的创作者,第二天早上文件已经就位。想更深度一点,项目里的example.py演示了如何用代码直接驱动整个下载流程,参数和配置文件一一对应,改成你自己的自动化脚本只是变量赋值的事。API 模式和 MCP 模式也内置好了,前者方便写服务端调用,后者可以直接接给 AI 助手用。

仓库地址:https://gitcode.com/gh_mirrors/xh/XHS-Downloader,建议从develop分支拉代码,有改动可以提 Pull Request 参与共建。

【免费下载链接】XHS-Downloader小红书(XiaoHongShu、RedNote)链接提取/作品采集工具项目地址: https://gitcode.com/gh_mirrors/xh/XHS-Downloader

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/8/22 18:51:47

程序搜索与持续抽象发现:实现自动化内容生成的元生成技术

这次我们来看一个名为“Procedural Content Metageneration via Program Search and Continual Abstraction Discovery”的研究项目。这个名字听起来很学术,但它的核心目标非常直接: 让计算机自动发现和生成复杂的程序规则,从而创造出近乎无…

作者头像 李华
网站建设 2026/8/22 18:49:43

Java大厂面试实战:电商高并发与微服务架构解析

1. 面试场景设定与核心考察点这场模拟面试以电商平台为业务背景,聚焦Java技术栈在互联网大厂中的实际应用。面试官作为技术专家,通过层层递进的问题考察候选人谢飞机在以下维度的能力:技术基础扎实度:Java语言特性、构建工具等基本…

作者头像 李华
网站建设 2026/8/22 18:46:50

1次扫码:GetQzonehistory帮你一键导出QQ空间历史说说

1次扫码:GetQzonehistory帮你一键导出QQ空间历史说说 【免费下载链接】GetQzonehistory 获取QQ空间发布的历史说说 项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory 还在为翻找几年前那条说说头疼?QQ空间的历史动态散在消息列…

作者头像 李华