Llama 3模型权重下载指南:官方脚本与Hugging Face双渠道完整步骤
【免费下载链接】llama3The official Meta Llama 3 GitHub site项目地址: https://gitcode.com/GitHub_Trending/ll/llama3
申请访问、链接过期、校验失败,这三件事都能让 Llama 3 模型权重下载功亏一篑。本文面向第一次接触 Llama 3 的开发者,把两个官方渠道整理成准备清单、分步操作和错误对照表。读完你能独立完成 8B 权重的下载与验证。
下载前准备:权限申请、工具安装与磁盘空间确认
这一节集中交代访问权限、命令行工具和硬件容量三项前置条件,避免下载进行到一半才卡住。
- 访问权限(两个渠道分别审批)
- 官方渠道:在 Meta Llama 官网注册,勾选许可协议,审批通过后邮件里会收到一条签名 URL(Presigned URL,即临时下载链接)。
- Hugging Face 渠道:注册 Hugging Face 账号,在模型页面接受许可协议,审批通过后即可访问全部 Llama 3 模型。
- 命令行工具:官方脚本依赖
wget(下载工具)与md5sum(校验和工具);HF 渠道依赖huggingface-hub库。 - 磁盘空间:8B 权重文件约 16GB,建议预留 20GB 以上;70B 约 140GB;四个模型全下约需 310GB。
- 算力硬件:8B 单张 GPU 可跑推理;70B 官方要求 8 卡并行(模型并行 MP 值为 8)。
⚠️ 邮件里的签名 URL 24 小时后失效,且限制下载次数。不要囤着链接,下载报错就重新申请。
建议:先把权限、工具、空间三项逐项打勾,再决定走哪个渠道。
渠道选择对比:什么时候用官方脚本,什么时候用 Hugging Face
下表按适用场景、所需凭证和速度对比两条渠道,先做决策再动手。
| 维度 | 官方 download.sh 脚本 | Hugging Face 渠道 |
|---|---|---|
| 适用场景 | 生产部署,需要原生 .pth 权重 | 开发测试、配合 transformers |
| 所需凭证 | 邮件中的签名 URL | Hugging Face 访问令牌 |
| 权重格式 | 原生格式(consolidated.00.pth 等) | original 原生权重,或 safetensors |
| 下载速度 | 单一来源,受链接带宽限制,支持断点续传 | 多文件 CDN 分发,通常更稳定 |
| 内置校验 | 自带 md5 校验 | 需自行核对文件清单与大小 |
建议:直接上生产就选官方脚本;先跑通开发环境就从 HF 渠道开始。
Llama 3官方 download.sh 脚本完整步骤
官方脚本一次完成下载与校验,适合生产部署。按下面五步执行。
- 克隆代码仓库并安装依赖
git clone https://gitcode.com/GitHub_Trending/ll/llama3 cd llama3 && pip install -r requirements.txt完成标志:目录里能看到download.sh与 requirements.txt。
- 申请访问并拿到签名 URL
在官网接受许可,审批通过后查收邮件。链接从邮件正文手动复制,不要点"Copy Link"按钮。
完成标志:邮件中出现一条以下载域名开头的链接。
- 运行下载脚本
bash download.sh完成标志:终端提示输入 URL 和模型列表。
- 输入 URL 与模型选择
模型列表用英文逗号分隔、不带空格:8B、8B-instruct、70B、70B-instruct;直接回车则四个全下。
完成标志:终端开始滚动 wget 下载进度。
- 等待自动校验完成
脚本在每份模型下载完后会执行md5sum -c checklist.chk。
完成标志:没有 FAILED 输出,且Meta-Llama-3-8B-Instruct目录中有consolidated.00.pth、params.json、tokenizer.model。
建议:只跑对话场景就填8B-instruct一项,省时间也省空间。
Llama 3 Hugging Face 权重下载与登录步骤
HF 渠道在账号审批通过后即可用命令行拉取权重,适合开发测试。
- 申请模型访问
在 HF 模型页面阅读并接受许可协议,审批通常一小时内完成,通过后可访问全部 Llama 3 模型。
完成标志:页面展示文件列表,不再提示无权限。
- 安装 huggingface-hub 并登录
pip install huggingface-hub huggingface-cli login提示时粘贴访问令牌(在账号设置页生成)。
完成标志:登录信息写入本地,出现成功提示。
- 下载原生权重
本仓库 llama/ 的实现加载原生权重,因此取original目录的内容:
huggingface-cli download meta-llama/Meta-Llama-3-8B-Instruct --include "original/*" --local-dir Meta-Llama-3-8B-Instruct完成标志:终端列出文件清单并开始显示下载进度。
⚠️ 遇到 401 Unauthorized,通常是未登录或审批未通过,重新执行
huggingface-cli login即可。
建议:若改用 transformers 管线集成,权重会在首次推理时自动缓存,可跳过手动下载。
验证 Llama 3 下载结果:校验和、参数与推理三项清单
三项依次通过,才能认为权重可用。
- 校验和验证(官方渠道)
cd Meta-Llama-3-8B-Instruct md5sum -c checklist.chk输出中所有条目均为 MD5 匹配。arm64 机器改用md5命令。
- 关键参数核对
打开params.json对照 8B 基准:dim应为 4096、n_layers32、n_heads32、vocab_size128256。任一不符,多半是取错了版本。
- 跑通推理示例
torchrun --nproc_per_node 1 example_chat_completion.py --ckpt_dir Meta-Llama-3-8B-Instruct/ --tokenizer_path Meta-Llama-3-8B-Instruct/tokenizer.model --max_seq_len 512 --max_batch_size 6✅ 终端给出连贯回复,说明权重、分词器与推理代码全部打通。
建议:HF 渠道没有 checklist.chk,用第 2、3 项验证即可。
Llama 3 权重下载常见错误对照表
多数问题不出在下表四种之外,按现象对号入座。
| 现象 | 原因 | 处理办法 |
|---|---|---|
403 Forbidden | 签名 URL 过期(24 小时有效)或下载次数用尽 | 重新申请新链接,再运行脚本 |
checklist.chk: FAILED | 网络中断导致文件不完整 | 删除对应.pth文件,重跑download.sh断点续传 |
401 Unauthorized(HF 渠道) | 未登录,或访问申请尚未批准 | 重新huggingface-cli login,或等待审批通过 |
| 显存不足 / OOM(70B) | 70B 需要 8 卡并行 | 换用 8B,或配置 8 张 GPU(MP=8) |
建议:修复后回到验证清单复核一遍,再进入部署环节。
总结与下一步
两个渠道覆盖不同阶段:官方脚本服务生产部署,HF 渠道适合快速迭代。验证通过只是模型落地的第一步。
下一步行动:
- 阅读 MODEL_CARD.md,了解模型能力与评测边界。
- 运行 example_chat_completion.py,实测对话质量。
- 显存有限时,了解量化部署(Quantization,用更低精度存储权重以节省显存)方案,在单卡上跑起 8B。
合规提示:使用 Llama 3 权重须遵守 USE_POLICY.md,不得用于违法目的或生成政策禁止的内容;商业化落地前请再次核对许可条款。
【免费下载链接】llama3The official Meta Llama 3 GitHub site项目地址: https://gitcode.com/GitHub_Trending/ll/llama3
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考