5步搞定MiniMax-H3 ComfyUI部署:文件放哪里、显存不足怎么办的完整指南
【免费下载链接】MiniMax-H3项目地址: https://ai.gitcode.com/hf_mirrors/Comfy-Org/MiniMax-H3
MiniMax-H3 是 ComfyUI 里的视频生成模型,新手最常卡在两处:文件放完下拉框找不到,第一次生成直接显存爆掉。这篇 MiniMax-H3 部署指南把流程拆成 5 步:硬件自检 → 文件落位 → 选精度版本 → 显存调优 → 工作流上手,每步先给结论再给操作。
第 1 步:下载前先查你的显卡
先检查这 3 点,再决定下哪些文件:
- ✅ 只有 NVIDIA 显卡有完整支持,AMD / Intel 集显暂时别折腾
- ✅ 8GB 显存是起步线;更低配置的显卡可能跑得极慢或直接报错
- ✅ 如果你的 pytorch 是 cu130 版本,官方明确建议优先用
int8_convrot精度的扩散模型
⚠️ 文本编码器里的
nvfp4_awq版本不需要 Blackwell 新卡,老卡也能用,显存紧张时优先选它。
第 2 步:一键放对位置——文件到底往哪复制
克隆模型仓库(仓库地址:https://gitcode.com/hf_mirrors/Comfy-Org/MiniMax-H3 ),然后把文件按类型拷进 ComfyUI 的对应子目录:
📂 ComfyUI/ └── 📂 models/ ├── 📂 diffusion_models/ # 10 个主模型(bf16 / int8 / fp8 / pruned 组合) ├── 📂 text_encoders/ # 3 个 Qwen3-VL-32B 文本编码器 ├── 📂 vae/ # 视频 VAE + 音频 VAE ├── 📂 loras/ # turbo 加速 LoRA(4step / 8step) └── 📂 embeddings/ # 10 个风格提示词嵌入⚠️ 放错目录不会报错,只是节点下拉框里没有这个模型。发现"找不到文件"时先核对子目录,不用重新下载。
第 3 步:8GB 显存该选哪个精度版本?
文件名看着多,实际一套工作流只需要:1 个主模型 + 1 个文本编码器 + 2 个 VAE。后缀含义对照如下:
| 后缀 | 含义 | 选择依据 |
|---|---|---|
bf16 | 全精度 | 16GB+ 显存,画质优先 |
int8_convrot | int8 量化 | 首选,需 pytorch cu130 |
fp8_scaled | fp8 量化 | 只有用不了 int8_convrot 时才选 |
pruned | 剪枝精简版 | 显存占用更低,可与上面任意精度叠加 |
8GB 显存推荐组合:minimax_h3_fl2va_int8_convrot(主模型)+qwen3vl_32b_minimax_h3_nvfp4_awq(文本编码器)+vae/下两个 VAE 文件。
第 4 步:生成时显存不足怎么办
按顺序排查,通常前两步就能解决:
- 先换低精度版本:
bf16→int8_convrot→fp8_scaled,或直接上pruned版本 - 再降输入分辨率,视频生成的显存占用对分辨率非常敏感
- 最后确认没有同时加载多个用不到的模型和 LoRA
第 5 步:I2V、T2V、R2V 工作流按需挑
项目提供三类官方工作流模板,按需取用:
- I2V:图生视频,最常用的入口,建议第一次运行就用它
- T2V:纯文本生视频
- R2V:参考图驱动生成
加载模板后在节点里选中第 2 步放好的模型文件即可;想快速出片,可叠加loras/里的 turbo LoRA(4step 最快,8step 质量更稳)。
排错顺序:出问题按这 4 步走
- 下拉框找不到模型 → 核对文件是否在正确的
models/子目录 - 显存不足 → 换低精度、降分辨率
- 文本编码器加载失败 → 先切
nvfp4_awq版本 - 能跑但极慢 → 检查显卡驱动与 pytorch 版本,优先 cu130 +
int8_convrot
【免费下载链接】MiniMax-H3项目地址: https://ai.gitcode.com/hf_mirrors/Comfy-Org/MiniMax-H3
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考