拓冰建站拓冰建站
首页 / 资讯中心 / 正文

ComfyUI WanVideo模型仓库终极使用手册:从模型迷路到流畅出片的完整指南

ComfyUI WanVideo模型仓库终极使用手册从模型迷路到流畅出片的完整指南【免费下载链接】WanVideo_comfy项目地址: https://ai.gitcode.com/hf_mirrors/Kijai/WanVideo_comfy如果你第一次接触 ComfyUI 的视频生成大概率经历过这种崩溃在网上下载了一堆后缀为.safetensors的大文件放进了models/目录结果加载时报错、画面崩坏、显存爆掉…… 根本分不清哪个是基础模型、哪个是 VAE、哪个是 LoRA。今天要讲的 WanVideo 模型仓库hf_mirrors/Kijai/WanVideo_comfy正是为解决这个模型迷宫而生的 ComfyUI 视频生成模型集合。一分钟认识它这到底是个什么仓库把 ComfyUI 比作厨房这个仓库就是一家食材超市。它不负责烹饪推理生成而是把做视频需要的所有食材——基础模型、VAE、文本编码器、LoRA 适配器、专用模块——按类别码放整齐让你按需取用。这里的食材全部服务于WanVideo 视频生成框架万相视频Wan2.1 / Wan2.2 系列涵盖三大任务文生视频 T2V、图生视频 I2V、以及各类风格增强与加速技巧。仓库由 ComfyUI 社区知名作者 Kijai 维护将分散在官方及各研究团队的多代模型做了统一整理、格式转换如 fp16 降精度、Comfy 原生键名适配和量化fp8保证你在 ComfyUI 里即插即用。从零到跑通先搞懂每个文件该放哪第一步准备环境。你需要一个能跑的 ComfyUI并安装 WanVideo 专用节点。仓库 README 明确说明它配合ComfyUI-WanVideoWrapper 插件以及 ComfyUI 原生 WanVideo 节点使用这是所有后续操作的前提。第二步克隆仓库认识目录结构。克隆命令为git clone https://gitcode.com/hf_mirrors/Kijai/WanVideo_comfy克隆后你会发现目录分类非常清晰目录/文件是什么典型用途根目录Wan2_1-*.safetensorsWan2.1 系列基础模型T2V / I2V 主模型Wan2_1_VAE_bf16.safetensors等VAE 视频编解码器视频压缩与还原umt5-xxl-enc-bf16.safetensors文本编码器把提示词转成向量LoRAs/风格与加速 LoRA电影感、角色一致性等Wan22-Turbo/、FastWan/蒸馏加速模型几步出片Skyreels/、Ovi/、ChronoEdit/专项功能模块天空生成、音频驱动等第三步最小跑通路径T2V。只拿 4 个文件就能跑通第一段视频Wan2_1-T2V-14B_fp8_e4m3fn.safetensors基础模型fp8 省显存Wan2_1_VAE_bf16.safetensorsVAEumt5-xxl-enc-bf16.safetensors文本编码器open-clip-xlm-roberta-large-vit-huge-14_visual_fp16.safetensors视觉编码器I2V 时需要把它们分别放进 ComfyUI 对应模型目录在 WanVideoWrapper 节点里填好路径、输入一句提示词如 A cat walking on the beach at sunset, cinematic设置 480p 分辨率、20~50 步采样就能生成第一段视频。如果你的显存只有 8GB可以把基础模型换成Wan2_1-T2V-1_3B_bf16.safetensors——1.3B 轻量版是低显存环境的救命稻草。提示同样的模型仓库里存在 fp32 / fp16 / bf16 / fp8 多种精度版本它们功能完全相同只是体积与画质取舍不同。新手优先选 fp8 或 bf16跑通流程后再追求 fp16/fp32 的极致画质。场景化实操三种真正会用到它的日常场景场景一给产品做 720P 高清宣传视频I2V 图生视频静态图活起来是商业制作的高频需求。以一张产品图作为首帧用Wan2_1-I2V-14B-720P_fp8_e4m3fn.safetensors作为主模型提示词描述运镜如 camera slowly zooming in, product rotating。想要更高级的运镜控制仓库里还有ATI 系列Wan2_1-I2V-ATI-14B_*专为镜头运动建模设计。如果感觉画面不够精致叠加LoRAs/CineScale/Wan2.1_I2V_14B_CineScale_ntk20_lora_rank16_fp16.safetensors——这是社区拆解的电影级画质 LoRA能明显提升光影与色彩质感。它的 NTK 缩放还支持更长序列生成长镜头也不在话下。场景二追求 4 步出片的极速工作流加速 LoRA短视频创作者最缺时间。仓库里藏着三套主流加速方案核心思路都是用蒸馏技术把采样步数从几十步压缩到 4~8 步Wan22-Turbo/Wan2_2-TI2V-5B-Turbo_fp16.safetensors直接把加速蒸馏进了权重里配合专用调度器5B 模型也能快速出片Wan22-Lightning/Wan22_A14B_T2V_HIGH_Lightning_4steps_lora_250928_rank128_fp16.safetensors是 4 步 LoRA专门针对 14B 级模型Lightx2v/提供了 8 档 rank4 到 256的蒸馏 LoRA目录里还有lightx2v_lora_rank_comparison.mp4对比视频直观展示不同 rank 在 4 步下的画质差异——rank 越高效果越好体积和显存消耗也越大新手从 rank 32 起步即可。想亲手对比效果可以先看Lightx2v/目录里的对比演示视频再按自己的显存选档位。场景三让视频开口说话音频驱动与数字人仓库的想象力不止于画面。Ovi/目录提供了完整的音频驱动视频生成组件Wan_2_2_Ovi_audio_model_bf16.safetensors配合 mmaudio 系列 VAE 与声码器导入音频即可让画面随声音节奏与情绪变化。做数字人则看InfiniteTalk/无限对话生成与WanVideo_2_1_Multitalk_14B_fp8_e4m3fn.safetensors多说话人——前者适合单人播客后者支持多人对话场景。避坑手册新手最容易踩的 5 个坑Q1加载模型一直报 key 不匹配 / 架构错误大概率是模型放错了位置或选错了节点类型。确认主模型走 WanVideoWrapper 的Load Diffusion ModelLoRA 走 Comfy 原生 LoRA 加载器且文件确实放进了models/对应目录而非别处。Q2显存直接 OOM 崩掉三板斧换小模型14B → 1.3B、降精度fp16 → fp8、降分辨率720P → 480P。注意Wan2_2_VAE_bf16.safetensors与Wan2_1_VAE_bf16.safetensors不能混用Wan2.2 模型必须配 Wan2.2 VAE否则解码必崩。Q3画面闪烁、运动僵硬检查是不是把蒸馏 LoRALightning/Turbo 类用在了普通模型上或步数设得太少。蒸馏 LoRA 通常要求专用调度器和低步数普通模型则需要 20 步以上。Q4fp8 版本加载很慢正常现象fp8 量化模型在部分显卡上需要反量化首次加载尤其明显。属预期行为不用反复重下。Q5分不清 HIGH 和 LOW 版Wan2.2 的-A14B-HIGH与-A14B-LOW指LoRA 应用的注意力层范围HIGH 影响更多层、风格更强LOW 更保守、更贴近原始模型。拿不准就先用 LOW出片稳。进阶玩法这些隐藏能力值得一试① 用 LoRA 做视频风格操作系统。仓库的LoRAs/像一套可自由组合的风格滤镜库Stand-In/做角色替换、Wan22_FFGO/用首帧定制视频内容、Stable-Video-Infinity/提供舞蹈/运镜/转场等多主题 LoRA、Wan22_relight/支持重打光。研究团队的最新成果这里基本都帮你转好了 Comfy 格式等于把论文里的 Demo 直接搬进了你的工作流。② 组合式模块给自己造一个专属模型。仓库里有些文件不是独立模型而是可替换部件。比如LongVie2/LongVie2_attn_layers_bf16.safetensors可以整体替换 I2V 主模型的注意力层作 extra_model 加载或用其 LoRA 版本获得稍弱的增强效果——注意两者二选一不要同时用。Wan2_1-VACE_module_14B_bf16.safetensors则是 VACE 条件控制模块配合专用节点能实现精准的空间控制。理解了部件式玩法你会发现这个仓库的可组合空间远超表面。资源与下一步沿着这条路线走值得深入探索的目录Lightx2v/—— 含 rank 对比演示视频与蒸馏 LoRA 说明入门加速的最佳教材LoRAs/CineScale/、LoRAs/Stable-Video-Infinity/—— 各带 README讲清来源与用法LongVie2/README.md—— 注意力层替换玩法的官方说明Wan22-Lightning/、Wan22-Turbo/—— 两套主流加速方案的完整文件建议的学习路线先用 fp8 的 1.3B T2V 模型跑通第一段视频感受全流程换成 14B I2V 模型做一次图生视频理解首帧与提示词的关系引入一款加速 LoRALightx2v 或 Lightning对比步数与画质的取舍最后尝试 Ovi 或 InfiniteTalk 等专项模块探索音频与多模态玩法。模型下载和存放只是开始真正的创作力在于你对基础模型 VAE LoRA 专用模块组合的理解。这份仓库把所有可能性摆在了你面前剩下的就是动手了。【免费下载链接】WanVideo_comfy项目地址: https://ai.gitcode.com/hf_mirrors/Kijai/WanVideo_comfy创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
分享:

看完干货,该让你的企业上线了

免费需求沟通 · 48 小时内出具建站方案 · 河南本地可上门