ComfyUI-WanVideoWrapper 十分钟出片:8G显存跑通WanVideo视频生成的最短路径

📅 2026/8/24 10:31:17
ComfyUI-WanVideoWrapper 十分钟出片:8G显存跑通WanVideo视频生成的最短路径
ComfyUI-WanVideoWrapper 十分钟出片8G显存跑通WanVideo视频生成的最短路径【免费下载链接】ComfyUI-WanVideoWrapper项目地址: https://gitcode.com/GitHub_Trending/co/ComfyUI-WanVideoWrapperComfyUI-WanVideoWrapper 是 ComfyUI 的自定义节点插件把 WanVideo 系列模型包成节点让你在 ComfyUI 里做视频生成文字出片、图片出片、跟着音频出片都行。读完这篇你装好依赖、放好模型、跑通第一个工作流并且知道显存不够时该拧哪个旋钮。 从零到第一次出片先把仓库克隆进 ComfyUI 的自定义节点目录依赖会跟着项目走之后升级就是git pull一行。git clone https://gitcode.com/GitHub_Trending/co/ComfyUI-WanVideoWrapper ComfyUI/custom_nodes/ComfyUI-WanVideoWrapper pip install -r ComfyUI/custom_nodes/ComfyUI-WanVideoWrapper/requirements.txt用便携版的话用内置解释器装依赖python_embeded\python.exe -m pip install -r ComfyUI\custom_nodes\ComfyUI-WanVideoWrapper\requirements.txt依赖装完接下来放模型。模型要按类型各归其位放错文件夹加载器就找不到文件文件放哪个文件夹干什么用umt5 文本编码器models/text_encoders读懂你的提示词Wan 主模型 transformermodels/diffusion_models视频生成的核心VAEmodels/vae把潜空间还原成画面CLIP Visionmodels/clip_vision图生视频时读图1.3B 模型 8G 显存就能跑14B 建议 16G 起步。fp8 scaled 版本是作者点名推荐省显存且画质损失小GGUF 量化版主加载器也支持。重启 ComfyUI节点面板里出现 WanVideo 分类就说明装好了。打开 example_workflows 里的wanvideo_2_1_14B_T2V_example_03.json把加载器节点里的文件名换成你本地的模型点 Queue Prompt。第一次跑记得固定 seed方便复现。场景环境图示例可直接当图生视频的输入素材️ 你想做哪种视频打字就能出片文字到视频参数设成说明模型14B t2v8G 显存换 1.3Bsteps3020 步可快速预览shift5.0和模型规格配套num_frames81更长接上下文窗口提示词按环境、主体、动作三段写逗号分隔A sunny bamboo forest, a man in a red shirt, walking slowly, medium shot, natural light排坑画面内容对不上提示词把 cfg 从 5 提到 6 再试81 帧以上的长视频别硬扛用 context window 分窗生成窗口设 81、overlap 设 16作者在 5090 上用 1.3B 跑 1025 帧不到 5G 显存。让一张静态图动起来参数设成说明num_frames81图生视频常用长度clip embed strength1.0图片控制力度noise_aug_strength0.0~0.1越小画面越稳操作序列照抄图片拖进 Load Image 节点 → 接 WanVideo Image Embeds 节点 → 提示词只写运动比如The teddy bear sways gently, soft breeze, background static→ 采样出片。静态图转视频示例素材玩具熊适合测试轻微摆动类运动排坑首帧和原图长得像换了张脸把 clip embed strength 提到 1.2画面变形严重把 noise_aug_strength 降回 0。画面踩着音乐节拍走音频驱动分两类Ovi 节点图生视频还带音频HuMo、FantasyTalking、MultiTalk 做说话人头和多人对话。参数设成说明audio_scale1.0音频影响强度audio_cfg_scale3~5同步紧密度num_frames81与音频时长对齐操作序列加载音频 → 接对应模型的 audio embeds 节点 → 再接一张人物参考图 → 跑采样。说话人头类工作流常用的人物参考图排坑口型跟不上节拍audio_cfg_scale 提到 5脸崩了、出现扭曲降回 3 并检查参考图是不是正脸特写。用姿态和镜头锁住动作想让运动精确可控别指望纯提示词。WanMove 管运动轨迹Uni3C 管相机参数ReCamMaster 做重打光换机位SteadyDancer 和 SCAIL 吃姿态图VACE 做视频编辑。参数设成说明control strength1.0控制信号强度start / end percent0 / 1控制生效区间排坑控制信号太强画面出现条纹伪影strength 降到 0.7控制完全没生效检查控制视频帧数是否和 num_frames 一致。⚡ 机器跑不动先看这里显存档位速查表档位模型选择关键开关预期表现8G1.3B fp8block swap 2081帧窗口实测5G显存16G14B fp8block swap 20/40512×512×81帧24G14B bf16不用 swap720P 81帧block swap 是把 transformer 的块先留在内存、用时再搬上显存的机制swap 块数是 8G 显存跑 14B 的命根子。如果爆显存每次多 swap 2 个块再试还不行就降分辨率或帧数。如果开了 torch.compile 第一次跑显存暴涨别慌重跑一次就好triton 缓存热起来就正常嫌麻烦干脆不开 compile作者已经把代码改得不依赖它也跑得动。如果用了未合并的 LoRA 却感觉显存变大了那是 LoRA 权重现在跟着块走开 block swap 让它们一起换出多补偿 2 个块就行。 还能接着玩什么example_workflows 里 30 多个现成模板相机控制、视频编辑、姿态驱动直接抄作业TeaCache 跳过重复计算提速新版系数设 0.25~0.30阈值是旧文档的 10 倍原生 ComfyUI 的文本编码器和 CLIP Vision 加载器可以直接给 wrapper 用少下一批模型SkyReels 管自然场景FantasyTalking 管说话人MultiTalk 管多人对话装模型后对应节点自动出现Qwen 节点能把你的短提示词扩写成详细描述提示词写不出花的时候用它兜底从一行提示词到成片ComfyUI-WanVideoWrapper 把整个视频生成链路都留在了 ComfyUI 里。打开 example_workflows 里第一个模板把文件名换成你本地的模型跑起来。【免费下载链接】ComfyUI-WanVideoWrapper项目地址: https://gitcode.com/GitHub_Trending/co/ComfyUI-WanVideoWrapper创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考