5分钟上手ComfyUI-WanVideoWrapper从文字到AI视频生成的完整指南【免费下载链接】ComfyUI-WanVideoWrapper项目地址: https://gitcode.com/GitHub_Trending/co/ComfyUI-WanVideoWrapperComfyUI-WanVideoWrapper 是 ComfyUI 里针对 WanVideo 系列模型的一套自定义节点包覆盖三类核心任务文字生成视频、图片生成视频、音频驱动视频。装好之后你可以通过拖节点的方式组装完整的视频生成流程同一套节点还接入了相机控制、人物口型、视频超分等一大批扩展模型。下面按装好→会用→跑得动→不踩坑的顺序讲一遍。 安装节点放好模型文件把仓库克隆到 ComfyUI 的custom_nodes目录下再装依赖git clone https://gitcode.com/GitHub_Trending/co/ComfyUI-WanVideoWrapper cd ComfyUI-WanVideoWrapper pip install -r requirements.txt用便携版的话在 ComfyUI 根目录执行python_embeded\python.exe -m pip install -r ComfyUI\custom_nodes\ComfyUI-WanVideoWrapper\requirements.txt然后按用途把模型文件放进对应目录文本编码器负责读你的提示词→ComfyUI/models/text_encoders视频生成模型transformer出画面的主力→ComfyUI/models/diffusion_modelsVAE把中间潜空间解码成真实图像→ComfyUI/models/vae视觉模型 Clip Vision→ComfyUI/models/clip_visionGGUF 量化格式的主模型也可以直接丢给主模型加载器读取不用转换。 三个最常用的玩法一句话直接生成视频输入竹林中的古老石塔微风轻拂模型会自己脑补出动态画面。显存一般的话建议先用 1.3B T2V 模型81 帧窗口、16 帧重叠生成 1025 帧的视频显存不到 5GB5090 上大约 10 分钟跑完。提示词可以先写简单的比如一个人在室内走动熟悉手感后再往里面加细节。给静态照片加上动态这是 I2Vimage to video图生视频的典型输入给一张图模型负责推测出后续帧。人物类照片要注意选主体清晰、遮挡少的图模型对发丝、衣料这类细节的运动处理会比较自然。用声音驱动画面接上 Ovi 模型代码在Ovi/目录可以生成带同步音频的视频也可以拿一段现成的音频文件驱动角色口型开合。对应的示例流程在example_workflows/里名字带Ovi的就是。⚙️ 显存到底够不够看这几项核心机制是块交换block swapping把大模型切成若干块正在算的留在显存其余暂存到内存里小显存卡也能跑 14B。参考值512×512、81 帧的 14B 模型40 块里换出 20 块显存占用约 16GB。torch.compile把模型图编译加速推理变快但注意它可能让首跑显存异常见踩坑篇上下文窗口长视频分段生成每段 81 帧相邻窗口重叠 16 帧保证衔接不断裂场景复杂可以把窗口调大LoRA 权重新版直接挂在对应块上跟着换入换出不会额外吃显存fp8 模型支持 fp8 的硬件用 fp8 量化版显存更省 扩展生态按能力维度看这套节点接了很多社区模型按用途分四组画质提升SkyReels 出更高分辨率FlashVSR 做视频超分VACE 做视频编辑人物与口型FantasyTalking、FantasyPortrait 做人物说话MultiTalk 支持多角色对话相机与运动ReCamMaster 重编运镜Uni3C 做三维相机控制ATI 做物体跟踪Fun control / SCAIL / SteadyDancer 做姿态控制音频与动画Ovi 音频生成WanAnimate 人物动画MoCha 主体替换源码分别在skyreels/、fantasytalking/、recammaster/、uni3c/、ATI/、wanvideo/modules/等目录核心生成架构在wanvideo/。️ 实战路径从示例工作流入手example_workflows/目录里全是成品流程直接导入 ComfyUI 就能跑入门wanvideo_2_1_14B_T2V_example_03.json文生视频、wanvideo_2_1_14B_I2V_example_03.json图生视频进阶wanvideo_1_3B_FlashVSR_upscale_example.json超分、wanvideo_2_1_14B_SCAIL_pose_control_example_01.json姿态控制进阶wanvideo_2_1_14B_I2V_InfiniteTalk_example_03.json多角色对话、wanvideo_2_1_14B_MoCha_replace_subject_KJ_02.json主体替换调参策略以示例参数为起点一次只动 1-2 个参数跑通了就把流程存成自己的模板。想提速可以开 TeaCache注意新版阈值要按旧版的 10 倍来填系数 0.25-0.30 通常够用起始步设 0 即可若用了更激进的阈值建议晚一点再启动避免跳过早期步骤导致动作错乱。硬件适配14B 模型建议 12GB 以上显存不够就开块交换1.3B 模型 6-8GB 的卡就能流畅跑所有配置都优先选 fp8 版本。️ 踩坑手册现象首次运行显存高得离谱小分辨率都爆显存原因Windows 上的旧 Triton / torch.compile 缓存和当前版本不兼容。 解法清空C:\Users\用户名\.triton和C:\Users\用户名\AppData\Local\Temp\torchinductor_用户名两个文件夹后重跑。现象挂了 LoRA 之后显存占用上涨原因新版把未合并的 LoRA 权重算进块里不交换时权重全部压在显存上。 解法多换几个块补偿。比如 1GB 的 LoRA、20 个块总量涨约 500MB把交换块数加 2 个就能找回来。现象生成质量不稳定、画面抖动原因通常是参数或提示词没配对。 解法先确认模型放对目录再降一点 CFG 值、加采样步数负面提示词别省。现象模型加载失败或节点不出现原因文件路径、格式不对或插件没装好。 解法对照上面那份目录清单逐项核对确认装完依赖后重启 ComfyUI。好了挑一个example_workflows/里的文生视频示例导进去提示词框里写一句话先看看模型能给你什么东西再说。【免费下载链接】ComfyUI-WanVideoWrapper项目地址: https://gitcode.com/GitHub_Trending/co/ComfyUI-WanVideoWrapper创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
