
今天给大家演示一个Wan2.2 万物形变物理特效生成器的 ComfyUI 工作流。这个工作流通过多模型协同,让图片在输入后能自动生成多种物理形变效果,例如压扁、拉伸、软体塌缩、爆裂等,最终输出动态视频。整个流程从模型加载、文本与图像编码、形变逻辑选择、再到采样解码与视频合成,形成一套完整的自动化视频生成链路,适合做短视频素材、特效演示或创意玩法展示。以下将根据工作流文件内容进行整理和概述。文章目录工作流介绍核心模型Node节点工作流程大模型应用WanVideoTextEncode 文本语义驱动的形变控制核心LoadWanVideoT5TextEncoder 文本理解与指令编码模型WanVideoImageClipEncode 图像语义理解与结构向量生成WanVideoSampler 主生成模型的语义执行模块使用方法应用场景开发与应用工作流介绍这个工作流基于 WanVideo 系列模型构建,通过加载 Wan2.1/2.2 级别的视频生成模型、T5 文本编码器、CLIP 视觉编码器与专用 VAE,实现从单帧图像到多帧动态形变效果的生成逻辑。核心结构由模型加载、图像与文本嵌入生成、形变模式切换、视频采样与解码等部分组成。模型之间通过标准 WanVideo 数据通路互相连接,使提示词、图像特征与形变逻辑共同驱动最终的视频输出。节点间链接丰富,且具备精细的显存管理与 BlockSwap 加载优化,从而保证在中高分辨率状态下依然能顺畅运行。核心模型在这个工作流中,核心模型包括 Wan2.1 系列的视频生成模型、T5 文本编码器、CLIP 视觉编码器与 WanVideo 专用 VAE。这些模型分别承担文本理解、图像解析、潜空间构建与最终解码的功能。工作流通过 Lora 选择器补充特定形变风格模型,使最终生成的视频在物理表现上更加真实。模型之间以统一的通道格式协作,确保提示词意图、图像结构与形变特征能被准确整合,从而形成稳定而可控的视频输出。模型名称说明Wan2_1-I2V-14B-480P*主视频生成模型,负责图像到视频的形变生成