【ComfyUI】Wan2.2 CharacterMotion 单图角色关键词驱动视频生成

发布时间:2026/9/18 4:04:19
【ComfyUI】Wan2.2 CharacterMotion 单图角色关键词驱动视频生成
今天给大家演示一个由单图驱动角色动作生成视频的 ComfyUI 工作流 ——Wan2.2 CharacterMotion。通过上传一张图像并输入关键词描述,该流程可以自动完成图像到视频的高质量动画生成,输出具有真实感动作的角色短片。整个系统基于多模型组合设计,结合大模型对图像与语义的理解能力,实现角色视觉、动作与音频的融合表现。该工作流适合创意短片、角色预览、叙事演示等多场景,支持精细控制和高效运算。文章目录工作流介绍核心模型Node节点工作流程大模型应用WanVideoTextEncode 单图角色动作语义驱动核心RH_Translator Prompt 自动翻译与语义强化器RH_LLMAPI_NODE(图像描述节点) 单图自动生成动作提示词LoadWanVideoT5TextEncoder 大模型文本解析底座使用方法应用场景开发与应用工作流介绍本工作流的目标是将单张静态图像通过自然语言描述驱动,生成具有指定动作和语义表达的视频内容。整个流程围绕角色关键词驱动展开,集成了图像嵌入、文本编码、多模型组合与采样生成等关键模块。核心设计通过 LoRA 控制、BlockSwap 模块调整、T5 文本理解和自定义采样配置实现图像与动作之间的高维关联。此流程可输出高清视频,支持多格式模型结构调整,并可拓展其他生成任务如配音、声音拟合等。核心模型本工作流使用了两种不同精度配置的Wan2.2-I2V-A14B视频生成模型作为基础框架,配合 LoRA 进行动作控制。同时引入umt5-xxl文本编码模型提升关键词语义理解能力。模型名称说明Wan2_2-I2V-A14B-HIGH_fp8_e4m3fn_scaled_KJ.safetensors用于高清视频版本生成,支持更高画质和细节还原,适合最终成片输出Wan2_2-I2V-A14B-LOW_fp8_e4m3fn_scaled_KJ.safetensors