简体中文 English 日本語 Русский язык 한어

29

主题

0

回帖

1508

修为

执行合伙人

积分
3025

曼加塔第一期曼加塔第二期



作者:@AIwood爱屋研究室

ID-V2V:Wan 2.1/VACE角色保持视频编辑与ComfyUI部署

ID-V2V:Wan 2.1/VACE角色保持视频编辑与ComfyUI部署


一句话导读:视频演示基于 Wan 2.1/VACE 的 ID-V2V 视频编辑工作流,重点是在重打光、背景或人物特征变化时尽量保持原视频角色身份,并讲解当前 ComfyUI 尝鲜部署、首帧预处理和遮罩使用方法。

核心内容:
1. 作者先指出普通视频编辑模型即使使用遮罩,也可能对整幅画面重新绘制,导致人物身份和面部特征漂移。ID-V2V 的目标是让编辑后的首帧参与视频生成,在改变光照、背景或部分人物特征时更好地保护原角色。
2. 当前部署仍属于尝鲜路径。视频简介给出的 ComfyUI PR #15139 处于 Draft 状态,内容是为 Wan 2.1/VACE 基础的 ID-V2V 增加支持,并给 I2V 节点补充该模型需要的参考填充图像输入;Kijai 同时提供了转换后的 INT8 模型。不会处理 Git 分支的用户,可等待相关改动正式合入主分支后再更新。
3. 环境准备分为更新对应 ComfyUI 分支、下载 ID-V2V 模型并放入 models/diffusion_models,以及载入作者提供的工作流。尝鲜分支、模型文件和工作流应保持配套,避免仅更新其中一项后出现节点或模型不兼容。
4. 第二步是制作编辑后的首帧。作者演示用图像编辑模型修改原视频首帧,并在工作流中增加视频首帧获取和图像缩放;输出宽高应按 Wan 模型的标准比例设置,相关数值需能被 16 整除。
5. 最终生成分两类任务:如果只做重打光,首帧其他细节与原视频基本一致,可不启用额外遮罩处理,上传原视频和重打光后的首帧,再设置尺寸与总帧数即可;如果背景或人物部分特征发生明显变化,同时又要保留身份,则需启用工作流里的分割遮罩模块。
6. 遮罩提示词用于说明要保留的区域,例如保留面部输入 face,保留整个人物输入 person。作者提醒,变化较大的编辑若不让遮罩参与,原视频素材和背景可能干扰新结果。转写对该遮罩模块的具体版本名称不够稳定,本文保留功能说明,不把未由上游 PR 核实的版本号写成确定配置。
7. 视频结尾说明模型和工作流已放入网盘,后续还计划部署到 RunningHub。当前效果来自作者本次工作流测试,角色保持程度、速度与显存表现仍需结合素材、分辨率和本机环境自行验证。

相关项目:
ComfyUI ID-V2V PR:https://github.com/Comfy-Org/ComfyUI/pull/15139
Kijai 转换模型:https://huggingface.co/Kijai/Wan ... convrot.safetensors

适合人群:想在 ComfyUI 中尝试角色保持视频编辑、首帧驱动重打光,或测试人物与背景变化工作流的 Wan 2.1/VACE 用户。

补充说明:本文根据授权视频约 258 秒完整音频转写、视频简介和默认首屏评论整理,并用视频提供的 ComfyUI PR 核对 ID-V2V、Wan 2.1/VACE、参考图输入和模型文件名;上游支持状态与节点参数请以实际 PR、工作流和原视频画面为准。

相关夸克网盘链接:
【模型+工作流网盘地址:https://pan.quark.cn/s/3f20219fe3a7
您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

简体中文
繁體中文
English(英语)
日本語(日语)
Deutsch(德语)
Русский язык(俄语)
بالعربية(阿拉伯语)
Türkçe(土耳其语)
Português(葡萄牙语)
ภาษาไทย(泰国语)
한어(朝鲜语/韩语)
Français(法语)
QQArchiver手机版小黑屋粤ICP备2026002389号-1粤ICP备2026002389号-1 简体中文 English 日本語 Русский язык 한어 |网站地图