简体中文 English 日本語 Русский язык 한어

33

主题

0

回帖

1508

修为

执行合伙人

积分
3025

曼加塔第一期曼加塔第二期



作者:@AIwood爱屋研究室

MiniMax H3 ComfyUI部署:文图/参考生视频与音频口型编辑

MiniMax H3 ComfyUI部署:文图/参考生视频与音频口型编辑


一句话导读:这期视频从 ComfyUI 更新与模板入手,拆解 MiniMax H3 的本地部署、模型精度选择、分辨率设置,以及文生视频、图生视频、参考生视频和音频口型编辑的接线方法。

核心内容:
1. MiniMax H3 已获得 ComfyUI 的首批模板支持。作者建议先更新 ComfyUI,再从模板中打开文生视频、图生视频和参考生视频工作流;三个模板的基础结构较简洁,适合先跑通后再扩展。
2. 官方提供了面向不同显存条件的多种精度方案。BF16 更适合大显存环境,Int8 转换版和更低精度方案用于降低本地门槛;CLIP 也提供 BF16、Int8、NVFP4 等选择。精度降低会影响细节,不能只看“能运行”而忽略质量差异。
3. 工作流通过百万像素级的分辨率选择器控制宽高。作者建议按显存逐步提高,不要一开始拉满:16G 至 32G 显存可先从中等像素档测试,96G 级设备再尝试更高分辨率乃至 2K。实际安全值仍取决于模型精度、时长和参考输入。
4. H3 使用独立的视频 VAE 和音频 VAE,并把正向要求与不希望出现的内容集中写在同一提示词区域,不采用传统的独立负面提示词框。视频时长可按秒数设置,文生视频和图生视频的基本操作与常见 ComfyUI 流程接近。
5. 参考生视频节点最多可接入 9 张参考图片,并可同时使用参考视频和参考音频。它既能做主体/风格参考,也能让角色跟随音频舞动、说话,或对已有视频的台词与口型进行重新编辑。
6. 替换原视频台词时,需要把原视频音频和新音频都接入参考节点,并在提示词中按手册格式写明原台词与新台词。作者特别建议查阅 MiniMax H3 提示词手册,因为不同任务的输入格式会直接影响可控性。
7. 视频简介同时提供 Hugging Face、ModelScope、网盘模型和 RunningHub 在线工作流入口。本地部署适合有显存和环境维护能力的用户;希望直接体验 BF16 或大显存版本的人,可先用云端高显存环境验证效果。

适合人群:准备部署 MiniMax H3 的 ComfyUI 用户,以及需要多图参考、视频参考、音频驱动、台词替换和口型编辑工作流的视频生成创作者。

相关夸克网盘链接:
【模型网盘地址:https://pan.quark.cn/s/7441a9d634f1

补充说明:本文根据授权视频约 8 分钟完整音频转写、视频简介和默认第一页评论整理。具体显存占用、速度与输出质量受模型精度、分辨率、时长、参考素材和运行环境影响;请按提示词手册与本机资源逐步测试。
您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

简体中文
繁體中文
English(英语)
日本語(日语)
Deutsch(德语)
Русский язык(俄语)
بالعربية(阿拉伯语)
Türkçe(土耳其语)
Português(葡萄牙语)
ภาษาไทย(泰国语)
한어(朝鲜语/韩语)
Français(法语)
QQArchiver手机版小黑屋粤ICP备2026002389号-1粤ICP备2026002389号-1 简体中文 English 日本語 Русский язык 한어 |网站地图