作者:@刘悦的技术博客
MiniMax H3分片推理:长视频分段生成与拼接
一句话导读:刘悦演示基于插件的 MiniMax H3 分片推理,把长视频拆成多个片段分别推理,再做上下文融合拼接,面向超长视频生成场景。
核心内容:
1. 这条视频的重点是 MiniMax H3 的分片推理插件:将较长的视频拆开处理,再把各段结果按上下文融合拼接,解决一次性生成长时长内容时的处理需求。
2. 口播演示了分段时长的调整:默认一段视频为 4 秒,参数改为 2 后,示例中对应为 8 秒。这里保留视频中的操作描述,不把参数含义扩展为未核验的通用公式。
3. 视频还带到首尾帧、全能参考等界面入口;当音频超过 15 秒时,演示将分段参数改为 4,并说明 4 段合计生成 16 秒视频。
4. 画面抽样可见本地 Web UI 的提示词、任务和输出预览界面,以及人物视频成片结果;口播最后说明可通过 ComfyUI 的自定义 8187 端口访问。
适合人群:想在 ComfyUI 中测试 MiniMax H3 长视频、分片推理和上下文拼接流程,并评估首尾帧/参考输入使用场景的创作者。
补充说明:本文根据授权视频约 163.1 秒、11 段完整音频转写和 3 个画面抽样整理;简介与 Bilibili 首屏评论未发现夸克网盘链接。具体参数含义、显存需求和成片稳定性请结合原视频、当前插件版本与本地环境自行复核。 |