作者:@T8star-Aix
MiniMax H3直出30秒长视频:媲美Seedance2.5的技术汇总与稳定方案
一句话导读:T8 中秋特辑演示 MiniMax H3 在 ComfyUI 中一次性直出 21–30 秒长视频(无需上下文拼接),配合加速 LoRA、鱼桥提示词与低显存 Trunk 优化,约 12–15 分钟可跑完 30 秒片,稳定性对标近期 Seedance 2.5 观感,并汇总近期相关技术节点。
核心内容:
1. 直出长视频能力:片头演示 21 秒、25 秒、30 秒三段均为一次性直出,不依赖“上下方/上下文”拼接。作者指出拼接时易出现变色与跳变,直出路径下镜头逻辑更贴剧本、更干净。
2. 速度与显存:优化后跑 30 秒约 12–15 分钟,20 多秒约不到 10 分钟;原先 30 秒以上常见直接爆显存,当前工作流可稳定跑通。
3. 长视频三大难点与对策:
- 注意力崩坏:原模型训练偏短时长(约 15 秒),加长后注意力易散;用 STEP600 EMA 等手段在温系/无系阶段收束注意力(口播建议温系约 0.5、无系约 1)。
- 计算量与显存指数上升:前置 Trunk 分块降低炸显存概率(Running Hub Plus/48G 下两个 Trunk 足够;不开则采样器阶段易炸);避免过高二次采样步数,二次采样建议 LMS 权重约 0.2–0.4,搭配 3D Latent Upscale,必要时再加高清修复类节点。
- 错误随时长放大:动作过多时后半段易偏离;用“鱼桥”结构化提示词约束运动与剧本,非战斗用默认鱼桥,枪战等战斗场景用战斗/兔子鱼桥;并配合提示词增强节点,现已支持 30 秒及以上结构化提示词(此前偏 15 秒)。
4. 底模与加速组合(口播实测偏好):底模不推荐“达西瓜”一类,倾向 Hyper 系并对比 25–49 区间中较稳版本;首轮加速仍用 Lightning/Liter2V 类成熟方案(可能略“油”,后续可修);串接多路加速 LoRA(含 STEP600 Liter2V、作者早期加速等)以及双向开发的 Motion Repair、H3 Speed Slider,用于在高速/高动态下维持注意力与画面稳定。
5. 体验与资源:Open 贞贞提示词画廊可复制片头脚本自测;Running Hub 会员福利口播提到近期约一个月内每日约 13 小时免费 MiniMax G3/H3 体验,加强版可到 1080P。工作流与模型轮子节点、T8 CF 整合包 V20、无限画布、贞贞整合包等夸克链接见简介;GitHub 侧含 minimax-h3-audio、prompt-skill、prompt-enhancer、blockcache 等节点。作者称主节点正拆分为更细能力,后续会把 Prompt Relay / Enhance of Video 等再并入。
6. 合规提醒:视频末尾强调遵守法律法规,勿将 AI 用于违法用途。
适合人群:已在 ComfyUI 使用 MiniMax H3、需要稳定直出 20–30 秒长视频、并关心低显存 Trunk、鱼桥提示词与加速 LoRA 组合的创作者。
补充说明:本文根据授权视频全片语音转写(faster-whisper small,约 629.7 秒 / 295 段)整理,已按 ASR 语境校正 MiniMax H3、Seedance 2.5、Running Hub、鱼桥、Trunk、Motion Repair、H3 Speed Slider、STEP600 EMA、3D Latent Upscale 等专有名词;具体权重、底模版本与包内文件以原视频演示及网盘/GitHub 为准,请合规使用。
相关夸克网盘链接:
【模型及工作流轮子节点:https://pan.quark.cn/s/a30a9a95a1bf】
【T8 CF整合包V20:https://pan.quark.cn/s/af20c54c9a13】
【无限画布整合包v3.1.9:https://pan.quark.cn/s/5871a0142ff3】
【贞贞整合包V4.9D:https://pan.quark.cn/s/ed4f5cc2db75】 |