简体中文 English 日本語 Русский язык 한어

47

主题

15

回帖

60

修为

创始合伙人

积分
112
QQ


作者:@天选嘉鲤敦赵图图

014406ktwtkmffptswedtp.webp

一句话导读:以 MiniMax H3 为例,讲清视频 LoRA 为什么要打标、素材怎么准备,以及在打标器里裁片、主体过滤后做图+视频联合训练的全流程。

核心内容:
1. 为什么视频 LoRA 也要打标:MiniMax H3 会把标注分词送入条件编码器,再与视频/音频特征一起进模型。同一个人左转、右转、镜头环绕若没有准确文字区分,模型就学不到动作与文本的对应;只留空触发词或完全不标注,效果会受影响。
2. 主体过滤:图片可用通用多模态标注,但仍建议做主体过滤;视频更依赖专用打标工具来控制过滤颗粒度。
3. 素材理想形态:以训「一件衣服」为例,最好是不同人种/光照/角度/动作都穿着同一件衣服,其它因素尽量变化;功夫服等天然多元素材更好找。自己拍时人换不了,可用图片补多样性(不同人、场景、光照),再与视频一起训。
4. 时长与裁片:训练用视频时长受硬件限制(视频内有对照表);过长会被训练器硬裁,不如自己先裁成重点不同的短片段(旋转、推进、走跑等不要重复堆同一动作)。可在剪辑软件裁好导入,也可在打标器时间轴用 Ctrl+S 分片后直接打标。
5. 打标器流程:导入视频 → 分片 → 选生成模型/处理范围(完整或分片)→ 若训 H3 则选对应条件模式(常见文生视频)→ 做主体过滤后再出标注。
6. 训练器侧:图片+视频联合进同一数据集;注意参考模型模式等约束(与此前云端教程一致)。片尾介绍免费训练器与提示词反推工具等资源(见视频简介)。

适用场景:
- 准备训视频类 / MiniMax H3 LoRA
- 素材单一、想用图片补多样性
- 需要规范打标与分片再开训
您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

简体中文
繁體中文
English(英语)
日本語(日语)
Deutsch(德语)
Русский язык(俄语)
بالعربية(阿拉伯语)
Türkçe(土耳其语)
Português(葡萄牙语)
ภาษาไทย(泰国语)
한어(朝鲜语/韩语)
Français(法语)
QQArchiver手机版小黑屋粤ICP备2026002389号-1粤ICP备2026002389号-1 简体中文 English 日本語 Русский язык 한어 |网站地图