-
作者:@AIwood爱屋研究室
一句话导读:AIwood爱屋研究室用一张主题参考图和一首歌,演示借助 Agent 与 MiniMax H3 提示词 Skill 制作约一分钟港风数字人 MV 的分镜流程。
核心内容:
1. 参考素材:先准备符合 ...
-
作者:@T8star-Aix
一句话导读:这期视频先讲 IndexTTS 2.5 的音色与情感控制,再用 MiniMax H3 音频节点对比 FL2VA、Ref2VA 和不同音频条件,寻找数字人口型、声音保持与画面质感之间的折中方案。
核心内容: ...
-
作者:@AIwood爱屋研究室
一句话导读:这套 MiniMax H3 数字人工作流不是把音频只当普通参考,而是将源音频编码并锁定在联合音视频 latent 中驱动人物,同时保留原始音轨用于最终合成,以兼顾口型动作与声音清 ...
-
作者:@AIwood爱屋研究室
一句话导读:作者用一整天搭建本地“赛博女友”原型,以 Hugging Face speech-to-speech 项目承载语音对话底座,调用 DeepSeek API 生成回复,再接入 Duix Avatar 数字人形象;视频重 ...
-
作者:@AIwood爱屋研究室
一句话导读:这套 LTX 2.3 数字人工作流把角色场景图、录制音频和文生/图生两种数字人模式串起来,适合制作唱歌或口播视频;作者同时给出单段不超过 35 秒的稳定性边界和 5090D 上的实 ...
-
作者:@T8star-Aix
一句话导读:这套开源数字人组合先用 MOSS-TTS V1.5 生成情绪充沛的语音,再交给 Bernini-R S2V 完成参考图与音频驱动,重点是兼顾长文本、高动态和较低显存占用。
核心内容:
1. MOSS-TTS ...
-
作者:@AIwood爱屋研究室
一句话导读:作者连续多次实测 Bernini S2V V2 与 Wan2.2 IS2V 双人对话方案,未能稳定复现演示中的轮流说话效果,主要问题是两名角色经常同时开口。
核心内容:
1. Bernini S2V V2 ...
-
作者:@AIwood爱屋研究室
一句话导读:这期视频介绍 Bernini-R S2V,让原本只能做参考视频生成的 Bernini 系列具备音频驱动说话、口型同步和视频改口型能力,整体更接近数字人工作流。
核心内容:
1. 作者先回 ...
-
作者:@刘悦的技术博客
一句话导读:这条短视频快速演示了基于 LTX-2.3 的 10Eros V1.3 实验模型,重点是低显存环境下的图生视频、文生视频,以及单人和多人数字人对话/唱歌效果。
核心内容:
1. 作者开场说明 ...
-
作者:@T8star-Aix
一句话导读:这一期围绕数字人全家桶展开,重点整理 Wan2.2 InfiniteTalk 高动态分组提示词、Flash Talk 自适应版、KJ 高动态版,以及单人/多人循环版等数字人工作流方向。
核心内容:
1. ...
-
作者:@T8star-Aix
一句话导读:京东开源 JoyAI Echo,主打数字人音画同步长视频生成,重点是跨模态音视频记忆库、人物一致性和较低显卡门槛。
核心内容:
1. 这个项目面向数字人口播/讲解类视频生成,目标是 ...
-
HeyGem数字人优化加速版,支持面部角色保存,支持API接口调用,支持原始分辨率和帧率,GFPGAN超分,修复多面部报错,推理速度1比2,唱歌数字人_哔哩哔哩_bilibili
大家好,本次为大家分享最新版 HeyGem 数字人。该版本 ...