-
作者:@T8star-Aix
一句话导读:这套开源数字人组合先用 MOSS-TTS V1.5 生成情绪充沛的语音,再交给 Bernini-R S2V 完成参考图与音频驱动,重点是兼顾长文本、高动态和较低显存占用。
核心内容:
1. MOSS-TTS ...
-
作者:@AIwood爱屋研究室
一句话导读:作者连续多次实测 Bernini S2V V2 与 Wan2.2 IS2V 双人对话方案,未能稳定复现演示中的轮流说话效果,主要问题是两名角色经常同时开口。
核心内容:
1. Bernini S2V V2 ...
-
作者:@AIwood爱屋研究室
一句话导读:这期视频介绍 Bernini-R S2V,让原本只能做参考视频生成的 Bernini 系列具备音频驱动说话、口型同步和视频改口型能力,整体更接近数字人工作流。
核心内容:
1. 作者先回 ...
-
作者:@刘悦的技术博客
一句话导读:这条短视频快速演示了基于 LTX-2.3 的 10Eros V1.3 实验模型,重点是低显存环境下的图生视频、文生视频,以及单人和多人数字人对话/唱歌效果。
核心内容:
1. 作者开场说明 ...
-
作者:@T8star-Aix
一句话导读:这一期围绕数字人全家桶展开,重点整理 Wan2.2 InfiniteTalk 高动态分组提示词、Flash Talk 自适应版、KJ 高动态版,以及单人/多人循环版等数字人工作流方向。
核心内容:
1. ...
-
作者:@T8star-Aix
一句话导读:京东开源 JoyAI Echo,主打数字人音画同步长视频生成,重点是跨模态音视频记忆库、人物一致性和较低显卡门槛。
核心内容:
1. 这个项目面向数字人口播/讲解类视频生成,目标是 ...
-
HeyGem数字人优化加速版,支持面部角色保存,支持API接口调用,支持原始分辨率和帧率,GFPGAN超分,修复多面部报错,推理速度1比2,唱歌数字人_哔哩哔哩_bilibili
大家好,本次为大家分享最新版 HeyGem 数字人。该版本 ...
-
InfiniteTalk玩法深挖!基于官方模型测试双人对话场景。实测结论:复杂多轮交互暂不支持,但“一人一句”的访谈/播报模式效果完美!为您带来避坑指南及专用双人工作流,轻松制作简易对话视频,避免踩雷!一、Infinit ...
-
继官版单人流后,InfiniteTalk玩法再升级!解锁多图MV制作模式。只需传入多张参考图,模型自动处理不同图片间的首尾帧衔接,实现丝滑转场。告别单调大头照,轻松制作动态丰富的AI音乐视频,最新MV工作流速领!一、In ...
-
InfiniteTalk迎来官方支持!彻底解决KJ版长视频画质劣化与分段色差痛点。实测推理速度翻倍,画质更顶,单次生成时长无限制且全程高清。开源数字人天花板再次拉高,官方工作流已打包,速领!一、InfiniteTalk官版流发 ...
-
Soul APP旗下AI Lab重磅发布FlashTalk!这是一款超低延迟的实时数字人驱动框架。仅需一张图+一段音频,即可在RTX 4090上实现130 FPS的惊人推理速度。完美解决ID漂移与口型不同步问题,支持写实/动漫双风格,实时交互 ...
-
王炸,AI自动漫剧短剧:https://www.bilibili.com/video/BV1pRCABsE9y/
自动版AI真人短剧:https://www.bilibili.com/video/BV1h1maBZEFm/
自动AI推文矩阵号(变现全流程教程):https://www.bilibili.com/video/ ...