<?xml version="1.0" encoding="utf-8"?>
<rss version="2.0">
  <channel>
    <title>Monster社区 | ComfyUI论坛 - 数字人</title>
    <link>https://bbs.monster/forum-34-1.html</link>
    <description>Latest 20 threads of 数字人</description>
    <copyright>Copyright(C) Monster社区 | ComfyUI论坛</copyright>
    <generator>Discuz! Board by Comsenz Inc.</generator>
    <lastBuildDate>Mon, 14 Sep 2026 00:25:53 +0000</lastBuildDate>
    <ttl>60</ttl>
    <image>
      <url>https://bbs.monster/static/image/common/logo_88_31.gif</url>
      <title>Monster社区 | ComfyUI论坛</title>
      <link>https://bbs.monster/</link>
    </image>
    <item>
      <title>MiniMax H3港风数字人MV：提示词Skill与分镜流程</title>
      <link>https://bbs.monster/thread-4796-1-1.html</link>
      <description><![CDATA[作者：@AIwood爱屋研究室



一句话导读：AIwood爱屋研究室用一张主题参考图和一首歌，演示借助 Agent 与 MiniMax H3 提示词 Skill 制作约一分钟港风数字人 MV 的分镜流程。

核心内容：
1. 参考素材：先准备符合主题的照片，视频示例使用旗袍、珍珠和花等元素，并保 ...]]></description>
      <category>数字人</category>
      <author>Aiwood爱屋</author>
      <pubDate>Fri, 28 Aug 2026 12:47:04 +0000</pubDate>
    </item>
    <item>
      <title>MiniMax H3音频驱动数字人：IndexTTS 2.5与FL2VA/Ref2VA口型优化</title>
      <link>https://bbs.monster/thread-4690-1-1.html</link>
      <description><![CDATA[作者：@T8star-Aix



一句话导读：这期视频先讲 IndexTTS 2.5 的音色与情感控制，再用 MiniMax H3 音频节点对比 FL2VA、Ref2VA 和不同音频条件，寻找数字人口型、声音保持与画面质感之间的折中方案。

核心内容：
1. IndexTTS 2.5 的重点是参考音色、跨语种音色迁移 ...]]></description>
      <category>数字人</category>
      <author>t8star</author>
      <pubDate>Thu, 13 Aug 2026 15:03:14 +0000</pubDate>
    </item>
    <item>
      <title>MiniMax H3真音频驱动数字人：锁定原音频与多人对话工作流</title>
      <link>https://bbs.monster/thread-4598-1-1.html</link>
      <description><![CDATA[作者：@AIwood爱屋研究室



一句话导读：这套 MiniMax H3 数字人工作流不是把音频只当普通参考，而是将源音频编码并锁定在联合音视频 latent 中驱动人物，同时保留原始音轨用于最终合成，以兼顾口型动作与声音清晰度。

核心内容：
1. 标准 H3 数字人流程中，音频与 ...]]></description>
      <category>数字人</category>
      <author>Aiwood爱屋</author>
      <pubDate>Tue, 04 Aug 2026 14:27:11 +0000</pubDate>
    </item>
    <item>
      <title>本地赛博女友链路：speech-to-speech、Duix Avatar与DeepSeek API</title>
      <link>https://bbs.monster/thread-4538-1-1.html</link>
      <description><![CDATA[作者：@AIwood爱屋研究室



一句话导读：作者用一整天搭建本地“赛博女友”原型，以 Hugging Face speech-to-speech 项目承载语音对话底座，调用 DeepSeek API 生成回复，再接入 Duix Avatar 数字人形象；视频重点复盘这条链路的延迟、显存和工程衔接问题，而不是提 ...]]></description>
      <category>数字人</category>
      <author>Aiwood爱屋</author>
      <pubDate>Tue, 28 Jul 2026 19:21:08 +0000</pubDate>
    </item>
    <item>
      <title>LTX 2.3数字人工作流：文/图生口播、自动帧数与35秒建议</title>
      <link>https://bbs.monster/thread-4469-1-1.html</link>
      <description><![CDATA[作者：@AIwood爱屋研究室



一句话导读：这套 LTX 2.3 数字人工作流把角色场景图、录制音频和文生/图生两种数字人模式串起来，适合制作唱歌或口播视频；作者同时给出单段不超过 35 秒的稳定性边界和 5090D 上的实测耗时。

核心内容：
1. 使用场景：作者说明整段视频 ...]]></description>
      <category>数字人</category>
      <author>Aiwood爱屋</author>
      <pubDate>Mon, 20 Jul 2026 14:40:34 +0000</pubDate>
    </item>
    <item>
      <title>MOSS-TTS V1.5 + Bernini-R S2V：开源高动态数字人工作流</title>
      <link>https://bbs.monster/thread-4409-1-1.html</link>
      <description><![CDATA[作者：@T8star-Aix



一句话导读：这套开源数字人组合先用 MOSS-TTS V1.5 生成情绪充沛的语音，再交给 Bernini-R S2V 完成参考图与音频驱动，重点是兼顾长文本、高动态和较低显存占用。

核心内容：
1. MOSS-TTS 不是单一模型，而是覆盖多音色、长文本、声音设计、双 ...]]></description>
      <category>数字人</category>
      <author>t8star</author>
      <pubDate>Mon, 13 Jul 2026 15:05:17 +0000</pubDate>
    </item>
    <item>
      <title>Bernini S2V V2双人对话实测：音频串扰与稳定性问题</title>
      <link>https://bbs.monster/thread-4388-1-1.html</link>
      <description><![CDATA[作者：@AIwood爱屋研究室



一句话导读：作者连续多次实测 Bernini S2V V2 与 Wan2.2 IS2V 双人对话方案，未能稳定复现演示中的轮流说话效果，主要问题是两名角色经常同时开口。

核心内容：
1. Bernini S2V V2 节点版本和新的 Wan2.2 IS2V 方案都支持单人及双人对话 ...]]></description>
      <category>数字人</category>
      <author>Aiwood爱屋</author>
      <pubDate>Sat, 11 Jul 2026 14:18:20 +0000</pubDate>
    </item>
    <item>
      <title>Bernini-R S2V：原生音频驱动、口型同步与视频延长工作流</title>
      <link>https://bbs.monster/thread-4374-1-1.html</link>
      <description><![CDATA[作者：@AIwood爱屋研究室



一句话导读：这期视频介绍 Bernini-R S2V，让原本只能做参考视频生成的 Bernini 系列具备音频驱动说话、口型同步和视频改口型能力，整体更接近数字人工作流。

核心内容：
1. 作者先回顾 Bernini 的优势：参考效果和多图参考效果不错，但 ...]]></description>
      <category>数字人</category>
      <author>Aiwood爱屋</author>
      <pubDate>Thu, 09 Jul 2026 13:55:11 +0000</pubDate>
    </item>
    <item>
      <title>LTX-2.3-10Eros V1.3：8G显存图生视频与单/多人数字人</title>
      <link>https://bbs.monster/thread-4353-1-1.html</link>
      <description><![CDATA[作者：@刘悦的技术博客



一句话导读：这条短视频快速演示了基于 LTX-2.3 的 10Eros V1.3 实验模型，重点是低显存环境下的图生视频、文生视频，以及单人和多人数字人对话/唱歌效果。

核心内容：
1. 作者开场说明这是基于 LTX-2.3 微调的 10Eros V1.3 版本，并提到配 ...]]></description>
      <category>数字人</category>
      <author>刘悦的技术博客</author>
      <pubDate>Tue, 07 Jul 2026 13:52:24 +0000</pubDate>
    </item>
    <item>
      <title>京东开源JoyAI Echo：数字人音画同步长视频直出，跨模态记忆库与3050显卡可用</title>
      <link>https://bbs.monster/thread-4114-1-1.html</link>
      <description><![CDATA[作者：@T8star-Aix



一句话导读：京东开源 JoyAI Echo，主打数字人音画同步长视频生成，重点是跨模态音视频记忆库、人物一致性和较低显卡门槛。

核心内容：
1. 这个项目面向数字人口播/讲解类视频生成，目标是把音频驱动、画面同步和长视频稳定性整合到一个流程里 ...]]></description>
      <category>数字人</category>
      <author>t8star</author>
      <pubDate>Mon, 08 Jun 2026 10:17:58 +0000</pubDate>
    </item>
    <item>
      <title>数字人玩法更新！InfiniteTalk官版双人对话工作流，主持/采访神器</title>
      <link>https://bbs.monster/thread-3172-1-1.html</link>
      <description><![CDATA[InfiniteTalk玩法深挖！基于官方模型测试双人对话场景。实测结论：复杂多轮交互暂不支持，但“一人一句”的访谈/播报模式效果完美！为您带来避坑指南及专用双人工作流，轻松制作简易对话视频，避免踩雷！一、InfiniteTalk官版双人对话数字人今天还是研究数字人，围绕官 ...]]></description>
      <category>数字人</category>
      <author>嘟先生</author>
      <pubDate>Fri, 06 Feb 2026 11:00:00 +0000</pubDate>
    </item>
    <item>
      <title>InfiniteTalk 隐藏玩法！多图自动衔接生成 MV，转场丝滑到离谱</title>
      <link>https://bbs.monster/thread-3153-1-1.html</link>
      <description><![CDATA[继官版单人流后，InfiniteTalk玩法再升级！解锁多图MV制作模式。只需传入多张参考图，模型自动处理不同图片间的首尾帧衔接，实现丝滑转场。告别单调大头照，轻松制作动态丰富的AI音乐视频，最新MV工作流速领！一、InfiniteTalk官版多图MV介绍今天在昨天的基础上继续迭代 ...]]></description>
      <category>数字人</category>
      <author>嘟先生</author>
      <pubDate>Thu, 05 Feb 2026 11:00:00 +0000</pubDate>
    </item>
    <item>
      <title>终于等到了！InfiniteTalk 官方版发布：长视频画质不再崩，速度直接翻倍</title>
      <link>https://bbs.monster/thread-3152-1-1.html</link>
      <description><![CDATA[InfiniteTalk迎来官方支持！彻底解决KJ版长视频画质劣化与分段色差痛点。实测推理速度翻倍，画质更顶，单次生成时长无限制且全程高清。开源数字人天花板再次拉高，官方工作流已打包，速领！一、InfiniteTalk官版流发布好消息，大家都知道InfiniteTalk是目前开源数字人里 ...]]></description>
      <category>数字人</category>
      <author>嘟先生</author>
      <pubDate>Wed, 04 Feb 2026 15:00:00 +0000</pubDate>
    </item>
    <item>
      <title>数字人全家桶：Wan2.2 InfiniteTalk分组提示词与Flash Talk/KJ高动态版</title>
      <link>https://bbs.monster/thread-4115-1-1.html</link>
      <description><![CDATA[作者：@T8star-Aix




一句话导读：这一期围绕数字人全家桶展开，重点整理 Wan2.2 InfiniteTalk 高动态分组提示词、Flash Talk 自适应版、KJ 高动态版，以及单人/多人循环版等数字人工作流方向。

核心内容：
1. 视频聚焦数字人口播和视频生成工作流的组合使用，强调 ...]]></description>
      <category>数字人</category>
      <author>t8star</author>
      <pubDate>Wed, 04 Feb 2026 10:14:13 +0000</pubDate>
    </item>
    <item>
      <title>Soul不再低调！发布 FlashTalk：一张图+一段话，快速生成唇形同步数字人视频</title>
      <link>https://bbs.monster/thread-3106-1-1.html</link>
      <description><![CDATA[Soul APP旗下AI Lab重磅发布FlashTalk！这是一款超低延迟的实时数字人驱动框架。仅需一张图+一段音频，即可在RTX 4090上实现130 FPS的惊人推理速度。完美解决ID漂移与口型不同步问题，支持写实/动漫双风格，实时交互数字人迎来了新霸主！一、SoulX-FlashTalk最新数字人 ...]]></description>
      <category>数字人</category>
      <author>嘟先生</author>
      <pubDate>Fri, 30 Jan 2026 08:00:00 +0000</pubDate>
    </item>
    <item>
      <title>开源接力！LongCat Video Avatar全面测试及说明！Vs Infinite Talk...</title>
      <link>https://bbs.monster/thread-2692-1-1.html</link>
      <description><![CDATA[王炸，AI自动漫剧短剧:https://www.bilibili.com/video/BV1pRCABsE9y/
自动版AI真人短剧：https://www.bilibili.com/video/BV1h1maBZEFm/
自动AI推文矩阵号（变现全流程教程）：https://www.bilibili.com/video/BV1BrmBBREhm/
自动AI推文矩阵号（软件使用教程）：ht ...]]></description>
      <category>数字人</category>
      <author>t8star</author>
      <pubDate>Sun, 21 Dec 2025 15:41:54 +0000</pubDate>
    </item>
    <item>
      <title>魔珐星云：免费体验企业级3D AI数字人智能客服！告别枯燥对话框！</title>
      <link>https://bbs.monster/thread-2624-1-1.html</link>
      <description><![CDATA[引言
随着大语言模型技术的快速发展，人工智能交互正在从纯文本对话向多模态、具身化方向演进。今天，魔珐科技（XMOV） 携手 魔搭社区（ModelScope），在创空间正式上线了 「魔珐星云智能客服 Demo」！这是一个基于超写实3D数字人技术的具身智能交互平台。该平台实现了A ...]]></description>
      <category>数字人</category>
      <author>魔搭社区</author>
      <pubDate>Wed, 17 Dec 2025 07:49:48 +0000</pubDate>
    </item>
    <item>
      <title>最强数字人实战记录——数字人做内容</title>
      <link>https://bbs.monster/thread-197-1-1.html</link>
      <description><![CDATA[用到的技术是infinite
实战效果展示：
【别只当听众了！AI音乐MV从流量收益到个人IP的变现路径全解析，这可能是普通人弯道超车的最佳机会。】 https://www.bilibili.com/video/BV1sunmz5Ep6/?share_source=copy_web&amp;vd_source=f6e0f26944b5466b2d546e2ed0a44890

使用的 ...]]></description>
      <category>数字人</category>
      <author>老胡用AI画梦</author>
      <pubDate>Tue, 30 Sep 2025 17:11:35 +0000</pubDate>
    </item>
    <item>
      <title>InfiniteTalk数字人优化版0926,4步采样,8G显存可用</title>
      <link>https://bbs.monster/thread-160-1-1.html</link>
      <description><![CDATA[InfiniteTalk数字人优化版0926,4步采样,8G显存可用,高清放大,批量任务队列,基于comfyui,工作流_哔哩哔哩_bilibili



大家好，针对 InfiniteTalk 数字人进行了更新，新增了高清放大功能；同时修复了视频数字人的抽帧逻辑，并将其调整为全量补帧模式。操作上，双击即可 ...]]></description>
      <category>数字人</category>
      <author>刘悦的技术博客</author>
      <pubDate>Sat, 27 Sep 2025 14:39:13 +0000</pubDate>
    </item>
    <item>
      <title>HeyGem数字人优化加速版,原生支持50系显卡,4G显存占用</title>
      <link>https://bbs.monster/thread-44-1-1.html</link>
      <description><![CDATA[HeyGem数字人优化加速版,支持面部角色保存,支持API接口调用,支持原始分辨率和帧率,GFPGAN超分,修复多面部报错,推理速度1比2,唱歌数字人_哔哩哔哩_bilibili




大家好，本次为大家分享最新版 HeyGem 数字人。该版本修复了此前反馈的两项问题，分别是面部超分无法关闭的 ...]]></description>
      <category>数字人</category>
      <author>刘悦的技术博客</author>
      <pubDate>Sat, 13 Sep 2025 06:00:00 +0000</pubDate>
    </item>
  </channel>
</rss>