AI 画布精选模板AI 视频工作流模板

Infinitetalk 数字人视频工作流:支持口播和唱歌

Infinitetalk 数字人作为当前效果最好的开源数字人方案,仅需一张单人图片和一段音频,就能生成生动自然的数字人视频。

AI 数字人Infinitetalk

如何使用?

整个工作流包含四步:

  1. 先生成数字人单人形象(文生图)
  2. 如果不满意,再优化编辑数字人形象(图生图,可选)
  3. 上传参考音色,输入口播文案,使用IndexTTS2 克隆模型生成口播音频(TTS)
  4. 再把口播音频和数字人形象,作为参考,供开源数字人模型(InfiniteTalk)生成数字人口播视频。(图片+音频生成视频)

常见问题?

可以上传数字人形象吗?

如果已经有合适的数字人形象,就可以跳过前两步,直接上传数字人形象。

可以上传音频吗?

如果已经有合适的音频,可以直接上传音频。确保含有人声。

支持唱歌吗?

支持唱歌,可以直接上传唱歌音频,生成唱歌数字人视频

生成的视频可以用于商业项目吗?

商业使用前,请确认你拥有提示词中涉及的品牌、人物、素材与音乐的必要权利,并遵守平台的服务条款和内容政策。避免上传或要求生成未经授权的受版权保护角色、商标或真人肖像。

数字人形象需要注意哪些方面?

图中仅包含一个主体人物,如果有多张主体脸,可能生成异常

有使用文档吗?

详细文档参考:https://lcn7iiucxqpv.feishu.cn/wiki/Fz8jwSPj9iIW7bkQ735cBfGgnrd