跳到主要内容
NAVSMAP

核心功能

对话驱动视频合成

核心能力是根据输入的语音和文本

口型同步

采用独特的“语音-视频窗口注意力”机制

多角色对话生成

支持在不同镜头间生成多个角色的轮流对话互动

关于 MoCha

MoCha 提供对话驱动视频合成、口型同步、多角色对话生成等功能。适合AI研究人员与开发者、电影与动画创作者、游戏开发者围绕相关任务使用。

对话驱动视频合成:核心能力是根据输入的语音和文本;口型同步:采用独特的“语音-视频窗口注意力”机制;多角色对话生成:支持在不同镜头间生成多个角色的轮流对话互动。

适合谁使用

  • AI研究人员与开发者
  • 电影与动画创作者
  • 游戏开发者