生成口播视频

提供一张正面人物图片,再选择已经生成的配音或上传音频。

正面、半身或近景效果更稳定长音频会在自然停顿处分段生成

排队和引擎启动不计费,完成后按实际 GPU 处理周期结算。上传文件直达对象存储,不经过应用服务器。请先选择人物图片和配音音频

请先选择人物图片和配音音频