Kling: Kling Avatar API
可灵数字人:一张人物图片(真人或卡通)加一段音频,生成口型同步、表情自然的说话视频,可用 prompt 描述动作、情绪和镜头。音频 2–300 秒,std / pro 两种模式。
- 输入模态: audio, image, text
- 输出模态: video
- 文件输入: 支持
- 发布日期: 2025-10-15
可灵数字人:一张人物图片(真人或卡通)加一段音频,生成口型同步、表情自然的说话视频,可用 prompt 描述动作、情绪和镜头。音频 2–300 秒,std / pro 两种模式。