session_id 和 face_id,再到对口型 Tab 提交任务。音频输入为 face_choose[].audio_id 或 face_choose[].sound_file,两者二选一。需要从文本开始时,先调用 Kling 数字人 TTS,并使用其返回的音频 id。
- 对口型
- 人脸识别
创建任务
POST /kling/v1/videos/advanced-lip-synccURL
请求头
string
必填
Bearer 鉴权,格式为
Bearer YOUR_API_KEY。string
默认值:"application/json"
必填
数据交换格式。
请求体
string
必填
人脸识别返回的会话 ID。
object[]
必填
人脸和驱动音频配置,只能传入一个条目。
string
必填
人脸识别在
data.face_data[].face_id 中返回的人脸 ID。string
30 天内生成的音频 ID,所选音频时长须为 2~60 秒。与
sound_file 必须二选一。string
音频公网 URL 或纯 Base64。AnyFast 已验证 MP3、WAV、M4A;文件不超过 5 MB,时长 2~60 秒。与
audio_id 必须二选一。integer
必填
源音频裁剪起点,单位毫秒。
integer
必填
源音频裁剪终点,单位毫秒,不得超过源音频总时长。
integer
必填
裁剪后音频在视频中的插入位置,单位毫秒。插入片段须位于视频内,并与所选人脸至少重合 2 秒。
number
默认值:1
插入音频音量,范围
0~2。number
默认值:1
原视频音量,范围
0~2。object
水印配置。
boolean
是否生成含水印结果。
string
任务状态通知的公网回调地址。
创建响应
200
integer
业务结果码,
0 表示请求已受理。string
业务信息,成功时可能为空。
string
请求 ID 字段,当前可能为空。
string
用于查询结果的 AnyFast 任务 ID。
string
初始任务状态,任务受理后为
submitted。integer
创建时间,Unix 毫秒时间戳。
integer
更新时间,Unix 毫秒时间戳。
查询任务
GET /kling/v1/videos/advanced-lip-sync/{task_id}cURL
请求头和路径
string
必填
Bearer 鉴权,格式为
Bearer YOUR_API_KEY。string
必填
创建任务时返回的 AnyFast 任务 ID。
响应
200
integer
业务结果码,
0 表示成功。string
业务信息,成功时可能为空。
string
AnyFast 任务 ID。
string
任务状态:
submitted、processing、succeed 或 failed。string
任务失败时的错误信息。
object[]
任务成功后返回的视频结果。
string
生成视频 URL。
string
接口返回的视频时长,单位为秒。
integer
创建时间,Unix 毫秒时间戳。
integer
更新时间,Unix 毫秒时间戳。