Skip to main content
先在人脸识别 Tab 获取 session_id 和 face_id,再到对口型 Tab 提交任务。音频输入为 face_choose[].audio_id 或 face_choose[].sound_file,两者二选一。需要从文本开始时,先调用 Kling 数字人 TTS,并使用其返回的音频 id。

创建任务

POST /kling/v1/videos/advanced-lip-sync
cURL

请求头

string
必填
Bearer 鉴权,格式为 Bearer YOUR_API_KEY。
string
默认值:"application/json"
必填
数据交换格式。

请求体

string
必填
人脸识别返回的会话 ID。
object[]
必填
人脸和驱动音频配置,只能传入一个条目。
string
必填
人脸识别在 data.face_data[].face_id 中返回的人脸 ID。
string
30 天内生成的音频 ID,所选音频时长须为 2~60 秒。与 sound_file 必须二选一。
string
音频公网 URL 或纯 Base64。AnyFast 已验证 MP3、WAV、M4A;文件不超过 5 MB,时长 2~60 秒。与 audio_id 必须二选一。
integer
必填
源音频裁剪起点,单位毫秒。
integer
必填
源音频裁剪终点,单位毫秒,不得超过源音频总时长。
integer
必填
裁剪后音频在视频中的插入位置,单位毫秒。插入片段须位于视频内,并与所选人脸至少重合 2 秒。
number
默认值:1
插入音频音量,范围 0~2。
number
默认值:1
原视频音量,范围 0~2。
object
水印配置。
boolean
是否生成含水印结果。
string
任务状态通知的公网回调地址。

创建响应

200
integer
业务结果码,0 表示请求已受理。
string
业务信息,成功时可能为空。
string
请求 ID 字段,当前可能为空。
string
用于查询结果的 AnyFast 任务 ID。
string
初始任务状态,任务受理后为 submitted。
integer
创建时间,Unix 毫秒时间戳。
integer
更新时间,Unix 毫秒时间戳。

查询任务

GET /kling/v1/videos/advanced-lip-sync/{task_id}
cURL

请求头和路径

string
必填
Bearer 鉴权,格式为 Bearer YOUR_API_KEY。
string
必填
创建任务时返回的 AnyFast 任务 ID。

响应

200
integer
业务结果码,0 表示成功。
string
业务信息,成功时可能为空。
string
AnyFast 任务 ID。
string
任务状态:submitted、processing、succeed 或 failed。
string
任务失败时的错误信息。
object[]
任务成功后返回的视频结果。
string
生成视频 URL。
string
接口返回的视频时长,单位为秒。
integer
创建时间,Unix 毫秒时间戳。
integer
更新时间,Unix 毫秒时间戳。