视频生成
Kling 系列
快手可灵视频模型:文生视频、首尾帧、参考图与参考视频、视频编辑与动作控制,kling-v3 / kling-v3-omni 支持 4K
POST
Kling 系列
快手可灵(Kling)的视频模型线,当前有 7 个模型:通用生成的
提交成功后返回
多镜头与参考主体(
带角色图片(
动作控制(
通用的
只有成功出片才计费。任务失败、取消,或没有返回可用视频时,全额退款。最终费用以任务响应里的
kling-3.0-turbo、kling-v2-6、kling-v3,带参考视频与视频编辑能力的 kling-v3-omni、kling-video-o1,以及做动作迁移的 kling-v2-6-motion-control、kling-v3-motion-control。它们共用同一个任务接口 POST /v1/tasks,换模型只改 model,但支持的动作、参数与时长各不相同,逐项差异见「可用模型」。
快速开始
task_id。用 GET /v1/tasks/{task_id} 查询结果,也可以用 Prefer: wait 在一次调用里等待,或配置 Webhook。
请求参数
string
必填
模型 ID,取值见「可用模型」。
string
默认值:"generate"
generate:生成视频,7 个模型都支持edit:编辑源视频,只有kling-v3-omni和kling-video-o1支持;必须提供video_urls
string
必填
视频描述或编辑指令。
kling-v3-omni 与 kling-video-o1 用 <<<image_N>>> 引用 image_urls 中第 N 张图(N 从 1 起);提示词里没有任何引用时,自动在开头加 <<<image_1>>>。kling-v3 与 kling-v3-omni 用 element_list 时用 @主体名 引用参考主体。integer
默认值:"1"
生成数量,取值
1。每次任务返回一个视频。integer
必填
输出时长(秒),按模型取值:
kling-3.0-turbo、kling-v3、kling-v3-omni:3–15的整数kling-v2-6、kling-video-o1:5或10kling-v2-6-motion-control、kling-v3-motion-control:传0,表示跟随参考视频时长action: "edit"(kling-v3-omni/kling-video-o1):传0,表示沿用源视频时长
string
默认值:"720p"
输出分辨率档:
720p、1080p;kling-v3、kling-v3-omni 另有 4k。string
画面比例:
16:9、9:16 或 1:1。两个 *-motion-control 不接受这个参数。传了参考图时输出比例跟随输入图。string[]
参考图 URL 数组:
kling-3.0-turbo:最多 1 张,作首帧kling-v2-6、kling-v3、kling-video-o1:最多 2 张;两张时为首帧与尾帧kling-v3-omni:最多 7 张,与element_list里的多图主体合计不超过 7 个- 两个
*-motion-control:必填,1 张角色参考图 - 带
video_urls时(kling-v3-omni/kling-video-o1)最多 1 张;action: "edit"不接受参考图
string[]
参考视频 URL 数组,最多 1 个:
kling-v3-omni、kling-video-o1:action: "generate"时作运镜与特征参考,action: "edit"时作待编辑的源视频;长度 3–10 秒- 两个
*-motion-control:必填,动作来源视频;长度上限 30 秒
string
负面提示词。
kling-v2-6、kling-v3、kling-v3-omni 支持。boolean
默认值:"false"
是否生成原生音频。
kling-v2-6、kling-v3、kling-v3-omni 支持;kling-v2-6 只在 resolution: "1080p" 时可用,kling-v3-omni 不能与 video_urls 同时使用。boolean
是否给输出视频加水印。除
kling-video-o1 外的 6 个模型支持。多镜头与参考主体(kling-v3 / kling-v3-omni)
boolean
默认值:"false"
开启多镜头分镜模式。
string
分镜方式:
customize 自定义镜头 / intelligence 智能分镜;multi_shot: true 时必填。array
多镜头分镜列表(1–6 项),每项
{ index, prompt, duration };index 从 1 连续递增,各段 duration 之和须等于顶层 duration;需 multi_shot: true。array
参考主体列表(最多 3 个),每项
{ name, description, element_input_urls };element_input_urls 为 2–4 张图片,首张为正面照;提示词中用 @name 引用该主体。带角色图片(kling-v3-omni / kling-video-o1)
array
带角色的图片数组,每项
{ url, role },role 取 first_frame / last_frame / reference;与 first_frame_image / last_frame_image 合并发送。动作控制(kling-v2-6-motion-control / kling-v3-motion-control)
string
必填
人物朝向以参考图或参考视频为准:
image 或 video。两种取值对参考视频长度的要求不同,见「限制」。string
默认值:"yes"
是否保留动作参考视频的原音轨:
yes 或 no。callback_url、callback_events、Prefer: wait、Idempotency-Key 和费用上限请求头见提交任务。
Kling 系列不接受 seed、quality 和 size。以上之外的参数会返回 400,不计费。
限制
时长跟随参考视频的请求(两个
*-motion-control,以及 action: "edit")需要能从视频链接读出时长,读不到会返回 400,不计费;常见的 MP4 / WebM 链接都可以。
计费
按分辨率档 × 输出秒数计费。resolution 决定档位(720p / 1080p / 4k),秒数取这一单实际的输出时长。参考图张数不影响价格。
出现下面两种情况时,换一档每秒单价,仍然只乘输出秒数:
- 原生音频:
generate_audio: true时走带声档。kling-v3、kling-v3-omni两个分辨率都有带声档,kling-v2-6只有 1080p 有。 - 参考视频:
kling-v3-omni与kling-video-o1提供了video_urls时走参考视频档,action: "generate"与action: "edit"都算。参考视频本身的秒数不另计费。
4k 档(kling-v3、kling-v3-omni)只有一个每秒单价,原生音频、参考视频不改变档位。
输出秒数怎么定:
- 传了具体
duration的请求,按duration计费。 duration: 0的请求(两个*-motion-control,以及action: "edit"),输出时长跟随参考视频或源视频,按从该视频读到的时长计费。
各模型的单价见
GET /v1/models 返回的 price_config,或控制台「模型市场」。看这一单实际花了多少:任务响应里的 cost(整数 quota,500,000 quota = 1 USD)。cost 为准,它是整数 quota 不是美元。
响应
任务完成
result.videos 返回生成的视频,expires_at 是链接失效时间,到期前请自行转存。完整字段说明见查询任务状态。
可用模型
按能力挑模型:
- 原生音频(
generate_audio):kling-v2-6(仅1080p)、kling-v3、kling-v3-omni - 多镜头分镜与参考主体(
multi_shot/shot_type/multi_prompt/element_list):kling-v3、kling-v3-omni - 带角色图片(
image_with_roles):kling-v3-omni、kling-video-o1 - 视频编辑与参考视频(
action: "edit"/video_urls):kling-v3-omni、kling-video-o1 - 动作迁移(
character_orientation/keep_original_sound):kling-v2-6-motion-control、kling-v3-motion-control - 负面提示词(
negative_prompt):kling-v2-6、kling-v3、kling-v3-omni