Skip to main content
POST
Kling 系列
快手可灵(Kling)的视频模型线,当前有 7 个模型:通用生成的 kling-3.0-turbo、kling-v2-6、kling-v3,带参考视频与视频编辑能力的 kling-v3-omni、kling-video-o1,以及做动作迁移的 kling-v2-6-motion-control、kling-v3-motion-control。它们共用同一个任务接口 POST /v1/tasks,换模型只改 model,但支持的动作、参数与时长各不相同,逐项差异见「可用模型」。

快速开始

提交成功后返回 task_id。用 GET /v1/tasks/{task_id} 查询结果,也可以用 Prefer: wait 在一次调用里等待,或配置 Webhook。

请求参数

string
必填
模型 ID,取值见「可用模型」。
string
默认值:"generate"
  • generate:生成视频,7 个模型都支持
  • edit:编辑源视频,只有 kling-v3-omni 和 kling-video-o1 支持;必须提供 video_urls
string
必填
视频描述或编辑指令。kling-v3-omni 与 kling-video-o1 用 <<<image_N>>> 引用 image_urls 中第 N 张图(N 从 1 起);提示词里没有任何引用时,自动在开头加 <<<image_1>>>。kling-v3 与 kling-v3-omni 用 element_list 时用 @主体名 引用参考主体。
integer
默认值:"1"
生成数量,取值 1。每次任务返回一个视频。
integer
必填
输出时长(秒),按模型取值:
  • kling-3.0-turbo、kling-v3、kling-v3-omni:3–15 的整数
  • kling-v2-6、kling-video-o1:5 或 10
  • kling-v2-6-motion-control、kling-v3-motion-control:传 0,表示跟随参考视频时长
  • action: "edit"(kling-v3-omni / kling-video-o1):传 0,表示沿用源视频时长
string
默认值:"720p"
输出分辨率档:720p、1080p;kling-v3、kling-v3-omni 另有 4k。
string
画面比例:16:9、9:16 或 1:1。两个 *-motion-control 不接受这个参数。传了参考图时输出比例跟随输入图。
string[]
参考图 URL 数组:
  • kling-3.0-turbo:最多 1 张,作首帧
  • kling-v2-6、kling-v3、kling-video-o1:最多 2 张;两张时为首帧与尾帧
  • kling-v3-omni:最多 7 张,与 element_list 里的多图主体合计不超过 7 个
  • 两个 *-motion-control:必填,1 张角色参考图
  • 带 video_urls 时(kling-v3-omni / kling-video-o1)最多 1 张;action: "edit" 不接受参考图
string[]
参考视频 URL 数组,最多 1 个:
  • kling-v3-omni、kling-video-o1:action: "generate" 时作运镜与特征参考,action: "edit" 时作待编辑的源视频;长度 3–10 秒
  • 两个 *-motion-control:必填,动作来源视频;长度上限 30 秒
string
负面提示词。kling-v2-6、kling-v3、kling-v3-omni 支持。
boolean
默认值:"false"
是否生成原生音频。kling-v2-6、kling-v3、kling-v3-omni 支持;kling-v2-6 只在 resolution: "1080p" 时可用,kling-v3-omni 不能与 video_urls 同时使用。
boolean
是否给输出视频加水印。除 kling-video-o1 外的 6 个模型支持。

多镜头与参考主体(kling-v3 / kling-v3-omni)

boolean
默认值:"false"
开启多镜头分镜模式。
string
分镜方式:customize 自定义镜头 / intelligence 智能分镜;multi_shot: true 时必填。
array
多镜头分镜列表(1–6 项),每项 { index, prompt, duration };index 从 1 连续递增,各段 duration 之和须等于顶层 duration;需 multi_shot: true。
array
参考主体列表(最多 3 个),每项 { name, description, element_input_urls };element_input_urls 为 2–4 张图片,首张为正面照;提示词中用 @name 引用该主体。

带角色图片(kling-v3-omni / kling-video-o1)

array
带角色的图片数组,每项 { url, role },role 取 first_frame / last_frame / reference;与 first_frame_image / last_frame_image 合并发送。

动作控制(kling-v2-6-motion-control / kling-v3-motion-control)

string
必填
人物朝向以参考图或参考视频为准:image 或 video。两种取值对参考视频长度的要求不同,见「限制」。
string
默认值:"yes"
是否保留动作参考视频的原音轨:yes 或 no。
通用的 callback_url、callback_events、Prefer: wait、Idempotency-Key 和费用上限请求头见提交任务。 Kling 系列不接受 seed、quality 和 size。以上之外的参数会返回 400,不计费。

限制

时长跟随参考视频的请求(两个 *-motion-control,以及 action: "edit")需要能从视频链接读出时长,读不到会返回 400,不计费;常见的 MP4 / WebM 链接都可以。

计费

按分辨率档 × 输出秒数计费。resolution 决定档位(720p / 1080p / 4k),秒数取这一单实际的输出时长。参考图张数不影响价格。 出现下面两种情况时,换一档每秒单价,仍然只乘输出秒数:
  • 原生音频:generate_audio: true 时走带声档。kling-v3、kling-v3-omni 两个分辨率都有带声档,kling-v2-6 只有 1080p 有。
  • 参考视频:kling-v3-omni 与 kling-video-o1 提供了 video_urls 时走参考视频档,action: "generate" 与 action: "edit" 都算。参考视频本身的秒数不另计费。
4k 档(kling-v3、kling-v3-omni)只有一个每秒单价,原生音频、参考视频不改变档位。 输出秒数怎么定:
  • 传了具体 duration 的请求,按 duration 计费。
  • duration: 0 的请求(两个 *-motion-control,以及 action: "edit"),输出时长跟随参考视频或源视频,按从该视频读到的时长计费。
各模型的单价见 GET /v1/models 返回的 price_config,或控制台「模型市场」。看这一单实际花了多少:任务响应里的 cost(整数 quota,500,000 quota = 1 USD)。
只有成功出片才计费。任务失败、取消,或没有返回可用视频时,全额退款。最终费用以任务响应里的 cost 为准,它是整数 quota 不是美元。

响应

任务完成
result.videos 返回生成的视频,expires_at 是链接失效时间,到期前请自行转存。完整字段说明见查询任务状态。

可用模型

按能力挑模型:
  • 原生音频(generate_audio):kling-v2-6(仅 1080p)、kling-v3、kling-v3-omni
  • 多镜头分镜与参考主体(multi_shot / shot_type / multi_prompt / element_list):kling-v3、kling-v3-omni
  • 带角色图片(image_with_roles):kling-v3-omni、kling-video-o1
  • 视频编辑与参考视频(action: "edit" / video_urls):kling-v3-omni、kling-video-o1
  • 动作迁移(character_orientation / keep_original_sound):kling-v2-6-motion-control、kling-v3-motion-control
  • 负面提示词(negative_prompt):kling-v2-6、kling-v3、kling-v3-omni

相关文档