Skip to main content
POST
Kling 系列
快手可灵 Kling 视频生成系列,7 个模型分四类:
  • kling-v3 — 新一代基础模型,质量档 720P / 1080P / 4K,原生支持有声视频(generate_audio)
  • kling-v3-omni — v3 系列统一多模态接口,文生 / 图生 / 视频参考全走同一 endpoint,prompt 支持 <<<image_N>>> 引用语法,支持有声与视频参考
  • kling-v2-6 — 经典稳定版,720P / 1080P,1080P 可有声,语义与动态稳定性打磨
  • kling-video-o1 — 推理增强视频模型,生成前对提示词与参考素材深度规划,物理一致性、复杂运动表现最优,支持视频参考
  • kling-3.0-turbo — 极速档,普通分辨率 720P / 1080P,生成最快、单价最低,适合预览 / 批量
  • kling-v3-motion-control / kling-v2-6-motion-control运动控制:用一张参考图(角色)+ 一段参考视频(运动),让参考角色复刻参考视频的动作

质量档用 resolution 表达

kling v3 家族(v3 / v3-omni / video-o1)的价格按质量模式分档,我们对外统一用 resolution 字段表达档位,网关内部映射到 kling 的 mode 参数: kling-3.0-turbo 与两个 *-motion-control普通分辨率含义(720P / 1080P),不涉及质量档映射。 质量档 × 时长 计费,单位 $/秒:实际计费 = 该档每秒单价 × duration

定价

各档为每秒单价(USD 售价)。开启有声(generate_audio:true)或挂视频参考(video_urls)会切换到对应高档单价。

kling-v3 / kling-v3-omni / kling-video-o1

有声加价(generate_audio:true,仅 v3 / omni): 视频参考加价(挂 video_urls,仅 omni / o1):

kling-v2-6 / kling-3.0-turbo

运动控制(kling-v3-motion-control / kling-v2-6-motion-control)

单价为每秒;实际计费 = 该档每秒单价 × duration。开启 generate_audio 或挂 video_urls 视频参考会切换到对应高档单价;4K 有声与 4K 基价同价。

调用示例

提交后用 GET /v1/tasks/{task_id} 轮询状态,详见 任务系统

可用模型

所有模型均支持 generate action;model ID 即上表取值。

通用参数

string
必填
模型 ID,见 可用模型
string
必填
视频描述文本。Omni / O1 中可用 <<<image_N>>> 语法引用 image_urls 第 N 张图(N 从 1 开始);运动控制档建议描述动作 / 镜头 / 风格
string
默认值:"720P"
输出分辨率 / 质量档。各模型支持范围见 可用模型:
  • 720P — v3 家族映射到标准模式(std)
  • 1080P — v3 家族映射到专业模式(pro)
  • 4K — v3 家族映射到 4K 模式(仅 kling-v3 / kling-v3-omni)
integer
默认值:"5"
视频时长(秒)。取值 510
string
默认值:"16:9"
画面宽高比,仅文生(T2V)生效;图 / 视频参考模式跟随源素材比例。可选值:
  • 16:9 — 横版宽屏
  • 9:16 — 竖版长屏
  • 1:1 — 正方形
string[]
参考图片 URL 数组:
  • 图生 / 首尾帧(v3 / v2.6 / o1 / 3.0-turbo):传 1 张作首帧;v3 / omni / o1 传 2 张自动作首帧 + 尾帧
  • 多模态参考(omni / o1):多张图,可被 <<<image_N>>> 引用
  • 运动控制(两个 *-motion-control):必填,1 张作角色参考图
string[]
参考视频 URL 数组(单元素):
  • 视频参考(omni / o1):一段参考视频,沿用其镜头 / 运动特征
  • 运动控制(两个 *-motion-control):必填,运动来源视频,让参考角色复刻其动作
integer
随机种子,固定可复现结果
string
Webhook 回调地址,任务终态时调用。详见 回调机制
string[]
需要推送的事件类型,默认终态全推

模型特定参数

boolean
默认值:"false"
是否生成有声视频。各质量档均支持原生有声;开启后切换到对应「有声」单价(见 定价)

特殊语法说明

<<<image_N>>> 提示词图片引用(Omni / O1 适用) prompt 中用 <<<image_N>>> 占位符显式引用 image_urls 数组中的第 N 张图(N 从 1 开始)。模型会把占位符替换为对应图像内容,用于:
  • 角色一致性 — <<<image_1>>> 锁定主体形象
  • 场景拼合 — <<<image_1>>> 中的角色出现在 <<<image_2>>> 的环境
  • 多素材引导 — 任意位置嵌入 N 张参考图
示例
对应 image_urls:
Omni / O1 提供了图时若 prompt 未含任何 <<<image_N>>>,系统会自动在开头补 <<<image_1>>>。非 Omni / O1 的 v2.6 / v3 / 3.0-turbo 不解析该占位符,会作为字面文本送入模型。

资源限制

相关文档