视频生成
Kling 系列
快手可灵视频生成 — v2.6 / v3 / v3-omni / video-o1 / 3.0-turbo / 运动控制,覆盖文生、图生、首尾帧、多模态参考、视频参考与运动控制
POST
Kling 系列
快手可灵 Kling 视频生成系列,7 个模型分四类:
质量档用
kling v3 家族(v3 / v3-omni / video-o1)的价格按质量模式分档,我们对外统一用
提交后用
对应
- kling-v3 — 新一代基础模型,质量档 720P / 1080P / 4K,原生支持有声视频(
generate_audio) - kling-v3-omni — v3 系列统一多模态接口,文生 / 图生 / 视频参考全走同一 endpoint,prompt 支持
<<<image_N>>>引用语法,支持有声与视频参考 - kling-v2-6 — 经典稳定版,720P / 1080P,1080P 可有声,语义与动态稳定性打磨
- kling-video-o1 — 推理增强视频模型,生成前对提示词与参考素材深度规划,物理一致性、复杂运动表现最优,支持视频参考
- kling-3.0-turbo — 极速档,普通分辨率 720P / 1080P,生成最快、单价最低,适合预览 / 批量
- kling-v3-motion-control / kling-v2-6-motion-control — 运动控制:用一张参考图(角色)+ 一段参考视频(运动),让参考角色复刻参考视频的动作
质量档用 resolution 表达
kling v3 家族(v3 / v3-omni / video-o1)的价格按质量模式分档,我们对外统一用 resolution 字段表达档位,网关内部映射到 kling 的 mode 参数:
kling-3.0-turbo 与两个 *-motion-control 是普通分辨率含义(720P / 1080P),不涉及质量档映射。
按 质量档 × 时长 计费,单位 $/秒:实际计费 = 该档每秒单价 × duration。
定价
各档为每秒单价(USD 售价)。开启有声(generate_audio:true)或挂视频参考(video_urls)会切换到对应高档单价。
kling-v3 / kling-v3-omni / kling-video-o1
有声加价(
generate_audio:true,仅 v3 / omni):
视频参考加价(挂
video_urls,仅 omni / o1):
kling-v2-6 / kling-3.0-turbo
运动控制(kling-v3-motion-control / kling-v2-6-motion-control)
单价为每秒;实际计费 = 该档每秒单价 ×
duration。开启 generate_audio 或挂 video_urls 视频参考会切换到对应高档单价;4K 有声与 4K 基价同价。调用示例
GET /v1/tasks/{task_id} 轮询状态,详见 任务系统。
可用模型
所有模型均支持
generate action;model ID 即上表取值。
通用参数
string
必填
视频描述文本。Omni / O1 中可用
<<<image_N>>> 语法引用 image_urls 第 N 张图(N 从 1 开始);运动控制档建议描述动作 / 镜头 / 风格string
默认值:"720P"
输出分辨率 / 质量档。各模型支持范围见 可用模型:
720P— v3 家族映射到标准模式(std)1080P— v3 家族映射到专业模式(pro)4K— v3 家族映射到 4K 模式(仅kling-v3/kling-v3-omni)
integer
默认值:"5"
视频时长(秒)。取值
5 或 10string
默认值:"16:9"
画面宽高比,仅文生(T2V)生效;图 / 视频参考模式跟随源素材比例。可选值:
16:9— 横版宽屏9:16— 竖版长屏1:1— 正方形
string[]
参考图片 URL 数组:
- 图生 / 首尾帧(v3 / v2.6 / o1 / 3.0-turbo):传 1 张作首帧;v3 / omni / o1 传 2 张自动作首帧 + 尾帧
- 多模态参考(omni / o1):多张图,可被
<<<image_N>>>引用 - 运动控制(两个
*-motion-control):必填,1 张作角色参考图
string[]
参考视频 URL 数组(单元素):
- 视频参考(omni / o1):一段参考视频,沿用其镜头 / 运动特征
- 运动控制(两个
*-motion-control):必填,运动来源视频,让参考角色复刻其动作
integer
随机种子,固定可复现结果
string[]
需要推送的事件类型,默认终态全推
模型特定参数
- kling-v3
- kling-v3-omni
- kling-v2-6
- kling-video-o1
- kling-3.0-turbo
- motion-control
特殊语法说明
<<<image_N>>> 提示词图片引用(Omni / O1 适用)
在 prompt 中用 <<<image_N>>> 占位符显式引用 image_urls 数组中的第 N 张图(N 从 1 开始)。模型会把占位符替换为对应图像内容,用于:
- 角色一致性 —
<<<image_1>>>锁定主体形象 - 场景拼合 —
<<<image_1>>>中的角色出现在<<<image_2>>>的环境 - 多素材引导 — 任意位置嵌入 N 张参考图
示例
image_urls:
Omni / O1 提供了图时若
prompt 未含任何 <<<image_N>>>,系统会自动在开头补 <<<image_1>>>。非 Omni / O1 的 v2.6 / v3 / 3.0-turbo 不解析该占位符,会作为字面文本送入模型。资源限制
相关文档
Kling 系列