Skip to main content
清波 API 支持多家视频生成模型,统一通过异步任务接口 /v1/tasks 调用。视频生成通常耗时 10 秒到几分钟不等,提交后返回 task_id,通过轮询或 Webhook 回调获取结果。

请求端点

异步流程详见 任务系统 — Submit → Status → Result + 可选 webhook。

支持的模型

Veo 系列

Google Veo 3.1 — 官方直连(Fast / Quality)+ 标准(Lite / Quality)

Seedance 系列

字节跳动 Seedance — 1.0 Pro / 1.5 Pro / 2.0(含 Face / Fast 子档)

Kling 系列

快手可灵 — v2.6 / v3 / v3-Omni / Video O1

Hailuo 系列

MiniMax 海螺 — 2.3 / 2.3 Fast,15 种运镜指令

Vidu 系列

生数科技 Vidu Q3 — Pro / Mix / Q3 / Turbo

Wan 系列

阿里通义万相 — 2.7 VideoEdit(视频编辑 / 风格迁移)

Skyreels

昆仑万维 SkyReels V4 — Fast / Standard,多模态参考

HappyHorse

阿里云百炼欢马 — 单模型自动路由 T2V/I2V/R2V/EDIT

Grok Imagine 视频

xAI Grok Imagine 1.0 Video — 6-30 秒,5 种比例

Sora 系列

OpenAI Sora 2 / Pro / Preview — 文生 / 图生视频,4-20 秒

Pixverse

Pixverse v6 — 360p–1080p,可选生成带声音视频

Omni Flash Ext

Omni-Flash-Ext — 视频续写扩展,按次计费

通用参数(全系列共有)

各模型实际支持范围不同,详见各 vendor 文档
string
必填
模型 ID(group_name),从上面的 vendor 文档选择
string
默认值:"generate"
操作类型,可选值取决于模型,常见:
  • generate — 文生视频(T2V)
  • image2video — 图生视频(I2V)
  • first_last_frame — 首尾帧
  • reference / reference_video — 参考生视频(R2V)
  • edit / video_edit / style_transfer — 视频编辑
  • video_continuation / extend — 视频续写
string
视频描述文本,T2V 必填;其他模式可选作引导
integer
视频时长(秒),范围取决于模型
string
画面宽高比,如 16:9 / 9:16 / 1:1
string
输出分辨率,如 720p / 1080p / 4K
string[]
参考图片 URL 数组(I2V / R2V 用)
string
视频首帧图 URL(首尾帧模式用)
string
视频尾帧图 URL,需配合 first_frame_image
string[]
参考视频 URL 数组,单元素即可(视频续写 / R2V 视频参考 / 视频编辑用)
string[]
参考音频 URL 数组,单元素即可(驱动音 / 自定义配音用)
string
Webhook 回调地址,任务终态时调用。详见 任务系统

提交响应示例

拿到 task_id 后调 GET /v1/tasks/{task_id} 轮询,直到 status = completed 取视频 URL。

生成模式速查

并非所有模型都支持全部模式 — 各 vendor 实际支持的 action 列表 + 字段范围请查看对应文档。后端会校验请求字段是否在 vendor 声明的能力范围内,不在范围会返回错误。

字段命名规范

  • 媒体引用统一复数 — 一律 image_urls / video_urls / audio_urls,即使单视频也用单元素数组 ["one.mp4"]
  • 画面比例统一 aspect_ratio — vendor 内部用 size / ratio 等是实现细节,无需感知
  • 分辨率统一 resolution — vendor 内部用 mode / quality 等是实现细节
  • 首尾帧字段带 _image 后缀first_frame_image / last_frame_image(强调是图片资源)

相关文档