/v1/tasks 调用。视频生成通常耗时 10 秒到几分钟不等,提交后返回 task_id,通过轮询或 Webhook 回调获取结果。
请求端点
支持的模型
Veo 系列
Google Veo 3.1 — 官方版 Fast / Quality 按秒计费;经济版 Lite 与 Fast / Quality 逆向档整片价,逆向档支持续写
Seedance 系列
字节跳动 Seedance 1.0 Pro / 1.0 Pro Fast / 1.5 Pro / 2.0 / 2.0 Fast / 2.0 Mini / 2.5,2.5 支持视频编辑与延长
Kling 系列
快手可灵 3.0 Turbo / v2.6 / v3 / v3 Omni / Video O1,另有两档运动控制
Hailuo 系列
MiniMax 海螺 02 / 2.3 / 2.3 Fast,文生、首帧与首尾帧
MiniMax H3
MiniMax H3 / H3 Max 文生 / 参考生视频,H3 Regeneration 把成片重渲染为原生 2K
Vidu Q3 系列
生数科技 Vidu Q3 / Q3 Mix / Q3 Pro / Q3 Turbo,起始帧、首尾帧与参考图
Vidu Q4 Preview
生数科技 Vidu Q4 Preview,首帧图生视频,或最多 15 张参考图加 3 段参考音频,最高 4K
万相 Wan 系列
阿里通义万相 2.5 / 2.6 / 2.6 i2v / 2.7 / 2.7 R2V / 2.7 VideoEdit / 3.0,文生、图生、参考生与视频编辑
HappyHorse 系列
阿里云百炼欢马 1.0(含视频编辑)/ 1.1,文生、图生与参考生视频
FLUX 3 Video
Black Forest Labs FLUX 3 Video 标准 / Draft 两档,关键帧与续写,自带同步音频
SkyReels V4 系列
昆仑万维 SkyReels V4 Fast / Standard,多模态参考
Grok Imagine Video 系列
xAI Grok Imagine Video 官方档、1.5 官方与逆向档,文生与图生视频
PixVerse V6
PixVerse V6,可选生成带声音视频
Omni 视频系列
Omni-Flash-Ext 固定时长档(首帧、参考图、参考视频作动作参考),Gemini Omni 1.1 Flash / Flash Preview 由模型决定时长
通用参数(全系列共有)
各模型实际支持范围不同,详见各 vendor 文档。
string
必填
模型 ID(group_name),从上面的 vendor 文档选择
string
默认值:"generate"
generate — 本模型唯一动作。模式不靠 action 区分,靠传什么: 只给 prompt 是文生视频;带 image_urls 是图生视频;带 first_frame_image + last_frame_image 是首尾帧;带 video_urls / audio_urls 是参考生视频。string
视频描述文本,T2V 必填;其他模式可选作引导
integer
视频时长(秒),范围取决于模型
string
画面宽高比,如
16:9 / 9:16 / 1:1 等string
输出分辨率,如
720p / 1080p / 4Kstring[]
参考图片 URL 数组(I2V / R2V 用)
string
视频首帧图 URL(首尾帧模式用)
string
视频尾帧图 URL,需配合
first_frame_imagestring[]
参考视频 URL 数组,单元素即可(视频续写 / R2V 视频参考 / 视频编辑用)
参考视频计费因厂商而异,详见各模型页,以及下面的 输入视频的时长与计费。
string[]
参考音频 URL 数组,单元素即可(驱动音 / 自定义配音用)
输入视频的时长与计费
传video_urls 的请求(参考视频 / 视频编辑 / 运动控制)按下面三条处理。
怎么算秒数 —— 网关会读取视频文件头得到真实时长,按秒截断取整(10.9 秒算 10 秒),不足 1 秒按 1 秒。与上游口径一致。
算不出来会怎样 —— 若文件头无法解析(格式特殊、URL 不可达等),请求会被拒绝并返回 400 input_video_duration_unknown,不会扣费,而不是按上限估算收费。请改用常见容器格式(mp4 / webm)的可直接下载 URL。
提交前可预估 —— POST https://api.qingbo.ai/waveapi/quote 传入 video_urls 会返回这一单的准确价格,含探测到的输入秒数。
这是公开工具接口,不需要 API key。返回走标准信封 {code, message, data},data 里是:
被拒时
errorKey 会带具体原因(如 input_video_duration_unknown),message 里是可直接展示给用户的说明。
参考视频具体怎么进价格(计入秒数、只换档、还是替代整片价),按厂商不同,见各模型页的计费段。
提交响应示例
task_id 后调 GET /v1/tasks/{task_id} 轮询,直到 status = completed 取视频 URL。
生成模式速查
并非所有模型都支持全部模式 — 各 vendor 实际支持的
action 列表 + 字段范围请查看对应文档。后端会校验请求字段是否在 vendor 声明的能力范围内,不在范围会返回错误。字段命名规范
- 媒体引用统一复数 — 一律
image_urls/video_urls/audio_urls,即使单视频也用单元素数组["one.mp4"] - 画面比例统一
aspect_ratio— vendor 内部用size/ratio等是实现细节,无需感知 - 分辨率统一
resolution— vendor 内部用mode/quality等是实现细节 - 首尾帧字段带
_image后缀 —first_frame_image/last_frame_image(强调是图片资源)