/v1/tasks 调用。图像生成通常 1-30 秒完成,提交后返回 task_id,通过轮询或 Webhook 回调获取结果。
请求端点
支持的模型
Gemini 图像系列
Nano Banana 官方版三档与 Nano Banana 2.1 按实际 token 用量结算,经济版五档按张固定价,最多 14 张参考图
GPT Image 系列
GPT Image 1 / 1.5 / 2 / 2.5 官方版按实际 token 用量结算,GPT Image 2 / 2.5 逆向版按张固定价
Seedream 系列
字节跳动 Seedream 4.0 / 4.5 / 5.0 Lite / 5.0 Pro / 5.0 Flash,文生图与参考图编辑
Qwen Image 系列
阿里通义千问 Qwen Image 2.0 / 2.0 Pro / 3.0 / 3.0 Pro,文字渲染强
Wan Image 系列
阿里通义万相 Wan 2.7 Image / Image Pro,文生图、参考图编辑、框选编辑与配色主题
Z-Image
Z-Image-Turbo,轻量快速,中英双语
FLUX 系列
Black Forest Labs FLUX.2 Pro / Max / Flex 与 Kontext Pro / Max,文生图与参考图编辑
FLUX 3 Image
Black Forest Labs FLUX 3 Image,文生图、单图编辑与最多 10 张参考图,最高 4K
Grok Imagine 系列
xAI Grok Imagine 1.5 逆向档、2.0 官方与逆向档、高质量档,文生图与参考图编辑
Midjourney
imagine 一次出四张,放大、变体、缩放、平移、重绘等 12 种链式动作
MAI-Image-2.6
微软 MAI-Image-2.6 与 Flash,文生图、单图编辑与最多 5 张参考图合成,按实际 token 用量结算
两条调用路径
图像有两个入口,计费完全相同,差别在参数校验和返回方式:用 OpenAI SDK 迁移时,把
base_url 指向 https://api.qingbo.ai/v1,model 换成对应的模型 ID 即可。
各模型独有的能力(掩码 mask_url、1k / 2k / 4k 分辨率档、参考图张数上限等)以任务接口的文档为准,
各模型页描述的都是任务接口的参数。通用参数(全系列共有)
各模型实际支持范围不同,详见各 vendor 文档。
string
必填
模型 ID(group_name),从上面的 vendor 文档选择
string
默认值:"generate"
generate— 文生图(默认)edit— 图像编辑,配合image_urls使用
prompt 是文生图;带一张 image_urls 是图生图;带多张是多图参考融合;再带 mask_url 就是局部重绘。string
必填
图像描述文本,支持中英文
integer
默认值:"1"
生成数量(部分 vendor 限制单次张数)
integer
默认值:"-1"
随机种子,
-1 为随机;固定值可复现相似结果string
画面宽高比,如
16:9 / 9:16 / 1:1,部分 vendor 支持 auto(智能选择)string
输出分辨率,如
1K / 2K / 4K,各 vendor 支持范围不同string[]
参考图片 URL 数组(图生图 / 多图参考用)
提交响应示例
task_id 后调 GET /v1/tasks/{task_id} 轮询,直到 status = completed 取图片 URL。
模式速查
并非所有模型都支持全部模式 — 各 vendor 实际支持的
action 列表 + 字段范围请查看对应文档。后端会校验请求字段是否在 vendor 声明的能力范围内,不在范围会返回错误。字段命名规范
- 媒体引用统一复数 — 一律
image_urls,即使单张也用单元素数组["one.jpg"] - 画面比例统一
aspect_ratio— vendor 内部用size/ratio等是实现细节,无需感知 - 分辨率统一
resolution— vendor 内部用quality等是实现细节 - 遮罩字段
mask_url(GPT Image 官方版局部重绘用)