Skip to main content
POST
GPT Image 2 官方版
gpt-image-2 是 GPT Image 2 的官方 API 线路,适合产品图、海报、插画和基于参考图的视觉编辑。所有操作都通过统一任务接口 POST /v1/tasks 提交。
需要按固定张价调用时,可使用 gpt-image-2-rev。两条线路使用相同的任务接口,但模型 ID、参数和计费方式不同,不会自动互相切换。

快速开始

提交成功后返回 task_id。用 GET /v1/tasks/{task_id} 查询结果,也可以用 Prefer: wait 在一次调用里等待,或配置 Webhook。

请求参数

string
必填
固定为 gpt-image-2
string
默认值:"generate"
  • generate:根据文字生成图片
  • edit:编辑参考图;必须提供 image_urls
string
必填
图片描述或编辑指令。
string[]
参考图片 URL。edit 时必填,最多 16 张。
string
局部重绘掩码 URL。必须同时提供 image_urls,并与第一张参考图尺寸一致。
string
默认值:"1:1"
支持 1:13:22:34:33:45:44:516:99:162:11:23:11:321:99:21
string
默认值:"1k"
输出分辨率:1k2k4k
string
默认值:"low"
画质档位:lowmediumhigh。画质越高,生成成本通常越高。
integer
默认值:"1"
生成数量,取值 1。每次请求返回一张图。
string
默认值:"auto"
autoopaquetransparent。透明背景只支持 pngwebp
string
默认值:"png"
pngjpegwebp
integer
JPEG/WebP 压缩比例,范围 0100。使用时必须将 output_format 设为 jpegwebp
string
默认值:"auto"
内容审核强度:autolow
通用的 callback_urlcallback_eventsPrefer: waitIdempotency-Key 和费用上限请求头见提交任务 官方线路不支持 seed。以上之外的参数会返回 400,不计费。

限制

计费

官方线路按实际 token 用量计费,共五个计费维度:文本输入、缓存文本输入、图片输入、缓存图片输入、图片输出。 单价见 GET /v1/models 返回的 price_config,或控制台「模型市场」。单次调用的实际花费见任务响应里的 cost——整数 quota,500,000 quota = 1 USD,不是美元。 图片输入包括参考图和掩码。缓存费率仅在上游返回可用于结算的缓存用量时生效;没有缓存用量时只按普通输入和图片输出计费。

冻结与结算

提交任务时按预估用量冻结一笔额度,任务完成后按实际用量结算,差额退回。预估用量的算法是:
  • 输出:按画幅、分辨率和画质三项查表得到预计输出 token 数
  • 文本输入:不足 32 token 按 32 计
  • 参考图:每张按 4,096 token 计,掩码同样算作图片输入
输出 token 的量级差异很大:同一画幅下,high 档的预计输出 token 约是 low 档的 36 倍4k 又比 1k 高数倍,两者叠加后单张成本可以相差两个数量级。quality 是这条线路影响成本最大的参数,默认值为 low。画幅同样有影响:同一画质下,16:9 的输出 token 低于 1:1 各画幅 / 分辨率 / 画质组合的预估输出 token,见公开模型详情 GET /v1/modelsprice_config.image_usage_reservation 只有成功出图才计费。任务失败、取消,或没有返回可用图片时,全额退款。完整字段说明见任务状态

响应

任务完成
result.images 返回生成图片。任务失败或取消时冻结额度全额退款;如果上游返回成功但没有可交付图片,任务会按失败处理并退款。

相关文档