图像生成
Midjourney
出图之后还能放大、变体、扩图和局部重绘的图像模型
POST
Midjourney
Midjourney 以高美学的艺术输出见长,默认渲染 2K 图像,
提交成功后返回
通用的
niji 版本擅长动漫风格。这里只有 midjourney 一个模型 ID,一次调用做什么由 action 决定:imagine 从提示词出一组四宫格,其余动作都在上一步任务的结果上继续加工。所有动作都通过统一任务接口 POST /v1/tasks 提交。
快速开始
出图张数以任务完成后
result.images 的实际条目数为准。
imagine 之外的动作都要 ref_task_id,传的是上一步任务的 task_id,串法见使用示例。
task_id。用 GET /v1/tasks/{task_id} 查询结果,也可以用 Prefer: wait 在一次调用里等待,或配置 Webhook。
请求参数
string
必填
固定为
midjourney。string
默认值:"imagine"
这次调用做什么,取值见上表。
string
提示词。
imagine 与 edit 必填;modal、remix-strong、remix-subtle 可选,留空时沿用来源任务的提示词。也可以直接在提示词里写 Midjourney 原生 flag(如 --ar 16:9),同名的结构化参数优先。string
输出画幅:
1:1、16:9、9:16、4:3、3:4、3:2、2:3、21:9 或 9:21。string[]
参考图 URL。
imagine 传入即为垫图生成;edit 必填,是要改写的原图。integer
随机种子,仅
imagine 生效。string
要排除的元素,仅
imagine 生效。string
默认值:"relax"
生成速度档:
relax、fast 或 turbo,直接影响价格。全部动作可用。string
Midjourney 模型版本:
v5.1、v5.2、v6.1、v7、v8.1、v8.2、niji6 或 niji7。链式动作沿用来源任务的版本。string
来源任务的
task_id,即上一步任务的 ID。imagine 之外的动作必填。integer
对来源四宫格里的第几张操作,取值
1–4(左上、右上、左下、右下)。upscale、variation、high-variation、low-variation、zoom、pan、inpaint、edit、remix-strong、remix-subtle 必填。string
直接指定来源任务上的操作按钮 ID,同时传了
index 时以 custom_id 为准。可用于 upscale、variation、high-variation、low-variation、reroll、zoom、pan、inpaint。number
仅
zoom。外扩倍数:小于 2 按 1.5 倍外扩,大于等于 2 按 2 倍。string
仅
pan。平移扩展的方向:left、right、up 或 down。string
仅
modal。掩码图 URL,透明区域重绘、白色区域保留原图。局部重绘时必填,不传时按外扩处理。object
自定义元数据对象,随请求原样带给上游。
string
仅
imagine。风格开关(--style),例如 raw。integer
仅
imagine。风格化强度(--s),范围 0–1000。integer
仅
imagine。四张结果之间的差异程度(--c),范围 0–100。integer
仅
imagine。怪异度(--w),范围 0–3000。boolean
仅
imagine。生成可无缝平铺的图案(--tile)。number
仅
imagine。垫图权重(--iw),范围 0–3,值越大越贴近 image_urls。string
仅
imagine。角色参考图 URL(--cref)。integer
仅
imagine。角色参考的贴合度(--cw),范围 0–100,配合 cref 使用。string
仅
imagine。风格参考图 URL(--sref)。integer
仅
imagine。风格参考的贴合度(--sw),范围 0–1000,配合 sref 使用。string
仅
imagine。深度参考图 URL(--dref)。number
仅
imagine。深度参考的贴合度(--dw),范围 0–100,配合 dref 使用。boolean
仅
imagine。原始风格(--raw),v5.1 起可用。boolean
仅
imagine。草图模式(--draft),v7 起可用。boolean
仅
imagine。高清输出(--hd),仅 v8.1 与 v8.2。integer
仅
imagine。提前停止(--stop),范围 10–100,仅 v5.1、v5.2、v6.1、niji6。string
仅
imagine。原样追加到提示词末尾的 Midjourney 原生 flag。callback_url、callback_events、Prefer: wait、Idempotency-Key 和费用上限请求头见提交任务。
本模型不接受 n、resolution、quality。以上之外的参数会返回 400,不计费。
限制
计费
按次固定价,两个计费维度:动作与speed 档。每个动作一个价,同一动作下 relax、fast、turbo 三档价格不同。imagine 一次返回 4 张图,按一次任务计费,不按张数。
单价见 GET /v1/models 返回的 price_config,或控制台「模型市场」。单次调用的实际花费见任务响应里的 cost——整数 quota,500,000 quota = 1 USD,不是美元。
version、画幅和提示词长度都不影响价格,参考图也不额外计费,提交前即可确定单次费用。请求的动作没有对应价格键时,按兜底价结算。
只有成功出图才计费。任务失败、取消,或没有返回可用图片时,全额退款。
响应
result.images 按四宫格的顺序返回图片,index 说的就是这个顺序:imagine 返回 4 项,upscale 返回 1 项。url 是数组,expires_at 是图片链接的过期时间戳。完整字段说明见查询任务状态。
使用示例
链式动作靠ref_task_id 串起来,传的是你自己上一步任务的 task_id,不是图片 URL,也不是上游的 ID。
1
出一组四宫格
调
imagine,拿到响应里的 task_id。这一步的 result.images 有 4 项。2
选一张继续
把上一步的
task_id 作为 ref_task_id,用 index 指定第几张。upscale 得到单图,variation 得到新的一组四宫格。3
在单图上接着做
upscale 产生的任务 ID 又可以作为下一步的 ref_task_id:zoom 外扩、pan 平移、inpaint 加 modal 局部重绘,可以一直串下去。