Skip to main content
POST
FLUX 3 Image
FLUX 3 Image 是 Black Forest Labs 的第三代图像模型。同一个模型完成文生图、单图编辑和最多 10 张参考图的多图参考,输出分 768sq 到 4k 五档;在提示词里给元素打标签并附上 bbox,可以指定布局或只改画面的某一块,写法见「使用示例」。FLUX.2 与 FLUX.1 Kontext 见 FLUX 系列。

快速开始

提交成功后返回 task_id。用 GET /v1/tasks/{task_id} 查询结果,也可以用 Prefer: wait 在一次调用里等待,或配置 Webhook。

请求参数

string
必填
固定为 flux-3-image。
string
默认值:"generate"
  • generate:根据文字生成图片,不接受参考图
  • edit:基于参考图编辑,必须提供 image_urls。传 1 张是单图编辑,传 2–10 张是多图参考
string
必填
图片描述或编辑指令。不支持负面提示词,想要的画面请正面描述。可以用 <标签> 指代画面元素,并在同一个字符串末尾附上 bbox 数组来指定布局或局部编辑的区域,见「使用示例」。
string[]
参考图片 URL 数组。edit 时必填,最多 10 张;generate 不接受。参考图按顺序编号,提示词里用 ref_image_0、ref_image_1……或 Image 1、Image 2……指代。参考图不另计费。
string
默认值:"auto"
画面比例:auto、21:9、2:1、16:9、3:2、7:5、4:3、5:4、1:1、4:5、3:4、5:7、2:3、9:16、1:2、9:21。auto 时:edit 跟随第一张参考图的画幅;generate 按提示词决定,定不下来时为 1:1。
string
默认值:"1k"
输出档位,也是计费档位:768sq(约 768×768 方图)、1k(约 1 MP)、1.5k(约 2 MP)、2k(约 4 MP)、4k(约 16 MP)。实际像素尺寸以返回的图片为准。4k 出图可能需要几分钟。
integer
默认值:"1"
生成数量,取值 1。每次请求返回一张图。
integer
默认值:"2"
内容安全容忍度,0–4,0 最严格,数值越大越宽松。
boolean
默认值:"true"
是否允许生成前进行网页或图片检索,传 false 关闭。
通用的 callback_url、callback_events、Prefer: wait、Idempotency-Key 和费用上限请求头见提交任务。 本模型不接受 seed、steps、guidance、output_format、prompt_upsampling、negative_prompt、mask_url,也不接受 width、height 这类像素尺寸:分辨率用 resolution 选,画幅用 aspect_ratio 选。传入这些参数或以上之外的参数会返回 400,不计费。

限制

计费

按成功出图的固定张价结算,resolution 是唯一的计费维度:768sq、1k、1.5k、2k、4k 各一档,档位越高越贵。generate 与 edit 同价,参考图不另计费,画幅、提示词长度、grounding 与 safety_tolerance 都不影响价格,提交前即可确定单次费用。每次请求出 1 张图,按 1 张计费。 不传 resolution 时按默认档 1k 计费。price_config.image_prices 里的 default 是兜底价,与 1k 档相同。
单价见 GET /v1/models 返回的 price_config,或控制台「模型市场」。看这一单实际花了多少:任务响应里的 cost(整数 quota,500,000 quota = 1 USD)。
只有成功出图才计费。任务失败、取消,或没有返回可用图片时,全额退款。最终费用以任务响应里的 cost 为准,它是整数 quota 不是美元。

响应

任务完成
result.images 返回生成的图片,url 是数组,expires_at 是图片链接的过期时间戳。完整字段说明见查询任务状态。

使用示例

布局和局部编辑都写在 prompt 里,不是独立的请求参数:先用自然语言写指令,用 <标签> 指代元素(如 <car_1>),再在同一个字符串末尾附上一个 JSON 数组,每个对象描述一个框。 所有框都按 [y1, x1, y2, x2](上、左、下、右)书写,坐标是 0–1000 的归一化值:左上角 [0, 0],右下角 [1000, 1000],不是像素。

局部编辑

把框内的汽车改成红色,背景原样保留。以下是请求体,提交方式同「快速开始」:
要移动某个元素,from 指向参考图,src_bbox 写原位置,tgt_bbox 写新位置。

文生图布局

不带参考图时,每个框用 id、bbox、desc 三个字段。坐标网格随画幅拉伸,所以要显式传 aspect_ratio:
  • bbox 数组是 prompt 字符串的一部分,手写 JSON 时内部双引号要转义成 \";用 SDK 或 JSON 序列化生成请求体时会自动转义。
  • 提示词里的标签与数组里的 id 一一对应;ref_image_0 这类标识指向输入的参考图。
  • 需要保留的区域也要列出来,在 desc 里写明保留要求。
  • 局部编辑靠 bbox 完成,本模型不接受 mask_url。

相关文档