图像生成
FLUX 3 Image
Black Forest Labs FLUX 3 Image:文生图、单图编辑与最多 10 张多图参考,提示词内 bbox 控制布局,按输出档位按张计费
POST
FLUX 3 Image
FLUX 3 Image 是 Black Forest Labs 的第三代图像模型。同一个模型完成文生图、单图编辑和最多 10 张参考图的多图参考,输出分
提交成功后返回
通用的
只有成功出图才计费。任务失败、取消,或没有返回可用图片时,全额退款。最终费用以任务响应里的
要移动某个元素,
768sq 到 4k 五档;在提示词里给元素打标签并附上 bbox,可以指定布局或只改画面的某一块,写法见「使用示例」。FLUX.2 与 FLUX.1 Kontext 见 FLUX 系列。
快速开始
task_id。用 GET /v1/tasks/{task_id} 查询结果,也可以用 Prefer: wait 在一次调用里等待,或配置 Webhook。
请求参数
string
必填
固定为
flux-3-image。string
默认值:"generate"
generate:根据文字生成图片,不接受参考图edit:基于参考图编辑,必须提供image_urls。传 1 张是单图编辑,传 2–10 张是多图参考
string
必填
图片描述或编辑指令。不支持负面提示词,想要的画面请正面描述。可以用
<标签> 指代画面元素,并在同一个字符串末尾附上 bbox 数组来指定布局或局部编辑的区域,见「使用示例」。string[]
参考图片 URL 数组。
edit 时必填,最多 10 张;generate 不接受。参考图按顺序编号,提示词里用 ref_image_0、ref_image_1……或 Image 1、Image 2……指代。参考图不另计费。string
默认值:"auto"
画面比例:
auto、21:9、2:1、16:9、3:2、7:5、4:3、5:4、1:1、4:5、3:4、5:7、2:3、9:16、1:2、9:21。auto 时:edit 跟随第一张参考图的画幅;generate 按提示词决定,定不下来时为 1:1。string
默认值:"1k"
输出档位,也是计费档位:
768sq(约 768×768 方图)、1k(约 1 MP)、1.5k(约 2 MP)、2k(约 4 MP)、4k(约 16 MP)。实际像素尺寸以返回的图片为准。4k 出图可能需要几分钟。integer
默认值:"1"
生成数量,取值
1。每次请求返回一张图。integer
默认值:"2"
内容安全容忍度,
0–4,0 最严格,数值越大越宽松。boolean
默认值:"true"
是否允许生成前进行网页或图片检索,传
false 关闭。callback_url、callback_events、Prefer: wait、Idempotency-Key 和费用上限请求头见提交任务。
本模型不接受 seed、steps、guidance、output_format、prompt_upsampling、negative_prompt、mask_url,也不接受 width、height 这类像素尺寸:分辨率用 resolution 选,画幅用 aspect_ratio 选。传入这些参数或以上之外的参数会返回 400,不计费。
限制
计费
按成功出图的固定张价结算,resolution 是唯一的计费维度:768sq、1k、1.5k、2k、4k 各一档,档位越高越贵。generate 与 edit 同价,参考图不另计费,画幅、提示词长度、grounding 与 safety_tolerance 都不影响价格,提交前即可确定单次费用。每次请求出 1 张图,按 1 张计费。
不传 resolution 时按默认档 1k 计费。price_config.image_prices 里的 default 是兜底价,与 1k 档相同。
单价见
GET /v1/models 返回的 price_config,或控制台「模型市场」。看这一单实际花了多少:任务响应里的 cost(整数 quota,500,000 quota = 1 USD)。cost 为准,它是整数 quota 不是美元。
响应
任务完成
result.images 返回生成的图片,url 是数组,expires_at 是图片链接的过期时间戳。完整字段说明见查询任务状态。
使用示例
布局和局部编辑都写在prompt 里,不是独立的请求参数:先用自然语言写指令,用 <标签> 指代元素(如 <car_1>),再在同一个字符串末尾附上一个 JSON 数组,每个对象描述一个框。
所有框都按
[y1, x1, y2, x2](上、左、下、右)书写,坐标是 0–1000 的归一化值:左上角 [0, 0],右下角 [1000, 1000],不是像素。
局部编辑
把框内的汽车改成红色,背景原样保留。以下是请求体,提交方式同「快速开始」:from 指向参考图,src_bbox 写原位置,tgt_bbox 写新位置。
文生图布局
不带参考图时,每个框用id、bbox、desc 三个字段。坐标网格随画幅拉伸,所以要显式传 aspect_ratio:
- bbox 数组是
prompt字符串的一部分,手写 JSON 时内部双引号要转义成\";用 SDK 或 JSON 序列化生成请求体时会自动转义。 - 提示词里的标签与数组里的
id一一对应;ref_image_0这类标识指向输入的参考图。 - 需要保留的区域也要列出来,在
desc里写明保留要求。 - 局部编辑靠 bbox 完成,本模型不接受
mask_url。