模型上架
7 个新模型 · 文本 / 图片 / 视频
- 文本 · Anthropic:
claude-haiku-5-5—— Claude 5.5 系列的小型号,100 万 token 上下文,默认开启自适应思考,支持图片输入、函数调用与原生/v1/messages接口;单次输入超过 100K token 时整单按长上下文档计费。 - 图片 · Black Forest Labs:
flux-3-image—— FLUX 3 Image,文生图、单图编辑与最多 10 张参考图,五档输出最高 4K,可在提示词中用 bbox 控制布局与局部编辑;按张计费,参考图不计费。 - 图片 · Google:
gemini-nano-banana-2.1与gemini-nano-banana-2.1-rev—— Nano Banana 2.1,1K / 2K / 4K 输出,最多 14 张参考图。官方版按实际 token 用量结算,单次最多 4 张;经济版按张固定计费,每次 1 张。 - 图片 · Microsoft:
mai-image-2.6与mai-image-2.6-flash—— MAI-Image-2.6 及其高速版,文生图、单图编辑与最多 5 张参考图合成,1K / 2K,可指定精确像素尺寸与联网增强;按实际 token 用量结算。 - 视频 · Vidu:
vidu-q4-preview—— Vidu Q4 Preview,首帧图生视频,或用 1–15 张参考图加最多 3 段参考音频生成视频,3–16 秒,540p 至 4K,默认带音轨。 - 文档:文本模型总览 · FLUX 3 Image · Nano Banana 2.1 · Nano Banana 2.1 经济版 · MAI-Image-2.6 · Vidu Q4 Preview
模型上架
文本模型 · 2 个新模型(OpenAI / Anthropic)
- OpenAI:
gpt-6.1-sol—— GPT-6.1 Sol,约 100 万 token 上下文,回答前进行推理,支持图片输入、JSON Schema 结构化输出与函数调用(函数调用需走/v1/responses);reasoning_effort支持low/medium/high/xhigh;单次输入超过 272K token 按长上下文档计费。 - Anthropic:
claude-sonnet-5-5—— Claude 5.5 系列的 Sonnet 模型,100 万 token 上下文,默认开启自适应思考,支持图片输入、函数调用、联网搜索与原生/v1/messages接口,单价与claude-sonnet-5相同。 - 两个模型都走
/v1/chat/completions与/v1/responses,支持流式输出。 - 文档:文本模型总览
能力更新
素材库上线 · Seedance 素材引用
- 新增
/v1/assets接口:把图片、视频、音频链接上传为素材,审核通过后在生成请求中以asset://<素材 ID>引用。 - 支持模型:
seedance-2.0·seedance-2.0-fast·seedance-2.0-mini·seedance-2.5。真人人像作为参考时须先上传为素材。 - 素材接口不计费;每个账号最多 500 个素材。
- 文档:素材库 · Seedance 系列
模型上架
MiniMax H3 Max 上架 · 视频
- 模型 ID:
minimax-h3-max - MiniMax H3 高质量版:480P / 768P / 1080P,支持参考图、参考视频与参考音频。
- 文档:MiniMax H3
能力更新
视频模型:Veo / Kling 4K、SkyReels / PixVerse 续写、FLUX 3 Video 转终稿、Grok 视频编辑
- Veo 3.1:
veo3.1-fast/veo3.1-quality/veo3.1-lite/veo3.1-fast-rev/veo3.1-quality-rev新增 4K;经济版续写可指定resolution(4K 续写要求父任务为 4K);enable_gif不能与 1080p / 4K 同用。 - Kling:
kling-v3/kling-v3-omni新增 4K;kling-v3-omni参考图最多 7 张,提示词用<<<image_N>>>引用。 - SkyReels V4:带参考视频支持 1080p;新增
extend视频续写。 - PixVerse V6:新增
extend,以ref_task_id指定源任务;默认分辨率改为 540p。 - FLUX 3 Video:
flux-3-video新增finalize,把flux-3-video-draft草稿转为终稿。 - Grok Imagine Video:
grok-imagine-video新增edit视频编辑;grok-imagine-video-1.5支持多张参考图(需指定画幅)。 - Seedance:
seedance-2.5支持duration: 0,由模型决定时长;seedance-1.5-pro与 2.0 三档的image_with_roles不能与image_urls同用。 - Wan:
wan3.0-video/wan3.0-video-prime支持由模型决定时长;wan2.7-r2v参考视频单段 1–30 秒;wan2.5-preview只生成有声视频。 - Hailuo:
minimax-hailuo-2.3/-2.3-fast不再接受seed。 - Vidu:
vidu-q3/vidu-q3-mix参考图最多 7 张;四个模型默认 720p。 - 文档:Veo 系列 · Kling 系列 · SkyReels V4 系列 · PixVerse V6 · FLUX 3 Video · Grok Imagine Video 系列 · Seedance 系列 · 万相 Wan 系列 · Hailuo 系列 · Vidu Q3 系列
模型下架
Sora 2 系列下架 · 视频
- 模型 ID:
sora-2·sora-2-pro - OpenAI 于 2026-09-24 关停 Sora 2 全部模型与 Videos API,无官方替代。以上模型即日下架,调用将返回错误。
- 视频生成可改用 Veo 3.1、Kling、Seedance 等模型。
- 文档:视频模型总览
模型上架
Seedream 5.0 Flash 上架 · 图像
- 模型 ID:
seedream-5.0-flash - 字节跳动 Seedream 5.0 系列的快速档:文生图与最多 10 张参考图的编辑,
1k/1.5k/2k,自动画幅与 10 种常用比例,JPEG / PNG 输出,支持透明背景编辑;每次生成 1 张。 - 按张固定价,各分辨率同价,参考图不另收费。
- 文档:Seedream 系列
能力更新
视频模型:SkyReels 默认分辨率、Wan 2.7 视频编辑计费、Gemini Omni 时长、Grok Imagine Video 参考图
skyreels-v4-fast/skyreels-v4-std:resolution默认值改为1080p(与实际出片一致);带参考视频(video_urls)时须显式传480p或720p,否则返回400。wan2.7-videoedit:除输出秒数外,源视频秒数另计一笔。gemini-omni-1.1-flash/gemini-omni-flash-preview:duration只能不传或传0,时长由模型决定(3–10 秒)。grok-imagine-video:参考图(image_urls)改为按张另计。grok-imagine-1.0-video-rev下架,调用将返回错误;请改用grok-imagine-video-1.5-rev。- 文档:SkyReels · 万相 Wan 系列 · Gemini Omni Flash · Grok Imagine Video
能力更新
图像模型:GPT Image 2.5 改用官方模型 ID 并上架逆向版;多个模型放开多张输出
gpt-image-2.5改名为gpt-image-2.5-flare,与 OpenAI 官方模型 ID 一致,参数与单价不变。旧 ID 已停用,调用会返回模型不存在,请把model改成gpt-image-2.5-flare。- GPT Image 2.5 支持局部重绘:
gpt-image-2.5-flare与gpt-image-2.5-sunburst接受mask_url(带透明通道的 PNG,需同时提供image_urls)。 - 新增 GPT Image 2.5 逆向版:
gpt-image-2.5-flare-rev·gpt-image-2.5-sunburst-rev,文生图与参考图编辑,1k/2k/4k,每次 1 张,按分辨率档的固定张价结算。 - 放开多张输出:
grok-imagine-image-2.0每次 1–10 张,grok-imagine-image-2.0-rev1–12 张,qwen-image-3.0/qwen-image-3.0-pro1–6 张,seedream-5.0-lite最多 15 张,seedream-4.0/seedream-4.5编辑时参考图与输出合计最多 15 张。多张输出按实际返回的张数计费。 z-image-turbo不再接受prompt_extend,传入会返回400,不计费。- 文档:GPT Image 系列 · GPT Image 2.5 逆向版 · Grok Imagine · Qwen Image · Seedream
能力更新
45 个文本模型支持 Responses 接口
- OpenAI(
gpt-4.1/gpt-5/gpt-5.x/gpt-6系列、o1/o3/o3-mini/o4-mini)、Qwen、DeepSeek、xAI 的文本模型现在也可以通过POST /v1/responses调用,支持流式与函数调用,Codex 等客户端可以直接使用。deepseek-v3.1-terminus暂不支持。 gpt-6-astra、grok-4.6开放函数调用,需走/v1/responses。- 计费与 Chat 接口相同。
- 文档:文本模型总览
模型上架
文本模型 · 10 个新模型(OpenAI / Anthropic / xAI / Qwen / Z.ai)
- OpenAI:
gpt-6-sol·gpt-6-luna—— GPT-6 系列的中档与低价档,约 100 万 token 上下文,支持图片输入、JSON Schema 结构化输出与函数调用(函数调用需reasoning_effort: "none");单次输入超过 272K token 按长上下文档计费。 - Anthropic:
claude-opus-5-5—— Claude 5.5 系列首个模型,100 万 token 上下文,始终进行思考,支持函数调用与原生/v1/messages接口,单价低于claude-opus-5。 - xAI:
grok-4.7—— 50 万 token 上下文,支持图片输入与函数调用,始终进行推理;单次输入达到 20 万 token 起按长上下文档计费。 - Qwen:
qwen3.8-max-0902(qwen3.8-max于 9 月 2 日发布的升级快照) ·qwen3.8-2.4t-a95b(开源权重旗舰,仅文本输入) ·qwen3.8-flash·qwen3.8-27b·qwen3.7-flash(超过 32K 输入按长上下文档计费)。 - Z.ai:
glm-5.3—— 始终进行推理,支持函数调用。 - 全部走
/v1/chat/completions,支持流式输出。 - 文档:文本模型总览
模型上架
DeepSeek V4.1 Flash 上架
- 模型 ID:
deepseek-v4.1-flash - DeepSeek V4 Flash 的新一代:上下文扩到 1M tokens,单次输出最长约 384K tokens,默认开启思考。
- 走
POST /v1/chat/completions,支持流式、JSON Schema 结构化输出与函数调用,命中自动缓存的部分按缓存读价结算。 - 按时段计价:请求按提交时刻所在时段结算,完整时段价表见
GET /v1/models返回的price_config.text_schedule。 - 文档:文本模型总览
模型上架
Wan 3.0 Video Prime 上架
- 模型 ID:
wan3.0-video-prime wan3.0-video的加速版,出片更快。动作、参数、取值范围与约束和wan3.0-video完全相同:文生、首尾帧、参考图 / 参考视频 / 参考音频,以及文档(file_url)与网页(link_url)参考;480p/720p/1080p,2–30 秒。换用只改model。- 按分辨率档 × 输出秒数计费,单价高于
wan3.0-video;不传resolution时按480p档结算。 - 文档:万相 Wan 系列
模型上架
GPT Image 2.5 上架 · 新增
xhigh 与 max 两档画质- 模型 ID:
gpt-image-2.5(Flare 线,出图更快) ·gpt-image-2.5-sunburst(Sunburst 线,编辑精度优先) - 两个模型的动作、参数、取值范围与单价完全相同:文生图与参考图编辑(最多 16 张参考图),15 种画幅,
1k/2k/4k,每次出 1 张,差别只在生成结果本身。 - 画质从三档扩到五档:
low/medium/high/xhigh/max。xhigh与max是 2.5 独有的档位,发给gpt-image-2会返回400,不会自动降档。 - 同名档位与上一代不通用:2.5 的
medium与high输出 token 约为 GPT Image 2 同名档位的四分之一,2.5 的max才对应 GPT Image 2 的high。从gpt-image-2迁过来请按新页的阶梯重新估算成本。 - 按实际 token 用量结算,计费维度为文本输入、缓存文本输入、图片输入、缓存图片输入、图片输出。本组不接受
mask_url与seed,掩码局部重绘仍用gpt-image-2。 - 文档:GPT Image 2.5 · GPT Image 系列
能力更新
Wan 2.7 Image 放开多图生成
- 模型 ID:
wan2.7-image·wan2.7-image-pro n从固定 1 张放开:标准模式每次请求 1–4 张;开启enable_sequential组图模式 1–12 张(同一请求出主题连贯的一组图)。wan2.7-image-pro组图模式最高2k。- 计费不变:按张固定价,
n张收n张的钱,提交时按n冻结。 - 文档:Wan Image 系列
模型上架
Nano Banana 官方版上架 · 经济版补上一代档
- 模型 ID:
gemini-3-pro-image(旗舰) ·gemini-3.1-flash-image(快速) ·gemini-3.1-flash-lite-image(最轻) ·gemini-2.5-flash-image-preview-rev(经济版上一代档) - 官方版三档走
POST /v1/tasks,支持generate文生图与edit参考图编辑(最多 14 张参考图),每次请求出 1 张;旗舰档1k/2k/4k,快速档0.5k/1k/2k/4k并额外支持1:4、4:1、1:8、8:1四种极端画幅,最轻档固定 1K、不接受resolution。 - 官方版按实际 token 用量结算:提交时按预估用量冻结,完成后按实际用量结算并退回差额;计费维度为文本输入、图片输入、文本输出、图片输出,参考图算图片输入。
google_search/google_image_search只有gemini-3.1-flash-image与gemini-3.1-flash-image-rev接受。- 经济版新增
gemini-2.5-flash-image-preview-rev,11 种画幅、固定 1K,仍按成功出图的固定张价结算。 - 文档:Gemini 图像系列 · Nano Banana 官方版 · Nano Banana 经济版
模型上架
GPT Image 1 与 GPT Image 1.5 恢复可用
- 模型 ID:
gpt-image-1·gpt-image-1.5 - 两个模型参数、动作与限制完全一致:文生图与参考图编辑、掩码局部重绘、透明背景与
png/jpeg输出,画幅1:1/2:3/3:2,四档画质,最多 15 张参考图,每次出 1 张。不接受resolution和seed。 - 按实际 token 用量结算;
gpt-image-1.5比gpt-image-1多计文本输出。 - 文档:GPT Image 系列 · GPT Image 1 与 1.5 官方版
模型上架
Grok Imagine · 图像四档与视频 1.5 逆向档
- 模型 ID:
grok-imagine-image-2.0·grok-imagine-image-2.0-rev·grok-imagine-image-quality·grok-imagine-1.5-rev·grok-imagine-1.5-edit-rev·grok-imagine-video-1.5-rev - 图像:
grok-imagine-image-2.0官方档与-rev逆向档;grok-imagine-image-quality是 xAI 官方高质量档,14 种画幅、1k/2k分档,支持 1–3 张参考图编辑,参考图按张另计;grok-imagine-1.5-rev(文生图)与grok-imagine-1.5-edit-rev(生成 / 编辑)一次最多 10 张。均按张固定价。 - 视频:
grok-imagine-video-1.5-rev文生 / 图生视频,480p / 720p,6–15 秒,最多 7 张参考图,按分辨率档 × 秒数计费。 - 文档:Grok Imagine 系列 · Grok Imagine Video 系列
模型上架
Gemini Omni Flash 上架 · 模型自定时长的视频生成
- 模型 ID:
gemini-omni-1.1-flash·gemini-omni-flash-preview - 两个模型都走
POST /v1/tasks的generate,从文本、参考图或一段参考视频生成视频;不接受duration,时长由模型按内容决定;画幅16:9/9:16,每次出 1 个视频。 gemini-omni-1.1-flash:360p/720p/1080p/4k,参考图合计 10 张(含首尾帧),支持first_frame_image/last_frame_image、image_with_roles与metadata,参考视频最长 10 秒。gemini-omni-flash-preview:固定720p,参考图最多 16 张,参考视频最长 24 秒。- 两者都支持
ref_task_id:带上一次任务的task_id即可在结果上续写或改写,与video_urls互斥。 - 按分辨率档 × 输出视频秒数计费,提交时按时长上限冻结额度,完成后按实际结果结算并退回差额。
- 文档:Omni 视频系列 · Gemini Omni Flash · Omni-Flash-Ext
模型上架
4 个视频模型上架 · 万相 3.0 / HappyHorse 1.1 / FLUX 3 Video 两档
- 模型 ID:
wan3.0-video·happyhorse-1.1·flux-3-video·flux-3-video-draft wan3.0-video:万相多模态视频入口,一个模型 ID 覆盖文生、首尾帧、参考图 / 参考视频 / 参考音频,以及文档(file_url)与网页(link_url)参考;480p/720p/1080p,2–30 秒;用generation_type区分frame与reference两族输入。happyhorse-1.1:文生 / 首帧图生 / 参考图生视频统一入口,720p/1080p,3–15 秒任意整数,五种画幅。flux-3-video/flux-3-video-draft:从文本、1–10 张有序关键帧或一段续写视频生成 5–20 秒带同步音频的片段,八种画幅含auto;标准档支持hd/fhd,Draft 档只出hd、画质更低更便宜,适合先预览再出片。happyhorse-1.0的edit动作明确了时长语义:duration传0表示沿用源视频时长,计费秒数取源视频时长。- 文档:万相 Wan 系列 · HappyHorse 系列 · FLUX 3 Video
模型上架
3 个视频模型上架 · Hailuo 02 与 Vidu Q3 Pro / Turbo
- 模型 ID:
minimax-hailuo-02·vidu-q3-pro·vidu-q3-turbo minimax-hailuo-02:MiniMax 海螺 02,支持文生视频、首帧与首尾帧,512p/768p/1080p,5 或 10 秒;512p需要首帧,1080p仅 5 秒。vidu-q3-pro/vidu-q3-turbo:Vidu Q3 的高质量档与加速档,能力相同——文生视频、起始帧或首尾帧,540p/720p/1080p,1–16 秒,默认生成原生音频(generate_audio)。带图片时画幅由输入图片决定。- 三个模型都走
POST /v1/tasks的generate动作,按分辨率档 × 秒数计费。 - 文档:Hailuo 系列 · Vidu Q3 系列
模型上架
Flow Music 上架 · 音乐生成
- 模型 ID:
flow-music - Lyria 引擎的文本生成音乐:
generate出整首歌或纯音乐(可传歌词、标题、BPM、时长、随机种子),lyrics单独生成歌词文本,走POST /v1/tasks;按次计费,两个动作价格不同。 - Suno 同批新增
download动作,把源音轨导出为音频文件。 - 文档:Flow Music 音乐生成 · Suno 音乐生成
能力更新
Seedance 2.5 开放视频编辑与视频延长
- 模型 ID:
seedance-2.5 - 新增两个动作:
edit按提示词编辑源视频,duration传0表示输出沿用源视频时长;extend从源视频往后续拍。两者都用video_urls传源视频,画幅固定adaptive。 - 同时按目录重新核对了 Seedance / Sora / PixVerse / SkyReels 四页的参数、取值范围与约束,
seedance-1.0-pro与seedance-1.0-pro-fast的时长更正为 2–12 秒任意整数。 - 文档:Seedance 系列 · Sora 2 系列 · PixVerse V6 · SkyReels V4 系列
能力更新
Kling 与 Veo 的动作与参数对齐
- 新增动作:
kling-v3-omni·kling-video-o1支持action: "edit",编辑 3–10 秒源视频、输出沿用源视频时长;veo3.1-fast-rev·veo3.1-quality-rev支持action: "extend",用ref_task_id续写自己生成的视频。 - 新增参数:Kling 的多镜头分镜
multi_shot/shot_type/multi_prompt与参考主体element_list(kling-v3·kling-v3-omni)、带角色图片image_with_roles(kling-v3-omni·kling-video-o1);Veo 官方版的person_generation/resize_mode/seed/negative_prompt,经济版的generation_type/enable_gif/raw。 - 时长:
kling-3.0-turbo·kling-v3·kling-v3-omni接受 3–15 秒任意整数;veo3.1-fast·veo3.1-quality接受 4 / 6 / 8 秒,1080p 仅 8 秒。 - 文档:Kling 系列 · Veo 系列
能力更新
Midjourney 链式动作补齐
- 模型 ID:
midjourney - 动作表补齐 12 种链式动作:
upscale、variation、high-variation、low-variation、reroll、zoom、pan、inpaint、modal、edit、remix-strong、remix-subtle,统一用ref_task_id引用上一步任务的task_id,用index选四宫格里的第几张。 - 补齐
imagine的创作参数(stylize、chaos、weird、tile、iw、cref/sref/dref及权重、raw、draft、hd、stop、extra)与speed、version(新增v8.2)的取值;按动作与速度档计费。 - 文档:Midjourney
模型下架
5 个媒体模型下架
- 模型 ID:
seedance-2.0-face·seedance-2.0-fast-face·minimax-h3-max·grok-imagine-1.0-rev·grok-imagine-1.0-edit-rev seedance-2.0-face/seedance-2.0-fast-face:seedance-2.0与seedance-2.0-fast已支持人脸参考,单独的 face 档不再提供,直接改用不带 face 的模型 ID。minimax-h3-max:上游已不再提供。MiniMax H3 线继续提供minimax-h3与minimax-h3-regeneration。grok-imagine-1.0-rev/grok-imagine-1.0-edit-rev:上游已不再提供,请改用grok-imagine-1.5-rev/grok-imagine-1.5-edit-rev。- 以上模型即日下架,调用将返回错误。
- 文档:Seedance 系列 · MiniMax H3 · Grok Imagine 系列
模型上架
Nano Banana 经济版上架 · Gemini 图像三档
- 模型 ID:
gemini-3-pro-image-rev(旗舰) ·gemini-3.1-flash-image-rev(快速) ·gemini-3.1-flash-lite-image-rev(最轻) - 三档共用同一套参数:走
POST /v1/tasks,支持generate文生图与edit参考图编辑(最多 14 张参考图),每次请求出 1 张,11 种共通画幅含auto。 - 档位差异:旗舰档
1k/2k同价;快速档2k比1k贵,并额外支持1:4、4:1、1:8、8:1四种极端画幅;最轻档最便宜,输出固定 1K、不接受resolution。单价见GET /v1/models。 - 按成功出图的固定张价计费,分辨率是唯一计费维度,参考图与画幅都不加价,提交前即可确定成本。
- 经济版没有专有参数:
mask_url、quality、seed、google_search/google_image_search、official_fallback均不接受,会在额度预扣前拒绝。需要掩码重绘请用gpt-image-2。 - 文档:Nano Banana 经济版
模型上架
GPT Image 2 上架 · 官方与逆向两条线路
- 模型 ID:
gpt-image-2(官方线路) ·gpt-image-2-rev(逆向线路) - 两条线路都走
POST /v1/tasks,支持generate文生图与edit参考图编辑,15 种画幅、1k/2k/4k分辨率,每次请求出 1 张,均不支持seed。 - 官方线路独有掩码局部重绘(
mask_url)、画质档(low/medium/high)、透明背景与输出格式控制(background/output_format/output_compression/moderation),最多 16 张参考图;按实际 token 用量结算,提交时按画幅 × 分辨率 × 画质预扣,完成后退回差额。 - 逆向线路不接受上述专有参数,最多 15 张参考图;按输出分辨率固定张价结算,
1k/2k/4k三档价格不同,提交前即可确定单张成本。 - 两条线路不会自动互相切换,模型 ID 请作为产品选择固化在配置里。
- 文档:GPT Image 系列 · GPT Image 2 官方版 · GPT Image 2 逆向版
模型上架
gpt-4o-mini-tts 上线 · 文字转语音
- 模型 ID:
gpt-4o-mini-tts - 接替已下架的
tts-1/tts-1-hd。13 种音色(alloy/echo/fable/onyx/nova/shimmer/coral/verse/ballad/ash/sage/marin/cedar),新增instructions参数,可用自然语言指定语气 / 语速 / 情绪。 - 按输入文本字符数计费,$13.5 / 百万字符,不收输出费用。走
/v1/audio/speech。 - 文档:TTS 文字转语音
能力更新
视频模型的参考视频输入全面可用
- 支持参考视频:
kling-v3-omni·kling-video-o1·skyreels-v4-fast·skyreels-v4-std·gemini-omni-1.1-flash-ext - 重新上架:
kling-v2-6-motion-control·kling-v3-motion-control seedance-2.0-fast开放参考视频,与seedance-2.0/seedance-2.0-mini一致。- 输入视频时长按真实文件时长计费(截断取整),无法解析时请求被拒绝而不计费。各家参考视频怎么进价格见各模型页,通用规则见 输入视频的时长与计费。
- 文档:Kling 系列 · SkyReels V4 · Omni-Flash-Ext · Seedance 系列
模型下架
7 个模型下架
- 模型 ID:
tts-1·tts-1-hd·sora-2-preview·deepseek-v3-0324·deepseek-r1-250528·kimi-k2-instruct·gpt-4o-2024-08-06 - 上游已不再提供,以上模型即日下架,调用将返回错误。
tts-1/tts-1-hd:文本转语音将以gpt-4o-mini-tts重新上线。gpt-4o-2024-08-06:gpt-4o-2024-05-13/gpt-4o-2024-11-20继续提供。
模型下架
Imagen 4.0 · 图像
- 模型 ID:
imagen-4.0 - 上游已不可用,该模型即日下架,调用将返回错误。
- Google 图像线请改用 Nano Banana 系列:
gemini-3-pro-image-preview(Nano Banana Pro) /gemini-3.1-flash-image-preview(Nano Banana 2) 及各自的-rev标准档。 - 文档:Gemini 图像系列
模型上架
Nano Banana 2 Lite 标准档 · 图像
- 模型 ID:
gemini-3.1-flash-lite-image-rev - Gemini 3.1 系列中最快、最便宜的图像模型,约 4 秒出图,仅
1K,最多 14 张参考图,不支持搜索增强与局部重绘。是当前站内最低价的 Gemini 出图档。 - 文档:Gemini 图像系列
模型上架
文本模型 · 15 个新模型(Anthropic / Google / Qwen / MiniMax / MoonshotAI / Z.ai)
- Anthropic:
claude-fable-5—— Mythos 级旗舰,100 万 token 上下文,长上下文不加价。 - Google:
gemini-3.7-flash·gemini-3.6-flash·gemini-3.5-flash-lite。 - Qwen(首次上架通义千问文本线):
qwen3.8-max(今日发布) ·qwen3.7-max·qwen3.7-plus·qwen3.6-plus·qwen3.6-flash,均为 100 万 token 上下文,Plus / Flash 超过 256K 输入按长上下文档计费。 - MiniMax:
minimax-m3(多模态,100 万 token 上下文,超过 512K 输入按 2 倍计费) ·minimax-m2.7。 - MoonshotAI:
kimi-k2.6·kimi-k2.7-code·kimi-k2.7-code-highspeed。 - Z.ai:
glm-5.2(100 万 token 上下文)。 - 全部走
/v1/chat/completions;模型 ID 一律裸名,不带厂商前缀。 - 文档:文本对话
模型上架
Grok 文本系列 · 四个模型
- 模型 ID:
grok-4.6·grok-4.5·grok-4.3·grok-build-0.1 - xAI 当代文本线首次上架:4.6 是旗舰(代码与通用任务,50 万 token 上下文);4.5 是推理档;4.3 是快速通用档(100 万 token 上下文);Build 0.1 面向编码智能体。均支持图片输入、函数调用与结构化输出,走
/v1/chat/completions。 - 单次输入超过 200K token 的长上下文请求按 2 倍单价计费,与 xAI 官方一致。
- 同批把
kimi-k3的输出单价按 Moonshot 官方价重新对齐(下调)。 - 文档:文本对话
模型上架
GPT-4o Transcribe 两档 · 语音转写
- 模型 ID:
gpt-4o-transcribe·gpt-4o-mini-transcribe - OpenAI 当代语音转写模型,词错误率明显低于 Whisper;Mini 档半价。按音频分钟数计费,走
/v1/audio/transcriptions。 - 文档:语音转写
模型上架
MiniMax H3 Max / Regeneration · 视频
- 模型 ID:
minimax-h3-max(480p / 768p 低价档) ·minimax-h3-regeneration(768p 成片重渲染为原生 2K,video_urls必传) - 同批把
minimax-h3的价格按 MiniMax 官方价目对齐。 - 文档:MiniMax H3
模型上架
视频 · Seedance 1.0 Pro 两档 + Wan 2.6 图生两档
- 模型 ID:
seedance-1.0-pro·seedance-1.0-pro-fast·wan2.6-i2v·wan2.6-i2v-flash - Seedance 1.0 Pro 是 1.x 时代的稳定旗舰,价格低于 1.5 / 2.x;Fast 档约快 3 倍,是最便宜的 Seedance 视频档。480p / 720p / 1080p,5 或 10 秒。
- Wan 2.6 图生视频补齐标准档与极速档(Flash 约半价),720p / 1080p,5 / 10 / 15 秒。
- 计费口径更正:Seedance 全家族图生与文生同价(此前文档写的「两个档」有误);参考视频按 2× 单价过渡计费。Wan 2.7 视频编辑与参考生视频同样按 2× 过渡。
- 文档:Seedance · Wan 系列
模型上架
Seedream 4.0 / 4.5 与 Imagen 4 · 图像
- 模型 ID:
seedream-4.0·seedream-4.5·imagen-4.0 - Seedream 4.x 两档补齐:4.0 是当前最低价的 Seedream,4.5 文字更准、多参考图融合更好;都支持 1K / 2K / 4K、最多 10 张参考图、单次最多 15 张。
- Imagen 4(标准档)正式开放:此前文档标注「维护中」,现已可用。写实文生图,1K / 2K,五种比例,仅文生图。
- 文档:Seedream 系列 · Imagen 4.0
模型上架
FLUX.2 Max · 图像
- 模型 ID:
flux-2-max - FLUX.2 家族的最高画质档,适合对保真度要求高于成本的成片。最多 8 张参考图,
1K/2K,按输出百万像素计费。 - 文档:FLUX 系列
模型上架
Grok Imagine 官方线 · 四个模型
- 模型 ID:
grok-imagine-image(标准) ·grok-imagine-image-quality(高质量) ·grok-imagine-video(1.0) ·grok-imagine-video-1.5 - 此前站内只有 Grok Imagine 的经济线(
-rev),现在补齐 xAI 官方线。图像标准档 1K / 2K 同价,是最便宜的官方 Grok 出图档;视频 1.5 新增 1080p 与音频驱动。 - 顺带更正:Grok 视频档的时长范围是 6-15 秒,此前文档写的 6-30 秒有误。
- 文档:Grok Imagine 图像 · Grok Imagine 视频
模型上架
Qwen Image 3.0 · 图像
- 模型 ID:
qwen-image-3.0(标准) ·qwen-image-3.0-pro(密集排版) - 文字渲染较 2 代明显更稳,1K / 2K,七种比例,最多 3 张参考图,单次最多 6 张。
- Pro 档 1K 与 2K 分档计价;标准档两档同价。
- 模型 ID:
gpt-image-1.5 - 比 GPT Image 1 更快,指令跟随与编辑精度显著提升。1:1 / 2:3 / 3:2,四档质量。
- 不传
quality按high档计费 —— 详见 GPT-Image 系列。
- 模型 ID:
tts-1·tts-1-hd·whisper-1 - TTS 按输入字符数计费,Whisper 按音频分钟数计费。
重要变更
Seedance / Seedream 系列 · 模型 ID 去掉
doubao- 前缀为与站内其余模型保持一致 —— 平台上绝大多数模型 ID 不带厂商前缀,厂商信息在模型卡片上单独标注 —— 以下 7 个模型 ID 已更名:- 旧 ID 已停止解析,请改用新 ID。
- 模型能力、可调参数、价格均未变化,只改了名字。
- 文档:Seedance 视频生成 API · Seedream 图像生成 API
模型上架
Claude Sonnet 5 · 对话
- 模型 ID:
claude-sonnet-5
- 模型 ID:
gpt-5.6-luna(轻量) ·gpt-5.6-terra(标准) ·gpt-5.6-sol(旗舰) - 三档按能力与价格递增,可按场景选择。
能力更新
Omni Flash Ext · 计价改为按分辨率 × 时长
omni-flash-ext由单一价改为按分辨率 × 时长分档计价:分辨率 720p / 1080p / 4k,时长 4 / 6 / 8 / 10 秒(仅支持这四个值)。- 传参考视频(
video_urls)时无需传duration,二者不可同时传入。 - 具体单价以 模型总览 与控制台「模型市场」为准。
重要变更
Seedance 2.0 系列 ·
image_urls 语义调整自 2026-07-09 起(上游生效),seedance-2.0、seedance-2.0-fast、seedance-2.0-mini 三个模型:- 变更前 —
image_urls第 1 张作首帧、第 2 张作尾帧,其余作参考图。 - 变更后 —
image_urls中所有图片一律作为参考图,不再有首帧 / 尾帧含义。
image_with_roles 字段(不受此次变更影响)。seedance-1.5-pro 与 face 系列不受影响。能力更新
Seedance 2.0 · 新增 4K
seedance-2.0新增 4K 分辨率,现支持 480p / 720p / 1080p / 4K;价格已同步官方价。- 文档:Seedance 视频生成 API
模型上架
HappyHorse 1.1 · 视频生成
- 模型 ID:
happyhorse-1.1 - 生成方式:文生视频、图生视频(传
image_urls作首帧) - 分辨率:720P / 1080P · 时长:3–15 秒 · 画面比例:16:9 / 9:16 / 1:1
- 文档:HappyHorse 视频生成 API
模型上架
Kling 3.0 Turbo · 视频生成
- 模型 ID:
kling-3.0-turbo - 生成方式:文生视频、图生视频(传
image_urls作首帧) - 分辨率:720P / 1080P · 时长:5 / 10 秒 · 画面比例:16:9 / 9:16 / 1:1
- 文档:Kling 视频生成 API
- 图像
grok-imagine-1.5-rev— 文生图,画面比例 1:1 / 16:9 / 9:16 / 3:2 / 2:3,支持批量n - 编辑
grok-imagine-1.5-edit-rev— 生成 / 编辑,传image_urls作参考图 - 视频
grok-imagine-1.5-video-rev— 文生视频 / 图生视频,分辨率 480p / 720p,时长 6–30 秒,比例 16:9 / 9:16 / 1:1 - 文档:Grok Imagine 图像 API · Grok Imagine 视频 API
模型上架
Seedance 2.0 Mini · 视频生成
- 模型 ID:
seedance-2.0-mini - 生成方式:文生视频、图生视频
- 分辨率:480p / 720p · 时长:4–15 秒 · 画面比例:16:9 / 9:16 / 1:1
- 文档:Seedance 视频生成 API
模型上架
Claude Opus 4.8 · 文本生成
- 模型 ID:
claude-opus-4-8 - 接入方式:OpenAI 兼容 Chat Completions,支持流式输出
- 文档:文本生成 API
模型上架
Gemini 3.5 Flash · 文本生成
- 模型 ID:
gemini-3.5-flash· OpenAI 兼容 Chat Completions - 文档:文本生成 API
- 模型 ID:
omni-flash-ext - 生成方式:文生视频、视频参考生成(传
video_urls) - 分辨率:720p / 1080p / 4K · 时长:4 / 6 / 8 / 10 秒 · 画面比例:16:9 / 9:16 / 1:1
- 文档:Omni 视频生成 API
模型上架
Midjourney · 图像生成
- 模型 ID:
midjourney - 生成方式:文生图(imagine)、融图(blend)、识图(describe)、编辑(edits);放大 / 变体 / 缩放 / 平移等链式操作(传
ref_task_id) - 画面比例:1:1 / 16:9 / 9:16 / 2:3 / 3:2 / 4:3 / 3:4 / 21:9 / 9:21 · 速度档:relax / fast / turbo
- 文档:Midjourney 图像 API
模型上架
Gemini Flash Latest · 文本生成
- 模型 ID:
gemini-flash-latest· 指向 Gemini Flash 最新版的滚动别名,OpenAI 兼容 Chat Completions - 文档:文本生成 API
模型上架
模型上架
GPT Image 2 系列
- 模型 ID:
gpt-image-2-rev·gpt-image-2 - 分辨率 1K / 2K / 4K · 画面比例 15 种比例 · 支持生成 / 编辑
- 文档:GPT Image API
模型上架
Vidu Q3 系列
- 模型 ID:
vidu-q3·vidu-q3-mix - 分辨率 540p / 720p / 1080p · 时长 1–16 秒 · 画面比例 16:9 / 9:16 / 1:1
- 文档:Vidu 视频 API
模型上架
Wan 2.7 · 视频
- 模型 ID:
wan2.7·wan2.7-r2v·wan2.7-videoedit - 分辨率 720P / 1080P · 时长 2–15 秒 · 画面比例 16:9 / 9:16 / 1:1 / 4:3 / 3:4
- 文档:Wan 视频 API
- 模型 ID:
wan2.7-image·wan2.7-image-pro - 分辨率 1K / 2K / 4K · 画面比例 7 种比例 · 支持生成 / 编辑
- 文档:Wan 图像 API
模型上架
PixVerse V6
- 模型 ID:
pixverse-v6 - 分辨率 360p / 540p / 720p / 1080p · 时长 1–15 秒 · 画面比例 8 种比例
- 文档:PixVerse 视频 API
模型上架
Gemini 3.1 Flash Image Preview
- 模型 ID:
gemini-3.1-flash-image-rev·gemini-3.1-flash-image - 分辨率 0.5K / 1K / 2K / 4K · 画面比例 11 种比例 · 支持生成 / 编辑
- 文档:Gemini 图像 API
模型上架
Gemini 3.1 Pro Preview (custom tools)
- 模型 ID:
gemini-3.1-pro-preview-customtools - 文档:文本生成 API
- 模型 ID:
skyreels-v4-std·skyreels-v4-fast - 分辨率 480p / 720p / 1080p · 时长 3–15 秒 · 画面比例 16:9 / 9:16 / 1:1
- 文档:SkyReels 视频 API
模型上架
Seedream 5.0 Lite
- 模型 ID:
seedream-5.0-lite - 分辨率 2K / 3K / 4K · 画面比例 9 种比例 · 支持生成 / 编辑
- 文档:Seedream 图像 API
模型上架
MiniMax M2.5
- 模型 ID:
minimax-m2.5 - 文档:文本生成 API
- 模型 ID:
seedance-2.0·seedance-2.0-fast·seedance-2.0-face·seedance-2.0-fast-face - 分辨率 480p / 720p / 1080p · 时长 4–15 秒 · 画面比例 16:9 / 9:16 / 1:1
- 文档:Seedance 视频 API
模型上架
Qwen Image 2.0
- 模型 ID:
qwen-image-2.0·qwen-image-2.0-pro - 分辨率 1K / 2K · 画面比例 7 种比例 · 支持生成 / 编辑
- 文档:Qwen 图像 API
模型上架
Claude Opus 4.6
- 模型 ID:
claude-opus-4-6 - 文档:文本生成 API
- 模型 ID:
kling-v3·kling-v3-omni·kling-v3-motion-control - 分辨率 720P / 1080P / 4K · 时长 5 / 10 秒 · 画面比例 16:9 / 9:16 / 1:1
- 文档:Kling 视频 API
模型上架
Grok Imagine 1.0 · 图像
- 模型 ID:
grok-imagine-1.0-rev·grok-imagine-1.0-edit-rev - 画面比例 1:1 / 16:9 / 9:16 / 3:2 / 2:3 · 支持生成 / 编辑
- 文档:Grok Imagine 图像 API
- 模型 ID:
grok-imagine-1.0-video-rev - 分辨率 480p / 720p · 时长 6–30 秒 · 画面比例 16:9 / 9:16 / 1:1
- 文档:Grok Imagine 视频 API
模型上架
Seedance 1.5 Pro
- 模型 ID:
seedance-1.5-pro - 分辨率 480p / 720p / 1080p · 时长 5 / 10 秒 · 画面比例 16:9 / 9:16 / 1:1
- 文档:Seedance 视频 API
- 模型 ID:
wan2.6 - 分辨率 720P / 1080P · 时长 5 / 10 / 15 秒 · 画面比例 16:9 / 9:16 / 1:1
- 文档:Wan 视频 API
模型上架
Kling V2.6 系列
- 模型 ID:
kling-v2-6·kling-v2-6-motion-control - 分辨率 720P / 1080P · 时长 5 / 10 秒 · 画面比例 16:9 / 9:16 / 1:1
- 文档:Kling 视频 API
模型上架
DeepSeek V3.2
- 模型 ID:
deepseek-v3.2 - 文档:文本生成 API
- 模型 ID:
kling-video-o1 - 分辨率 720P / 1080P · 时长 5 / 10 秒 · 画面比例 16:9 / 9:16 / 1:1
- 文档:Kling 视频 API
模型上架
Z-Image Turbo
- 模型 ID:
z-image-turbo - 分辨率 1K / 2K · 画面比例 7 种比例
- 文档:Z-Image API
模型上架
FLUX 2 系列
- 模型 ID:
flux-2-pro·flux-2-flex - 分辨率 1K / 2K · 画面比例 7 种比例
- 文档:FLUX 图像 API
模型上架
Gemini 3 Pro Image Preview
- 模型 ID:
gemini-3-pro-image-rev·gemini-3-pro-image - 分辨率 1K / 2K / 4K · 画面比例 11 种比例 · 支持生成 / 编辑
- 文档:Gemini 图像 API
模型上架
GPT-5.1 系列
- 模型 ID:
gpt-5.1·gpt-5.1-codex·gpt-5.1-codex-mini·gpt-5.1-chat-latest - 文档:文本生成 API
模型上架
MiniMax Hailuo 2.3
- 模型 ID:
minimax-hailuo-2.3·minimax-hailuo-2.3-fast - 分辨率 768p / 1080p · 时长 6 / 10 秒 · 画面比例 16:9 / 9:16 / 1:1
- 文档:Hailuo 视频 API
模型上架
Veo 3.1 系列
- 模型 ID:
veo3.1-quality-rev·veo3.1-fast-rev·veo3.1-lite·veo3.1-quality·veo3.1-fast - 分辨率 720p / 1080p / 4K · 时长 8 秒 · 画面比例 16:9 / 9:16 / 1:1
- 文档:Veo 视频 API
- 模型 ID:
gpt-5-search-api - 文档:文本生成 API
模型上架
GPT-5 Pro
- 模型 ID:
gpt-5-pro - 文档:文本生成 API
- 模型 ID:
sora-2-pro - 分辨率 720p / 1024p / 1080p · 时长 4–20 秒 · 画面比例 16:9 / 9:16 / 1:1
- 文档:Sora 视频 API
- 模型 ID:
sora-2-preview - 分辨率 720p · 时长 4–20 秒 · 画面比例 16:9 / 9:16 / 1:1
- 文档:Sora 视频 API
模型上架
GLM-4.6
- 模型 ID:
glm-4.6 - 文档:文本生成 API
- 模型 ID:
sora-2 - 分辨率 720p · 时长 4–20 秒 · 画面比例 16:9 / 9:16 / 1:1
- 文档:Sora 视频 API
模型上架
GPT-5 Codex
- 模型 ID:
gpt-5-codex - 文档:文本生成 API
- 模型 ID:
wan2.5-preview - 分辨率 480p / 720p / 1080p · 时长 5 / 10 秒 · 画面比例 16:9 / 9:16 / 1:1
- 文档:Wan 视频 API
模型上架
Gemini 2.5 Flash Image Preview
- 模型 ID:
gemini-2.5-flash-image-preview-rev·gemini-2.5-flash-image-preview - 分辨率 1K · 画面比例 11 种比例 · 支持生成 / 编辑
- 文档:Gemini 图像 API
模型上架
FLUX Kontext Pro / Max
- 模型 ID:
flux-kontext-pro·flux-kontext-max - 画面比例 7 种比例 · 支持生成 / 编辑
- 文档:FLUX 图像 API
模型上架
GPT Image 1 (official)
- 模型 ID:
gpt-image-1 - 画面比例 1:1 / 3:2 / 2:3 · 支持生成 / 编辑
- 文档:GPT Image API
模型上架
HappyHorse 1.0
- 模型 ID:
happyhorse-1.0 - 分辨率 720P / 1080P · 时长 3–15 秒 · 画面比例 16:9 / 9:16 / 1:1 · 支持生成 / 编辑
- 文档:HappyHorse 视频 API
模型上架
Embeddings 3 · GPT-3.5 Turbo
- 模型 ID:
text-embedding-3-small·text-embedding-3-large·gpt-3.5-turbo-0125 - 文档:文本生成 API