Skip to main content
POST
上游停用预告:OpenAI 已公告 whisper-1、gpt-4o-transcribe、gpt-4o-mini-transcribe 于 2027-02-26 关闭,清波 API同日下架;替代模型接入后会提前在 运营公告 说明。新接入请把 model 做成可配置项。
同步接口:上传音频文件,请求直接返回识别出的文本,没有 task_id,不需要轮询。三个模型共用这一个端点,切换时只改 model。需要反过来把文本读成语音时用 TTS 文字转语音。

请求参数

请求体使用 multipart/form-data。
file
必填
要转写的音频文件,支持 mp3、mp4、mpeg、mpga、m4a、wav、webm。
string
必填
模型 ID:gpt-4o-transcribe、gpt-4o-mini-transcribe 或 whisper-1。
以上之外的参数会返回 400,不计费。

计费

按音频时长(分钟)计费:三个模型单价不同,转写出来的文本长度、音频语言和文件格式都不影响价格。 单价见 GET /v1/models 返回的 price_config,或控制台「模型市场」。计费单位是 quota,500,000 quota = 1 USD,不是美元。 请求失败不计费。

响应

string
转写出的文本内容。

可用模型

相关文档