Skip to main content
POST
同步接口 — 请求完成后直接返回识别结果。

可用模型

两个端点

语音转文字

将音频转录为原始语言的文本。

语音翻译

将音频翻译为英文文本。参数与转录端点相同。

请求参数

使用 multipart/form-data 格式:
file
必填
音频文件,支持 mp3、mp4、mpeg、mpga、m4a、wav、webm 格式
string
必填
模型 ID:whisper-1

响应

string
识别或翻译后的文本内容