跳到主要内容

音频转写(Audio Transcriptions)

音频接口的具体能力取决于已配置的模型和渠道。本页介绍 OpenAI 音频转写接口;同一分类下还提供文本转语音和音频翻译。上传文件时使用 multipart/form-data。

语音转文字​

POST /v1/audio/transcriptions
Authorization: Bearer sk-your-api-key
Content-Type: multipart/form-data

调用示例​

curl -X POST "https://www.walmind.cn/v1/audio/transcriptions" \
-H "Authorization: Bearer $API_KEY" \
-F "file=@audio.mp3" \
-F "model=whisper-1"

响应示例:

{"text": "识别出的文字内容"}