/v1/audio/speech用于 OpenAI 风格语音合成。请求必须通过 provider 指定providers;当前千问 TTS 使用 ali。
Back to Audio endpoint listRequest parameters
FieldTypeRequiredDescription
modelstringYes语音models ID,例如 qwen-audio-3.0-tts-flash。inputstringYesText to read aloud.voicestring | { id: string }Yes预置音色名称,或由create音色APIreturns的 voice_id(传 { id: voice_id })。providerstringYes指定providers ID;调用千问models时填写 ali。response_formatstringNo输出格式:aac、flac、mp3、opus、pcm 或 wav;默认 mp3。formatstringNoresponse_format 的兼容别名;两者同时传入时必须一致。speednumberNo语速,范围 0.25 到 4;默认 1。instructionsstringNo朗读方式或声音风格指令,是否生效取决于providers能力。Response fields
FieldTypeRequiredDescription
Content-TypeheaderYes输出音频的 MIME 类型。X-Generation-IdheaderYes生成记录 ID,可用于排查请求。bodybinaryYes音频二进制流;请按 response_format 保存到文件。Errors
401
UNAUTHORIZEDMissing or invalid Authorization Bearer token.
403
FORBIDDENThe current API key is not allowed to call this scope or model.
429
RATE_LIMITED请求过快或异步任务队列已满,请降低并发或稍后重试。
Notes
- 预置音色名称和 voice.id 都会按 provider 路由;当前 qwen-audio-3.0-tts-flash 的 provider 为 ali。
- 使用自定义音色时,先调用 POST /v1/audio/voices,再将returns的 id 作为 voice: { id: "..." } 传入。