/v1/audio/voices请求会调用指定 provider 的声音复刻能力,并returns voice_id;后续语音合成通过 voice: { id: voice_id } 使用。
Back to Audio endpoint listRequest parameters
FieldTypeRequiredDescription
namestringYes自定义音色名称。providerstringYes指定providers ID;调用千问时填写 ali。audio_samplefileYes参考音频文件,支持 WAV、MP3、M4A,最大 10 MiB。modelstringNoTTS models ID;默认 qwen-audio-3.0-tts-flash。Response fields
FieldTypeRequiredDescription
idstringYescreate成功后的 voice_id。objectstringYes固定为 voice。namestringYescreate时提交的音色名称。Errors
401
UNAUTHORIZEDMissing or invalid Authorization Bearer token.
403
FORBIDDENThe current API key is not allowed to call this scope or model.
429
RATE_LIMITED请求过快或异步任务队列已满,请降低并发或稍后重试。
Notes
- audio_sample 使用 multipart/form-data 上传,不能传 URL 或 Base64 文本。
- 为提高复刻成功率,参考音频应是清晰、连续的人声;上游要求至少 5 秒,推荐 10 到 20 秒,最长不超过 60 秒。
- 千问create音色按次计费,每次 0.01 元。