GRGlobalRouter Docs
Console

Audio / POST

Create voice

通过一段参考音频create可复用的自定义音色。

Endpoints

Mobile only shows the endpoint list. View parameter details and examples on desktop.

MethodEndpointDescription
POST/v1/audio/speechcreate文本转语音结果,并直接returns二进制音频流。
POST/v1/audio/voices通过一段参考音频create可复用的自定义音色。
POST/v1/audio/transcriptions上传音频文件并create转写结果。
POST/v1/audio/voices

请求会调用指定 provider 的声音复刻能力,并returns voice_id;后续语音合成通过 voice: { id: voice_id } 使用。

Back to Audio endpoint list

Request parameters

FieldTypeRequiredDescription
namestringYes自定义音色名称。
providerstringYes指定providers ID;调用千问时填写 ali。
audio_samplefileYes参考音频文件,支持 WAV、MP3、M4A,最大 10 MiB。
modelstringNoTTS models ID;默认 qwen-audio-3.0-tts-flash。

Response fields

FieldTypeRequiredDescription
idstringYescreate成功后的 voice_id。
objectstringYes固定为 voice。
namestringYescreate时提交的音色名称。

Errors

401UNAUTHORIZED

Missing or invalid Authorization Bearer token.

403FORBIDDEN

The current API key is not allowed to call this scope or model.

429RATE_LIMITED

请求过快或异步任务队列已满,请降低并发或稍后重试。

Notes

  • audio_sample 使用 multipart/form-data 上传,不能传 URL 或 Base64 文本。
  • 为提高复刻成功率,参考音频应是清晰、连续的人声;上游要求至少 5 秒,推荐 10 到 20 秒,最长不超过 60 秒。
  • 千问create音色按次计费,每次 0.01 元。