GRGlobalRouter Docs
Console

Audio / POST

Create speech

create文本转语音结果,并直接returns二进制音频流。

Endpoints

Mobile only shows the endpoint list. View parameter details and examples on desktop.

MethodEndpointDescription
POST/v1/audio/speechcreate文本转语音结果,并直接returns二进制音频流。
POST/v1/audio/voices通过一段参考音频create可复用的自定义音色。
POST/v1/audio/transcriptions上传音频文件并create转写结果。
POST/v1/audio/speech

用于 OpenAI 风格语音合成。请求必须通过 provider 指定providers;当前千问 TTS 使用 ali。

Back to Audio endpoint list

Request parameters

FieldTypeRequiredDescription
modelstringYes语音models ID,例如 qwen-audio-3.0-tts-flash。
inputstringYesText to read aloud.
voicestring | { id: string }Yes预置音色名称,或由create音色APIreturns的 voice_id(传 { id: voice_id })。
providerstringYes指定providers ID;调用千问models时填写 ali。
response_formatstringNo输出格式:aac、flac、mp3、opus、pcm 或 wav;默认 mp3。
formatstringNoresponse_format 的兼容别名;两者同时传入时必须一致。
speednumberNo语速,范围 0.25 到 4;默认 1。
instructionsstringNo朗读方式或声音风格指令,是否生效取决于providers能力。

Response fields

FieldTypeRequiredDescription
Content-TypeheaderYes输出音频的 MIME 类型。
X-Generation-IdheaderYes生成记录 ID,可用于排查请求。
bodybinaryYes音频二进制流;请按 response_format 保存到文件。

Errors

401UNAUTHORIZED

Missing or invalid Authorization Bearer token.

403FORBIDDEN

The current API key is not allowed to call this scope or model.

429RATE_LIMITED

请求过快或异步任务队列已满,请降低并发或稍后重试。

Notes

  • 预置音色名称和 voice.id 都会按 provider 路由;当前 qwen-audio-3.0-tts-flash 的 provider 为 ali。
  • 使用自定义音色时,先调用 POST /v1/audio/voices,再将returns的 id 作为 voice: { id: "..." } 传入。