GET
/
人类可读的首页 API 文档。
公开访问
公共 TTS 服务。既支持传入已分段的 segments,也支持直接提交长文本 text。服务端会走异步队列处理,并将最终音频上传到对象存储。
请求头:Authorization
固定值:Bearer WANGJI
除首页文档外,其余 API 请求都必须携带该请求头。
项目 ID。首次提交时如果不传,服务端自动创建;后续可以复用同一个 projectId 来归组多次请求。
请求 ID。每次创建任务都会生成新的 requestId,用于查询该次任务状态。
最小合成单元。segments 模式下由调用方提供;long_text 模式下由服务端自动切分。
/
人类可读的首页 API 文档。
/api/tts
JSON 格式 API 文档,适合程序读取。
/api/tts/health
健康检查。
{
"ok": true
}/api/tts/voices
获取当前可用音色列表。
/api/tts/requests
提交一个分段异步 TTS 请求。
{
"mode": "segments",
"voice": {
"voiceType": "zh_male_m191_uranus_bigtts",
"speedRatio": 1.0,
"pitchRatio": 1.0,
"volumeRatio": 1.0,
"emotion": ""
},
"options": {
"enableTimestamps": true,
"enableAlignment": false
},
"segments": [
{
"sequence": 1,
"text": "你好,欢迎使用公共 TTS 服务。"
},
{
"sequence": 2,
"text": "这是第二句测试文本。"
}
]
}{
"ok": true,
"projectId": "proj_xxxxxxxxxxxx",
"requestId": "req_xxxxxxxxxxxx",
"status": "queued",
"segmentCount": 2,
"queuePosition": 1,
"createdAt": "2026-06-01T08:04:51.210370Z"
}/api/tts/long-text
直接提交长文本,由服务端自动切分后异步合成。
{
"voice": {
"voiceType": "zh_female_vv_uranus_bigtts",
"speedRatio": 1.0,
"pitchRatio": 1.0,
"volumeRatio": 1.0,
"emotion": ""
},
"text": "这是一个长文本示例。服务端会自动按句子切分。然后逐段合成。最后拼接成完整音频。"
}{
"ok": true,
"projectId": "proj_xxxxxxxxxxxx",
"requestId": "req_xxxxxxxxxxxx",
"status": "queued",
"segmentCount": 3,
"queuePosition": 1,
"createdAt": "2026-06-01T08:04:51.210370Z"
}/api/tts/requests/{requestId}
查询某次请求的总体状态。
/api/tts/requests/{requestId}/segments
查询某次请求下每个 segment 的状态、音色和时长。
/api/tts/requests/{requestId}/artifacts
查询某次请求生成的产物,例如 final_audio、segments_json、segment_audio:*。
/api/tts/requests/{requestId}/events
SSE 实时事件流。