跳到主要内容

TTS API ​参考

Shisa TTS API ​提供​两​个​端点:​一​个​用于​生成​语音,​一​个​用于​列出​可​用​声音。​两者​均​使用​标准​ Bearer ​令牌​进行​身份验证。

Authorization: Bearer YOUR_API_KEY

端点

生成语​音

POST https://api.shisa.ai/tts

将​文本​转换​为​语音​音频。​以​请求​的​格式​返回二​进制​音频​数据。

列​出声​音

GET https://api.shisa.ai/tts/voices

返回​所有​可​用​声音​的​ J​SON 数组,​包括​其​元​数据、​支持​的​格式​和​流式​传输​功能。​目录请​参阅声​音

请​求​参数

POST /tts ​端点​的​参数,​以​ J​SON ​主体​形式​发送:

参数类型必填描述
voice_idstring必填要​使用​的​声音​ UU​ID。​可​从​ GET /tts/voices ​获取​可​用​ ID。
textstring必填要​转换​为​语音​的​文本。
formatstring必填输出音频​格式。​必须​是​所​选声​音​支持​的​格式。mp3wavoggpcmflac ​之一。
streamboolean可​选为​ true ​时,​以​分块流​形式​返​回音​频​用于​实时​播放。​仅​适用​于​ streaming: true ​的​声音。​默​认为​ false

响​应

POST /tts — 二​进制​音频

成功​时,​AP​I 返​回带​有​适当​ Content-Type 头​(例如​ audio/mp3)​的​原始​二​进制​音频​数据。​将响​应体​直接​保存到​文件:

# The response is binary audio data — save directly to file
curl -s -X POST "https://api.shisa.ai/tts" \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{"voice_id": "61ba1141-60aa-4bc3-a3b3-be1ec20700b3", "format": "mp3", "text": "テスト"}' \
--output speech.mp3

GET /tts/voices — JSON

返回​可​用​声音​对象​的​ J​SON 数​组:

[
{
"id": "e3362c0a-7677-4cd8-b122-91fb093305c9",
"description": "Young male Japanese voice...",
"language": "Japanese & English",
"gender": "Male",
"formats": ["mp3", "ogg", "pcm"],
"sample_rates": [8000, 16000, 22050, 24000, 32000, 44100, 48000],
"streaming": true
}
]

声音​对​象​字段:

字段类型描述
idstring (uuid)在​请求​中用​作 voice_id ​的​ U​U​ID。
descriptionstring人类​可读​的​声音​描述。
languagestring支持​的​语言。
genderstring声音性别​(Male、​Fe​male、​Ne​utral)。
formatsarray支持​的​输出音频​格式。
sample_ratesarray支持​的​输出​采样率​(Hz)。
streamingboolean声音​是否​支持实时​流式​传输。

错误​处理

错误​以下列​格式​的​ J​SON 返回:

{
"context": ["..."],
"code": 104,
"name": "ErrAuthenticationFailed",
"error": "Authentication error: Invalid token"
}

错误代​码

状态原​因解决​方案
400参数​缺失​或​无效检查​ voice_idtext ​和​ format ​字段。
400声音​不​支持​的​格式使用​声音​ formats 数​组​中​列出​的​格式。
401API ​密钥​无效​或​缺失检查​您​的​ Authorization: Bearer 头。
429超​出速率​限制使用​指数​退避​等​待后​重试。
500内部​服务器​错误重试​请​求​或​联系​技术​支持。
注意

当​请​求​的​ format ​不​在​所选​声音​的​ formats 数​组​中​时,​也​会​返​回 400。​生成​语​音前,​请​使用​ GET /tts/voices 确​认声​音​支持​的​格式。

后续​步​骤

  • 快速​开始中​逐步​完成​您​的​第一​个​请求。
  • 声​音目录​中浏览​可​用​声音。
  • 价格中​了解​用量​的​计费​方式。