跳到主要内容

ASR ​快速​开始

本​指南​将​引导​您​完成​针对​ S​hisa AS​R ​的​首次​转录。​您​需要​一​个​ A​PI 密钥​——​在​ Shisa 平台中​创建​一​个。​新​账户​包含​**​$10 ​的​免费额​度​**。

1. ​获取​您​的​ A​PI 密钥

注册 Shisa AI ​账户,​并​从​ Shisa 平台获取​您​的​ A​PI ​密钥。​将​其带​上​ shsk: ​前缀,​放入​ Authorization ​标头​中:

Authorization: Bearer YOUR_API_KEY
注意

Shisa API 密钥​以​ shsk: ​开头。​请​将​完整​密钥​(包含​ shsk: ​前缀)​放入​ Authorization: Bearer YOUR_API_KEY ​请​求头。​令牌​缺失​或​格式​不​正确会​返​回 ​401 错误。

提示

请​勿​将​ A​PI 密钥​纳入源​代码​管理。​在​实际​应用​中,​应从​环境​变量​(例如​ SHISA_API_KEY)​中​读取​它。

2.​ ​准备​您​的​音频

API ​接受​ W​AV、​OGG、​MP​3 ​或​ FLAC ​格式​的​ base64 ​编码​音频。​请​先​将​任何​受​支持​的​文件​编码​为​ base64:

base64 -w0 audio.ogg # Linux
base64 -i audio.ogg # macOS

3. ​发起​请​求

将​ base64 ​编码​的​音频​放入​ audio ​字段,​向​端点​发送​ POST ​请​求。

curl
curl -s -XPOST 'https://api.shisa.ai/asr/srt/audio_llm' \
-H 'Authorization: Bearer YOUR_API_KEY' \
-H 'Content-Type: application/json' \
-d '{
"audio": "'$(base64 -w0 audio.ogg)'"
}'
Python
import base64
import requests

# Read and encode audio file
with open("audio.ogg", "rb") as f:
audio_data = base64.b64encode(f.read()).decode("utf-8")

url = "https://api.shisa.ai/asr/srt/audio_llm"
headers = {
"Authorization": "Bearer YOUR_API_KEY",
"Content-Type": "application/json"
}

payload = {
"audio": audio_data
}

response = requests.post(url, headers=headers, json=payload)
response.raise_for_status()
print(response.json())
JavaScript
async function transcribeAudio(audioFile) {
// Read file and convert to base64
const fileBuffer = await audioFile.arrayBuffer();
const base64Audio = btoa(
new Uint8Array(fileBuffer).reduce(
(data, byte) => data + String.fromCharCode(byte),
''
)
);

const response = await fetch('https://api.shisa.ai/asr/srt/audio_llm', {
method: 'POST',
headers: {
'Authorization': 'Bearer YOUR_API_KEY',
'Content-Type': 'application/json'
},
body: JSON.stringify({
audio: base64Audio
})
});

if (!response.ok) {
throw new Error(`API request failed: ${response.status}`);
}

return await response.json();
}

// Example usage with file input
document.querySelector('#audioInput').addEventListener('change', async (e) => {
const file = e.target.files[0];
if (file) {
const result = await transcribeAudio(file);
console.log('Transcription:', result);
}
});
备注

只​有​ audio ​字段​是​必需​的。​语言会​自动​检测,​调优​参数​使用​合理​的​默​认值。​要​指定​特定​语言​或​添加领域术语,​请​参阅 API ​参考

4.​ ​读​取响​应

API 返​回​一​个​ J​SON​ 响应,​包含​转录​文本、​检测到​的​语言​和​置信度​分数​:

{
"text": "こんにちは、シサAIです。",
"language": "ja",
"confidence": 0.98
}

后续​步​骤

  • 在​ API ​参考中查​看​每​个​请​求​参数​和​错误​代码。
  • 音频​与​语言中​查阅​支持​的​格式​和​可​检测​的​97​种​语言。
  • 认证中​了解​各​服务​通用​的​认证​标头​约定。