LLM 模型
Shisa LLM模型均使用相同的OpenAI兼容聊天补全端点,您通过请求中的model字段选择模型。
列出您的密钥可用的模型
模型可用性是动态的,并按API密钥权限筛选。请始终将GET /openai/v1/models视为当前密钥的权威目录:
curl -s "https://api.shisa.ai/openai/v1/models" \
-H "Authorization: Bearer YOUR_API_KEY" | jq .
从data[].id中选择一个值。若响应包含max_model_len,它表示该部署的上下文上限。
标准模型层级
标准目录包含以下层级。如果您的密钥没有访问权限或部署发生变化,某个模型可能不会出现在/models响应中。
| Model ID | 层级 | 参数量 | 最适合的用途 |
|---|---|---|---|
shisa-ai/shisa-v2.1-unphi4-14b | Flash | 14B | 经济高效、高吞吐量的日常任务 |
shisa-ai/shisa-v2.1-llama3.3-70b | Pro (推荐) | 70B | 日英双语工作中质量与速度的最佳平衡 |
shisa-ai/shisa-v2-llama3.1-405b | 旗舰 | 405B | 极致质量;按申请开放使用 |
Shisa V2.1 Flash
shisa-ai/shisa-v2.1-unphi4-14b
高效层级。一个基于 Phi-4 构建、针对日语调优的 14B 模型。当延迟和成本比榨取最后几个百分点的质量更重要时,请使用它 —— 例如聊天小部件、分类、大批量批处理任务。
Shisa V2.1 Pro
shisa-ai/shisa-v2.1-llama3.3-70b
推荐的默认选项。一个基于 Llama 3.3 的 70B 模型。它取得了 9.26 的日语 MT-Bench 和 73.1% 的日语平均分,是大多数生产环境双语工作负载的正确选择。完整的评估细节请阅读 Shisa V2.1 解析文章。
Shisa V2 405B
shisa-ai/shisa-v2-llama3.1-405b
旗舰。一个基于 Llama 3.1 的 405B 模型,达到 80.5% 的日语平均分 —— 这是 Shisa 所能提供的最高质量。
405B 模型面向白名单账户开放。请联系我们申请访问权限。详情请阅读 Shisa V2 405B 解析文章。
上下文窗口
每个层级提供不同的上下文窗口。标准部署中,Flash约为16K令牌,Pro约为65K令牌,Shisa V2 405B约为131K令牌。请读取经过认证的/models响应中的max_model_len,以获取当前上限。
其他可用模型
我们正与 Alibaba Cloud 合作,通过引入包括 Qwen 和 GLM 在内、并根据我们自己的基准测试针对日本市场优化的前沿编码与推理能力,扩充 Shisa 的模型阵容。此次集成体现了我们的理念:最佳开发者体验应将开源透明度与前沿推理能力的访问结合起来,并全部通过一个 API 提供。
以下模型托管在 Alibaba Cloud 新加坡区域。
| 模型名称 | Model ID | 描述 |
|---|---|---|
| GLM 5.2 | glm-5.2 | 适用于长周期任务、推理、长文本理解和代码生成的旗舰模型 |
| Qwen 3.7 Flash | qwen3.7-flash | 针对低延迟和成本效益优化的多模态模型 |
| Qwen 3.7 Max | qwen3.7-max | 面向复杂智能体任务的 Qwen 3.7 旗舰模型 |
| Qwen 3.7 Plus | qwen3.7-plus | 适用于编码、工具使用和生产力工作流的均衡型多模态模型 |