LLM 模型
Shisa LLM 提供三个层级。三者均使用相同的 OpenAI 兼容聊天补全端点 —— 您通过请求中的 model 字段选择模型。
| Model ID | 层级 | 参数量 | 最适合的用途 |
|---|---|---|---|
shisa-ai/shisa-v2.1-unphi4-14b | Flash | 14B | 经济高效、高吞吐量的日常任务 |
shisa-ai/shisa-v2.1-llama3.3-70b | Pro (推荐) | 70B | 日英双语工作中质量与速度的最佳平衡 |
shisa-ai/shisa-v2-405b | 旗舰 | 405B | 极致质量;按申请开放使用 |
Shisa V2.1 Flash
shisa-ai/shisa-v2.1-unphi4-14b
高效层级。一个基于 Phi-4 构建、针对日语调优的 14B 模型。当延迟和成本比榨取最后几个百分点的质量更重要时,请使用它 —— 例如聊天小部件、分类、大批量批处理任务。
Shisa V2.1 Pro
shisa-ai/shisa-v2.1-llama3.3-70b
推荐的默认选项。一个基于 Llama 3.3 的 70B 模型。它取得了 9.26 的日语 MT-Bench 和 73.1% 的日语平均分,是大多数生产环境双语工作负载的正确选择。完整的评估细节请阅读 Shisa V2.1 解析文章。
Shisa V2 405B
shisa-ai/shisa-v2-405b
旗舰。一个基于 Llama 3.1 的 405B 模型,达到 80.5% 的日语平均分 —— 这是 Shisa 所能提供的最高质量。
按申请开放使用
405B 模型面向白名单账户开放。请联系我们申请访问权限。详情请阅读 Shisa V2 405B 解析文章。
上下文窗口
每个层级都有自己的上下文窗口:Shisa V2.1 Flash 支持 16K 令牌,Shisa V2.1 Pro 支持 65K 令牌,Shisa V2 405B 支持 131K 令牌。由于实际提供的限制可能会变化,请在 Shisa 平台确认您账户的确切限制。