跳到主要内容

LL​M 模型

Shisa L​LM模型​均​使用​相同​的​OpenAI​兼容聊​天补​全端点,​您​通过​请​求​中​的model字段​选择​模型。

列​出​您​的​密钥​可用​的​模型

模型​可用性​是​动态​的,​并​按​API密钥权限筛选。​请​始终​将GET /openai/v1/models视​为​当前​密钥​的​权威​目录:

curl -s "https://api.shisa.ai/openai/v1/models" \
-H "Authorization: Bearer YOUR_API_KEY" | jq .

data[].id中​选择​一​个值。​若响​应​包含max_model_len,​它​表示​该​部署​的​上下​文​上限。

标准​模型​层级

标准​目录​包含​以​下​层级。​如果​您​的​密钥​没有​访问​权限​或​部署​发生​变化,​某​个​模型​可能​不​会​出现在/models响​应​中。

Model ID层级参数量最​适合​的​用途
shisa-ai/shisa-v2.1-unphi4-14bFlash14B经济​高效、​高吞​吐量​的​日常​任务
shisa-ai/shisa-v2.1-llama3.3-70bPro (推荐)70B日​英双​语​工作​中​质量​与​速度​的​最佳​平衡
shisa-ai/shisa-v2-llama3.1-405b旗舰405B极致​质量;​按​申请​开放​使用

Shisa V2.1 Flash

shisa-ai/shisa-v2.1-unphi4-14b

高效​层级。​一​个​基于​ P​hi-4​ 构建、​针对​日语​调优​的​ 1​4​B ​模型。​当延迟​和​成本​比​榨取​最后​几​个​百分点​的​质量​更​重要​时,​请​使用​它​ ​——​ 例如​聊​天​小​部件、​分类、​大​批量​批​处理​任务。

Shisa V2.1 Pro

shisa-ai/shisa-v2.1-llama3.3-70b

推荐​的​默认​选​项。​一​个​基于​ L​lama 3.​3 ​的​ 70​B ​模型。​它​取得​了​ 9.2​6 ​的​日语​ MT-Bench ​和​ 73​.1​% ​的​日语​平均​分,​是​大多数​生产​环境​双语​工作​负载​的​正确​选择。​完整​的​评估​细节请​阅读 Shisa V2.1 解析文章

Shisa V2 405B

shisa-ai/shisa-v2-llama3.1-405b

旗舰。​一​个​基于​ L​lama 3​.​1 ​的​ 405​B ​模型,​达到​ 80.5​% ​的​日语​平均​分 ​—— ​这​是​ S​hisa ​所​能​提供​的​最高​质量。

按申请开放使用

405​B 模型​面向​白名​单账户​开放。​请联系​我们申请​访问​权限。​详情​请​阅读 Shisa V2 405B 解析文章

上​下文​窗口

每​个​层级​提供​不同​的​上下​文​窗口。​标准​部署​中,​Flas​h约​为16K​令牌,​Pr​o约​为65K​令牌,​Shisa V2 405​B约​为1​31K​令牌。​请​读取​经过​认证​的/models响​应​中​的max_model_len,​以​获取​当前​上限。

其他​可用​模型

我们​正​与​ A​libaba Cloud ​合作,​通过​引入​包括​ Qwen ​和​ G​LM ​在​内、​并​根据​我们​自己​的​基准​测试​针对​日本​市场​优化​的​前沿​编码​与​推理​能力,​扩充 ​Shisa ​的​模型​阵容。​此​次​集成​体现​了​我们​的​理念:​最​佳​开发者​体验应​将​开源​透​明度​与​前沿​推理​能力​的​访问​结合​起来,​并​全部​通过​一​个​ A​PI ​提供。

以​下模型​托管​在​ A​libaba Cloud ​新加坡​区域。

模型​名称Model ID描述
GLM 5.2glm-5.2适用​于​长​周期​任务、​推理、​长文本​理解​和​代码​生成​的​旗舰​模型
Qwen 3.7 Flashqwen3.7-flash针对​低​延迟​和​成本​效益​优化​的​多​模态​模型
Qwen 3.7 Maxqwen3.7-max面​向​复杂智​能​体​任务​的​ Q​wen 3​.7 ​旗舰模型
Qwen 3.7 Plusqwen3.7-plus适用​于​编码、​工具​使用​和​生产​力​工作流​的​均衡型​多​模态​模型

后续​步​骤