メインコンテンツまでスキップ

LLMモデル

Shisa LLMの​各モデルは、​同じ​OpenAI互換のチャット補完エンドポイントを​使用します。​リクエストのmodelフィールドで​モデルを​選択します。

APIキーで​利用​可能な​モデルを​確認する

モデルの​提供状況は​動的で、​APIキーの​権限に​基づいて​絞り込まれます。​使用中の​キーに​対する​正式な​カタログと​して、​必ずGET /openai/v1/modelsを​参照してください。

curl -s "https://api.shisa.ai/openai/v1/models" \
-H "Authorization: Bearer YOUR_API_KEY" | jq .

data[].idから​値を​選択します。max_model_lenが​含まれる​場合は、​その​デプロイでの​コンテキスト上限を​表します。

標準モデルティア

標準カタログには​以下の​ティアが​あります。​キーに​アクセス権が​ない​場合や​デプロイが​変更された​場合、​モデルが/modelsレスポンスに​含まれない​ことがあります。

Model IDティアパラメータ数適した用途
shisa-ai/shisa-v2.1-unphi4-14bFlash14Bコスト効率が​高く、​高スループットな​日常的タスク
shisa-ai/shisa-v2.1-llama3.3-70bPro (推奨)70B日英バイリンガル作業に​おける​品質と​速度の​最良の​バランス
shisa-ai/shisa-v2-llama3.1-405bフラッグシップ405B最高品質。​利用は​申請制

Shisa V2.1 Flash

shisa-ai/shisa-v2.1-unphi4-14b

高効率ティア。​Phi-4ベース上に​構築され、​日本語向けに​チューニングされた​14Bモデルです。​品質の​最後の​数ポイントを​絞り出すことよりも​レイテンシと​コストが​重要な​場合に​使用してください​ — チャットウィジェット、​分類、​大量の​バッチジョブなど。

Shisa V2.1 Pro

shisa-ai/shisa-v2.1-llama3.3-70b

推奨される​デフォルト。​Llama 3.3ベースの​70Bモデルです。日本​語M​T-Bench​ 9.26と​**日本語平均73.1%**を​記録し、​ほとんどの​本番バイリンガルワークロードに​適した​選択肢と​なっています。​完全な​評価の​詳細に​ついてはShisa V2.1の​解説記事を​ご覧ください。

Shisa V2 405B

shisa-ai/shisa-v2-llama3.1-405b

フラッグシップ。​Llama 3.1ベースの​405Bモデルで、​**日本語平均80.5%**に​達します — Shisaが​提供する​最高品質です。

利用は申請制

405Bモデルは​ホワイトリスト登録された​アカウントで​利用できます。​アクセスを​リクエストするにはお問い​合わせください。​詳細に​ついてはShisa V2 405Bの​解説記事を​ご覧ください。

コンテキストウィンドウ

各ティアには​異なる​コンテキストウィンドウが​あります。​標準デプロイでは、​Flashは​約16Kトークン、​Proは​約65Kトークン、​Shisa V2 405Bは​約131Kトークンと​報告されます。​現在の​上限は、​認証済みの/modelsレスポンスに​あるmax_model_lenを​確認してください。

次の​ステップ