MINI
SEI Mini
速く、軽く。日常の文章処理と会話を、軽量な推論経路で即座に返します。
- 軽い依頼 — 軽量モデルでそのまま回答
- 考える依頼 — 軽量モデルのまま、推論を強めて回答
- sei-mini-v0
- テキストのみ
- 非ストリーミング
限定プレビュー公開中 · 日本発のAI推論API
すべての依頼を読み、最適な推論経路へ。
軽い仕事は即座に、考える仕事は深く。
それを、一つのAPIで。
Profiles
2つのプロファイルは、どちらも依頼を1件ずつ読み分けます。違いは、考える依頼をどこまで深く処理するか。
速く、軽く。日常の文章処理と会話を、軽量な推論経路で即座に返します。
必要なら、より強いモデルまで。設計・推論・コードのような考える依頼を、上位の推論経路で深く処理します。
For developers
OpenAI形式の Chat Completions API に対応(一部)。接続先とキーを差し替えるだけで、推論経路の選択は SEI AI が引き受けます。対応範囲は API説明 へ。
curl --fail-with-body "$SEI_BASE_URL/v1/chat/completions" \
-H "Authorization: Bearer $SEI_API_KEY" \
-H 'Content-Type: application/json' \
-d '{
"model":"sei-standard-v0",
"messages":[{"role":"user","content":"来週中に検証します、を丁寧に書き換えて"}],
"max_completion_tokens":1024,
"stream":false
}'import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["SEI_API_KEY"],
base_url=os.environ.get("SEI_BASE_URL", "https://seiai.dev") + "/v1",
timeout=70.0,
max_retries=0,
)
result = client.chat.completions.create(
model="sei-standard-v0",
messages=[{"role": "user", "content": "この文章を短くしてください。来週中に検証を実施する予定です。"}],
max_completion_tokens=1024,
stream=False,
)
print(result.choices[0].message.content)FAQ
単一のモデルではありません。依頼を1件ずつ判定し、複数の推論基盤から処理経路を組み立てる推論エンジンです。公開しているモデルIDは、その経路の方針(処理プロファイル)の名前です。
書き換え・要約・翻訳から、設計の相談、コードの検討、多段の推論まで。テキストの入出力に対応しています。
データの取扱いをご確認ください。プレビューでは機密情報・個人情報を入力しないでください。
限定プレビューの期間中は無料です。正式な料金は今後お知らせします。