高度な機能
カスタムルーティング
TokSpan は、コスト・能力・アカウントのアクセス階層に応じて、各リクエストを最適な上流プロバイダーに自動的にルーティングします。コードに変更は不要です。
TokSpan のルーティングの仕組み
TokSpan はスマートルーティング層を使用します。呼び出すモデル名は、そのリクエストに最適な上流プロバイダーとモデルに自動的に解決されます。コードの変更は不要です。
ルーティングは完全に自動です。チャネルや優先順位を設定する必要はなく、希望のモデル名を呼び出すだけで、TokSpan が最適なバックエンドを選択します。
一般的なルーティングパターン
コスト最適化ルーティング
gpt-4o のような汎用モデル名を呼び出すと、TokSpan は現在最もコスト効率の高いプロバイダーに送信します。
キー単位のルーティング
用途ごとに別々の API キーを作成し、各キーを必要なモデルと予算に限定します:
- コスト重視のワークロード → 経済的なモデルに限定したキー(GPT mini、Gemini Flash、DeepSeek)
- プレミアムワークロード → フラッグシップモデルにアクセスできるキー(GPT、Claude Opus、Gemini Pro)
- 顧客向けアプリ → キーごとの予算上限を設定し、支出を予測可能に
機能ベースルーティング
TokSpan はモデルを能力ごとに内部的にグループ化し、各ワークロードを最適なモデルへルーティングします:
- コード支援 — コード最適化モデル(Claude Opus / GPT / DeepSeek)へルーティング
- コンテンツ作成 — 品質と速度のバランスが取れたモデル(Claude Sonnet / GPT / Gemini Pro)へルーティング
- データ分析 — 最大のコンテキストウィンドウを持つモデルへルーティング
キースコーピングを使うと、各キーがアクセスできるモデルを制限できます。詳細は認証 — キースコーピングをご覧ください。