高度な機能

カスタムルーティング

TokSpan は、コスト・能力・アカウントのアクセス階層に応じて、各リクエストを最適な上流プロバイダーに自動的にルーティングします。コードに変更は不要です。

TokSpan のルーティングの仕組み

TokSpan はスマートルーティング層を使用します。呼び出すモデル名は、そのリクエストに最適な上流プロバイダーとモデルに自動的に解決されます。コードの変更は不要です。

ルーティングは完全に自動です。チャネルや優先順位を設定する必要はなく、希望のモデル名を呼び出すだけで、TokSpan が最適なバックエンドを選択します。

一般的なルーティングパターン

コスト最適化ルーティング

gpt-4o のような汎用モデル名を呼び出すと、TokSpan は現在最もコスト効率の高いプロバイダーに送信します。

キー単位のルーティング

用途ごとに別々の API キーを作成し、各キーを必要なモデルと予算に限定します:

  • コスト重視のワークロード → 経済的なモデルに限定したキー(GPT mini、Gemini Flash、DeepSeek)
  • プレミアムワークロード → フラッグシップモデルにアクセスできるキー(GPT、Claude Opus、Gemini Pro)
  • 顧客向けアプリ → キーごとの予算上限を設定し、支出を予測可能に

機能ベースルーティング

TokSpan はモデルを能力ごとに内部的にグループ化し、各ワークロードを最適なモデルへルーティングします:

  • コード支援 — コード最適化モデル(Claude Opus / GPT / DeepSeek)へルーティング
  • コンテンツ作成 — 品質と速度のバランスが取れたモデル(Claude Sonnet / GPT / Gemini Pro)へルーティング
  • データ分析 — 最大のコンテキストウィンドウを持つモデルへルーティング
キースコーピングを使うと、各キーがアクセスできるモデルを制限できます。詳細は認証 — キースコーピングをご覧ください。