ヘルプ & サポート
FAQ
TokSpan に関するよくある質問:はじめ方、料金、API の使用法、データプライバシー、課金、セキュリティ、エンタープライズサポートについて説明します。
一般
TokSpanとは何ですか?どのように機能しますか?
TokSpanは 統合AI APIゲートウェイ であり、OpenAI、Anthropic、Google、Meta、DeepSeekを含む 50以上のプロバイダーから200以上のモデル にアクセスできる単一のOpenAI互換エンドポイントを提供します。
仕組みは次のとおりです:標準のOpenAI形式でTokSpanのAPIにリクエストを送信します。TokSpanがリクエストを適切な上流プロバイダーにルーティングし、必要に応じて形式を変換し、レスポンスを処理して返します。お客様の視点では、1つのAPI を呼び出すだけです — TokSpanがモデルルーティング、負荷分散、レート制限、自動フェイルオーバー、コスト追跡をバックグラウンドで管理します。
必要なのはTokSpanアカウントだけです。すべての上流プロバイダーとの関係は弊社が代行します — OpenAI、Anthropic、Googleの個別アカウントは不要です。
OpenAIやAnthropicを直接使う代わりにTokSpanを使う理由は?
- 1つのキーですべてのモデルに — 単一のAPIキーでGPT、Claude Opus、Gemini Pro、DeepSeekにアクセス。複数のプロバイダーで課金アカウントを管理する必要なし。
- ベンダーロックインなし — 1つのパラメーターを変更するだけでモデルを切り替えられます。どのプロバイダーがリクエストを処理してもコードは変わりません。
- 自動フェイルオーバー — プロバイダーがダウンした場合、トラフィックは自動的に同じモデルを提供するバックアッププロバイダーにルーティング。手動介入ゼロ。
- グローバルリーチ — 世界中の開発者にサービスを提供するグローバルエッジネットワーク。
- コストの可視性 — すべてのモデルとプロバイダーにわたる統合課金とリアルタイム使用量追跡を1つのダッシュボードで。
どうやって始めればいいですか?最初のAPIコールは?
開始まで約5分です:
- api.tokspan.com/register で サインアップ
- クレジット/デビットカード、Apple Pay / Google Pay、または地域のウォレットでアカウントに クレジットを追加
- ダッシュボード → APIキー ページから APIキーを作成
base_urlをhttps://api.tokspan.com/v1に変更して新しいキーを使用し、最初の呼び出しを実行
すでにOpenAI SDKを使用している場合、30秒で完了します。Python、TypeScript、curlのコード例については クイックスタートガイド を参照してください。
無料トライアルや無料モデルはありますか?
恒久的な無料枠は提供していません — それが実際にお客様にとって良い理由は次のとおりです:
- 品質を犠牲にする無料枠はありません — 大規模な無料枠はインフラ、サポート、モデルアクセスの妥協を必要とします。弊社はすべてを信頼性とモデルカバレッジに投資しています。
- 使った分だけ支払う — 最低利用義務なし。必要な分だけチャージできます。ほとんどの開発者は最初の1か月のテストで$5未満しか使いません。
- すべてのモデル、制限なし — チャージ残高があれば、プラットフォーム上のすべての最先端モデルにすぐにアクセスできます — 「無料枠限定」モデルの制限はありません。
新規アカウントには随時プロモーション用のスタータークレジットが付与される場合があります。サインアップ後、ダッシュボード を確認してください。
どのモデルが利用可能ですか?
主要な全カテゴリにわたって 200以上のモデル にアクセスできます:LLM(GPT、Claude Opus、Gemini Pro、DeepSeek、Llama、Mistral)、ビジョンおよびマルチモーダル、埋め込みおよびリランキング、音声およびオーディオ(TTS + STT)。
最新のトークン単位料金を含む完全なライブカタログは api.tokspan.com/pricing でご覧いただけます。カテゴリ概要と機能比較については モデルドキュメント を参照してください。
料金と課金
料金体系はどのようになっていますか?
TokSpan の価格は完全に透明です。消費したトークン分をお支払いいただき、各モデルのトークン単価は事前に表示されます。
すべてのモデルのトークン単位料金は、呼び出し前に モデルハブ でリアルタイムに確認できます。表示された価格がお支払いいただく価格です — 隠れたコストや予期しない課金はありません。
月額サブスクリプション および 最低利用義務 はありません。任意の金額をチャージしてすぐにモデルの呼び出しを開始できます。
どの支払い方法に対応していますか?手数料はありますか?
クレジットカード / デビットカード(Visa、Mastercard、American Express)をStripe経由で安全に受け付けています。さらに Apple Pay と Google Pay にも対応。また、お住まいの地域で利用可能な地域ウォレット決済(例:Alipay、WeChat Pay)もサポートしています — チェックアウト時に表示される正確な方法はお客様の地域によって異なります。
すべての支払いはUSD建てです。支払い確認後、残高はすぐに反映されます。
返金はありますか?
はい、以下のポリシーに従います:
- カード・ウォレット決済 — 未使用のクレジットは購入から 7日以内 であれば返金対象となります。プラットフォームサービス手数料(プロバイダー料金に上乗せされるマージン)のうち、既に消費されたトークン分は返金不可です。
返金をリクエストするには、アカウントのメールアドレスと支払い詳細を添えて support@tokspan.com までご連絡ください。
クレジットに有効期限はありますか?
はい。未使用のクレジットは購入から12か月で失効します。 このポリシーにより、プロバイダー側の負債を管理しながらサービス手数料を可能な限り低く抑えることができます。クレジット失効の30日前と7日前にメールリマインダーが送信されます。失効日はダッシュボードの 課金 → クレジット で確認できます。
リクエストの途中で残高がなくなるのを防ぐには?
TokSpanは残高が尽きる前に通知し、時間内にチャージできるようにします:
- ダッシュボード → 課金で低残高アラートの閾値を設定します
- 残高がこの閾値を下回るとメールアラートが届きます。重要なイベントのリアルタイム通知のためにWebhook/アプリ内通知の有効化を推奨します
- 閾値に達したら、課金ページでカード、Apple Pay / Google Pay、または地域のウォレットでチャージします
本番ワークロードを途切れさせないために、残高を健全に保ち、資金が尽きる前に通知を受け取れるアラートを設定してください。予期しない課金を心配する必要はありません — 残高がゼロになると、リクエストは明確な insufficient_user_quota エラーできれいに停止し、いつでも準備ができたときにチャージできます。
コストを管理し、利用上限を設定するには?
複数のレイヤーでコスト管理が可能です:
- キーごとの利用上限 — APIキーごとにハードキャップを設定。クォータを使い切ると、制限を引き上げるかチャージするまでリクエストは拒否されます。
- プラットフォームのレート制限 — RPM(1分あたりのリクエスト数)とTPM(1分あたりのトークン数)はアカウントとプラングループに適用されます。より高い制限はご要望に応じて提供されます。
- モデルホワイトリスト — キーを特定のモデルのみに制限(例: 開発キーでは安価なモデルのみ許可)。
- IPホワイトリスト — キーの使用を特定のIPアドレスまたは範囲に制限。
- リアルタイム使用量ダッシュボード — ダッシュボードでキー、モデル、期間ごとの利用額を監視。
キー単位の制限(利用上限、モデルアクセス、IPホワイトリスト)はキーの作成時または編集中に ダッシュボード → APIキー から設定します。詳細は キースコーピング を参照してください。
トークンはどのようにカウントされ、課金されますか?
トークンは上流プロバイダーと全く同じ方法でカウントされます:プロンプトトークン + 補完トークン = 課金対象の合計トークン数。各プロバイダーのトークナイザーを透過的に使用するため、プロバイダーを直接呼び出した場合と同じカウントになります。
マルチモーダル入力(画像、音声、動画)の場合:各プロバイダーはメディアをトークン換算する独自の計算式を持っています。弊社はプロバイダーの計算をそのまま通過させます — ダッシュボードには最終的なトークン数とコストが表示されます。一般的に:高解像度の画像は1枚あたり約85~170トークン(GPT)、音声は1秒あたり約50トークン(音声認識)です。
プロンプトキャッシング(Claude、GPT)対応モデルの場合、キャッシュされたプロンプトトークンはプロバイダーの割引キャッシュレートで課金されます。使用量ダッシュボードでは通常とキャッシュのトークン利用額が内訳表示されます。
データプライバシーとセキュリティ
TokSpanはプロンプトや補完をログに記録または保存しますか?
いいえ — プロンプトや補完内容は保存されません。 データはリアルタイムで弊社のインフラを通過し、永続化されません。課金の正確性と不正利用防止のため、リクエストの メタデータのみ(モデル、トークン数、タイムスタンプ、APIキーID)をログに記録します。これはお客様の使用量を計算しプラットフォームを保護するために必要です。
お客様のプロンプトや補完内容をモデルトレーニングに使用することは決してなく、データを第三者に販売または共有することもありません。
上流プロバイダーは私のデータでトレーニングしますか?防ぐには?
これはプロバイダーと設定によって異なります:
- OpenAI — API呼び出しのデータをトレーニングに使用 しません(2023年3月現在)。APIを通じて送信されたデータはデフォルトでモデルトレーニングに使用されません。
- Anthropic — APIデータをトレーニングに使用 しません。Claude APIデータは明示的にオプトインしない限りモデル改善に使用されません。
- Google (Gemini) — 有料APIの使用データをトレーニングに使用 しません。無料枠の使用は異なる条件が適用される場合があります。
- その他のプロバイダー — ポリシーは様々です。各プロバイダーの利用規約を確認してください。懸念がある場合はプロバイダーのデータ使用ポリシーを確認することを推奨します。
これを重視される場合は、当社チームが「トレーニングなし」ポリシーの明確なプロバイダー選定をお手伝いします — support@tokspan.comまでお問い合わせください。
APIキーはどのように保護されていますか?
すべてのAPIキーは保存時に暗号化(AES-256)されています。キーはダッシュボードでいつでも再度確認できます — キーを紛失した場合や漏洩が疑われる場合は、失効させて新しいキーを生成してください。すべてのAPIトラフィックは転送時にTLS 1.3で暗号化されます。多層防御として、IPホワイトリスト、モデル制限、月間利用上限を設定したAPIキーの使用を推奨します。セキュリティのベストプラクティスとして、90日ごとにキーをローテーションしてください。
どのようなセキュリティ認証とコンプライアンス基準を満たしていますか?
セキュリティはTokSpanの基盤です。当社のインフラストラクチャは以下の管理策を中心に構築されています:
- TLS 1.3 — 転送中のすべてのデータはエンドツーエンドで暗号化されます。
- AES-256 — APIキーと認証情報は保存時に暗号化されます。
- MFA — すべてのアカウントで多要素認証をサポートしています。
- GDPR準拠のプラクティス — データ最小化とプライバシー開示はプライバシーポリシーに記載されています。
セキュリティ体制の詳細については、エンタープライズのお客様はsupport@tokspan.comまでお問い合わせいただけます。
TokSpanはGDPR/CCPAに準拠していますか?
はい。当社のホステッドサービスはGDPRおよびCCPAの要件を実装しています:データ最小化(プロンプトやコンプリーションは保存しません)、目的制限(メタデータは課金および不正使用防止のみに使用)、リクエストに応じたユーザーデータの削除、透明性のあるデータ処理の開示。
厳格なデータレジデンシーやコンプライアンス要件がある場合は、当社チームにお問い合わせください。DPA(データ処理契約)の提供やご要件のご相談に対応いたします。support@tokspan.comまでお問い合わせください。
アカウントを削除するには?残高はどうなりますか?
ダッシュボード → 設定 → アカウント → アカウント削除から、アカウントと関連するすべてのデータを削除できます。アカウントの削除は永久的で元に戻せません。
残高について:
- 削除時点の残りのクレジットは没収されます。削除を開始する前に、残高を使用するか返金をリクエストすることを推奨します。
- 法律で義務付けられている請求記録(支払い領収書、請求書)は、法定期間(通常7年間)保持されます。
- その他のすべてのアカウントデータ(APIキー、使用ログ、メールアドレス、設定)は、30日以内に完全に消去されます。
DPA(データ処理契約)に署名できますか?
はい。DPAはエンタープライズアカウントおよびチームアカウントでご利用いただけます。当社は、GDPRデータ処理者の義務、サブプロセッサーの開示、越境転送保護措置(SCC)、および侵害通知のコミットメントをカバーする標準DPAを提供します。法務チームの要件を添えてsupport@tokspan.comまでご連絡ください。通常2〜3営業日で対応いたします。
APIと機能
APIはOpenAI SDKと完全互換ですか?どの機能がサポートされていますか?
はい、100%対応しています。base_urlをhttps://api.tokspan.com/v1に変更するだけで、既存のOpenAI SDKコードがPython、Node.js、Go、curl、または任意のOpenAI互換ライブラリですぐに動作します。
サポートされる機能:
- Chat Completions — システム/ユーザー/アシスタントメッセージを含む完全サポート
- ストリーミング —
stream: trueによるSSE(Server-Sent Events) - Function / Tool Calling — 並列ツール呼び出し、strictモード
- JSON Mode —
response_formatによる構造化出力 - Vision / Image Input — URLおよびbase64画像
- Embeddings — 複数プロバイダーにわたる完全サポート
- Audio — TTS(テキスト読み上げ)およびSTT(音声認識)
- Images — DALL·Eおよび互換モデルによる生成
- Rerank — 完全サポート
- Reasoning Effort — 対応モデルでは
reasoning_effortパラメータによる推論深度の制御
GPTやDeepSeekなどの推論深度を制御するには?
一部の推論モデルは、標準の reasoning_effort パラメータで推論深度を制御できます。TokSpan はこのパラメータを上流プロバイダーに透過的に転送します — 対応可否はモデル自体に依存します:
| 値 | 効果 | 最適な用途 |
|---|---|---|
low | 高速、最小限の推論 — 最低コスト | 単純なクエリ、分類 |
medium | バランスの取れた推論(ほとんどのモデルのデフォルト) | 一般的な会話 |
high | 最大推論深度 — 最高品質、低速、高コスト | 複雑な推論、コード生成 |
リクエストボディに含めるだけです — 例:"reasoning_effort": "high"。モデルがこのパラメータを受け付けない場合は省略すると、モデルのデフォルトが使用されます。モデルごとの対応はモデルカタログをご覧ください。
異なるモデルに切り替えるにはどうすればよいですか?
モデルの切り替えは1行の変更で完了します — リクエストの model フィールドにカタログの任意のモデルIDを設定するだけです:
- OpenAI互換: リクエストボディの
model: "MODEL_NAME" - Anthropicネイティブ: リクエストボディの
model: "MODEL_NAME" - Gemini互換:
generateContent内のmodel="MODEL_NAME"
コードはそのままで、モデル名が変わるだけです。すべての形式が同じAPIキーと残高を共有します。ライブ価格付きの全カタログは api.tokspan.com/pricing でご覧いただけます。
TokSpanはプロンプトキャッシングをサポートしていますか?どのくらい節約できますか?
はい。上流プロバイダーがサポートしている場合(Claude、GPT、Gemini)、プロンプトキャッシングは自動的に適用されます。同じプロンプトプレフィックスを複数のリクエストに送信すると、プロバイダーが計算をキャッシュし、キャッシュされた部分に対して割引料金(通常、フルプロンプトトークン価格の90%オフ)で課金します。
コードを変更する必要はありません。TokSpanはプロバイダーからのキャッシュステータスを透過的に通過させ、ダッシュボードにキャッシュ使用トークンと非キャッシュ使用トークンが表示されます。キャッシュヒットを最大化するには:
- 静的なコンテンツ(システムプロンプト、コンテキストドキュメント)をプロンプトの先頭に配置してください
- 動的なコンテンツ(ユーザーメッセージ、最新のクエリ)を末尾に配置してください
- 同じシステムプロンプトをリクエスト間で再利用してください
最適化ガイド全文はこちら:プロンプトキャッシング。
APIエラーをどのように処理すればよいですか?
TokSpanは標準のHTTPステータスコードを返します:
| コード | 意味 | 対処方法 |
|---|---|---|
400 | 不正なリクエスト — 不正な形式のペイロードまたは無効なパラメータ | APIリファレンスとリクエストボディを照合してください |
401 | APIキーが無効または欠落 | Authorizationヘッダーを確認し、キーが無効化されていないか確かめてください |
503 | モデルが見つからないか、一時的な過負荷 | カタログでモデル名を確認してください(大文字小文字を区別)。過負荷の場合はバックオフ付きで再試行 |
429 | レート制限超過、または残高/クォータ不足 | レート制限にはジッター付き指数バックオフを実装してください。エラーがクォータや残高に言及している場合(例: insufficient_user_quota)、リトライせず残高を補充してください |
5xx | 上流プロバイダーエラーまたはタイムアウト | バックオフ付きでリトライしてください。継続する場合、自動フェイルオーバーが同じモデルを提供するバックアッププロバイダーにルーティングします |
429および5xxエラーにはジッター付き指数バックオフの実装を推奨します。エラーレスポンスボディを含む完全なリファレンスはエラーコードをご覧ください。
信頼性とパフォーマンス
稼働時間とSLAはどうなっていますか?
ホステッドAPIの稼働率目標は99.99%です。当社のインフラストラクチャは、単一障害点のない複数のアベイラビリティゾーンにまたがって水平スケーリングされています。
エンタープライズプランには、稼働時間のコミットメント、クレジットペナルティ、優先インシデント対応を含む正式なSLAが含まれます。SLA条件についてはsupport@tokspan.comまでお問い合わせください。
上流プロバイダーがダウンした場合はどうなりますか?
TokSpanは、次の健全なモデルへ自動的にフェイルオーバーします。当社のシステムは:
- プロバイダーの利用不可(5xxエラー、タイムアウト)を数秒以内に検出します
- 最近停止が発生したプロバイダーをスキップします(一時的なクールダウン期間)
- フェイルオーバーチェーン(TokSpan が自動管理)の次のプロバイダーにルーティングします
チェーンは同じモデルを提供するプロバイダー間で構築され(例:GPT 系列を提供する複数のプロバイダー)、リクエスト消失ゼロを保証します。最終的にリクエストを処理したプロバイダーに対してのみ課金され、失敗した試行は課金されません。仕組みの詳細は自動フェイルオーバーをご覧ください。
プロバイダー直接呼び出しと比較してどの程度のレイテンシを期待すべきですか?
TokSpanは最小限のルーティングオーバーヘッド(通常100ms未満)を追加します。主要なレイテンシ要因は上流モデルの生成速度(初回トークンまでの時間およびトークン毎秒)であり、TokSpanを経由しても影響を受けません。
レイテンシ重視のアプリケーション向け:
- ストリーミング(
stream: true)を有効にして、トークン生成中にユーザーが結果を確認できるようにしてください - インタラクティブ用途にはより高速または軽量なモデルを選択してください — レイテンシ特性はモデルカタログで確認できます
- TokSpan のグローバルエッジネットワーク経由でルーティング — リクエストはユーザーに最も近いリージョンから処理されます
公開ステータスページはありますか?
はい。リアルタイムのサービス状態、インシデント履歴、計画メンテナンス期間についてはAPIステータスページをご確認ください。メール、Webhook、Bark、Gotifyでインシデント通知を購読できます。設定についてはWebhookをご覧ください。
アカウントとAPIキー
APIキーを作成・管理するには?
ダッシュボードにログインし、APIキーに移動して+ 新規キーをクリックします。各キーにわかりやすい名前(例:「production-backend」「mobile-app-dev」「staging-test」)を付けてください。キーは無制限に作成できます。
環境ごとに個別のキー(開発、ステージング、本番)を作成することを強く推奨します。各キーは独立した使用量追跡、利用上限、モデル制限を持ち、環境ごとまたはクライアントごとのコスト監視が容易になります。開発キーが侵害されても、本番キーは影響を受けません。
APIキーが漏洩した場合は?
ダッシュボードから直ちに無効化してください。無効化は即時に有効になります(反映まで60秒未満)。新しいキーを生成し、アプリケーションを更新してください。削除前に古いキーの使用ログに不審なアクティビティがないか監視してください。
予防のベストプラクティス:
- IPホワイトリストを使用して、キーの使用元を制限してください
- キー漏洩時の被害範囲を制限するために月間利用上限を設定してください
- 90日ごとにキーをローテーションしてください
- キーをバージョン管理にコミットしないでください。環境変数またはシークレットマネージャーを使用してください
開発、ステージング、本番環境をどのように設定すればよいですか?
ダッシュボードから環境ごとに個別のAPIキーを作成してください:
- 開発 — 厳しめの利用上限(例: $10)、安価なモデルに制限、IP制限なし(ローカル開発用)
- ステージング — 中程度の上限(例: $50)、本番と同じモデル、ステージングサーバーにIP制限
- 本番 — 必要に応じて高い上限、すべてのモデル、本番サーバーにIP制限
各キーには独自の使用量ダッシュボード、アラート、アクティビティログがあります。このセットアップにより、環境ごとのコスト可視性が得られ、開発フェーズのバグで本番予算が消費されるのを防ぎます。完全な設定リファレンスはキースコーピングをご覧ください。
エンタープライズとサポート
専用サポート、SLA、カスタムデプロイメントはありますか?
はい。エンタープライズプランには以下が含まれます:
- 専任アカウントマネージャー — すべての質問に対応する単一の窓口
- 優先サポート — 保証された応答時間(重大な問題は通常2時間以内)
- カスタムSLA — お客様のニーズに合わせたクレジットペナルティ付き稼働時間コミットメント
- 一括請求 — Net-30/60条件、発注書、マルチ通貨請求
- カスタムレート制限 — お客様のワークロードに合わせたRPM/TPM制限
- デプロイメント支援 — アーキテクチャレビューと、お客様のワークロードに応じた統合ガイダンス
要件を添えてsupport@tokspan.comまでご連絡ください。1営業日以内にご提案をまとめます。
サポートへの連絡方法は?どのチャネルがありますか?
複数のサポートチャネルをご用意しています:
- メール — support@tokspan.com(課金、アカウント、技術的な質問)。24時間以内に回答し、ほとんどの質問は1回のやり取りで解決します。
- ステータスページ — リアルタイムのインシデント更新はAPIステータス。停止時に通知を受け取るには購読してください。
エンタープライズのお客様には、当社のエンジニアリングチームとの共有Slackチャネルを提供し、リアルタイムのコラボレーションが可能です。