幫助與支援
常見問題
關於 TokSpan 的常見問題:入門指南、定價、API 使用、資料隱私、計費、安全及企業支援。
一般問題
什麼是 TokSpan?它如何運作?
TokSpan 是一個統一的 AI API 閘道,為您提供單一 OpenAI 相容端點,即可存取來自 50 多家供應商的 200 多個模型——包括 OpenAI、Anthropic、Google、Meta、DeepSeek 等。
運作方式如下:您以標準 OpenAI 格式向 TokSpan 的 API 傳送請求。TokSpan 將您的請求路由至適當的上游供應商,必要時轉換格式,處理回應後返回給您。從您的角度來看,您呼叫的是一個 API——TokSpan 在背後管理模型路由、負載平衡、速率限制、自動容錯移轉及成本追蹤。
您只需要一個 TokSpan 帳號。我們為您處理所有上游供應商關係——無需分別註冊 OpenAI、Anthropic 或 Google 帳號。
為什麼使用 TokSpan 而不是直接使用 OpenAI 或 Anthropic?
- 一把金鑰,所有模型——使用單一 API 金鑰即可存取 GPT、Claude Opus、Gemini Pro 和 DeepSeek。無需管理不同供應商的多個計費帳號。
- 無供應商鎖定——只需更改一個參數即可切換模型。無論由哪個供應商提供服務,您的程式碼保持不變。
- 自動容錯移轉——若供應商發生故障,流量會自動路由至提供相同模型的備用供應商。無需人工介入。
- 全球覆蓋——服務全球開發者的全球邊緣網路。
- 成本可視性——在單一儀表板中跨所有模型和供應商的統一計費與即時使用量追蹤。
如何開始使用?如何進行第一次 API 呼叫?
入門大約只需 5 分鐘:
- 在 api.tokspan.com/register 註冊
- 透過信用卡/簽帳金融卡、Apple Pay / Google Pay 或本地錢包為您的帳號新增點數
- 從儀表板 → API 金鑰頁面建立 API 金鑰
- 進行第一次呼叫——只需將
base_url更改為https://api.tokspan.com/v1並使用您的新金鑰
若您已在使用 OpenAI SDK,只需 30 秒即可完成。請參閱快速入門指南以取得 Python、TypeScript 和 curl 的程式碼範例。
有免費試用或免費模型嗎?
我們不提供永久免費方案——原因如下,這實際上對您有利:
- 無補貼性的品質下降——大規模的免費方案需要在基礎架構、支援或模型存取上偷工減料。我們將一切投資於可靠性和模型覆蓋範圍。
- 只需為實際用量付費——無最低承諾。儲值任意金額即可。大多數開發者在測試的第一個月花費不到 $5。
- 所有模型,無限制——您的付費餘額讓您立即存取平台上的所有前沿模型——沒有「免費方案限定」的模型限制。
新帳號可能不時獲得推廣用的起始點數。註冊後請查看儀表板。
有哪些模型可用?
我們提供200 多個模型的存取,涵蓋所有主要類別:LLM(GPT、Claude Opus、Gemini Pro、DeepSeek、Llama、Mistral)、視覺與多模態、嵌入與重新排序,以及語音與音訊(TTS + STT)。
請在 api.tokspan.com/pricing 瀏覽完整的即時目錄及當前每 Token 定價。請參閱模型文件以取得類別概覽和功能比較。
定價與計費
定價如何運作?
TokSpan 的價格完全透明。您支付所消耗的 Token 費用,每個模型的每 Token 價格都會預先顯示。
每個模型的每 Token 價格在您進行呼叫前,即可在 Model Hub 上即時查看。您看到的價格就是您支付的價格——無隱藏費用,無意外帳單。
無月費訂閱,也無最低承諾。儲值任意金額即可立即開始呼叫模型。
接受哪些付款方式?有手續費嗎?
我們接受信用卡/簽帳金融卡(Visa、Mastercard、American Express)透過 Stripe 安全處理,以及 Apple Pay 和 Google Pay。我們也支援地區性本地錢包付款(例如支付寶和微信支付),實際付款方式取決於您所在地區。
所有付款均以美元計價。付款確認後,餘額會立即更新。
提供退款嗎?
是的,政策如下:
- 信用卡及錢包付款——未使用的點數可在購買後 7 天內申請退款。已消耗 Token 的平台服務費(我們在供應商費率上加收的利潤)不予退款。
若要申請退款,請將您的帳號電子郵件和付款詳情寄送至 support@tokspan.com。
點數會過期嗎?
是的。未使用的點數將在購買後 12 個月過期。此政策使我們能夠管理供應商端的責任,同時盡可能降低服務費。您將在點數過期前 30 天和 7 天收到電子郵件提醒。過期日期可在儀表板的計費 → 點數下查看。
如何避免請求中途餘額耗盡?
TokSpan 會在餘額耗盡前通知您,讓您及時儲值:
- 在儀表板 → 計費中設定您的低餘額警示閾值
- 當餘額低於此閾值時,您會收到電子郵件提醒,並建議您啟用Webhook/應用內通知以取得重要事件的即時提醒
- 遇到閾值時,直接在計費頁面使用您的卡片、Apple Pay / Google Pay 或本地錢包儲值即可
為避免生產環境中斷,請保持餘額健康並設定提醒,讓您能在資金用完前收到通知。您無須擔心意外扣款——餘額歸零時請求會以明確的 insufficient_user_quota 錯誤乾淨停止,您可以隨時準備好再儲值。
如何控制成本和設定消費上限?
您有多層成本控制機制:
- 每金鑰消費上限——為每個 API 金鑰設定嚴格的消費上限。當金鑰用盡額度時,請求將被拒絕,直到您提高限制或儲值。
- 平台速率限制——RPM(每分鐘請求數)與 TPM(每分鐘 Token 數)限制套用於您的帳戶與方案群組;更高的限制可依需求申請。
- 模型白名單——將金鑰限制為僅能使用特定模型(例如,僅允許開發金鑰使用較便宜的模型)。
- IP 白名單——將金鑰使用限制為特定 IP 位址或範圍。
- 即時使用量儀表板——在儀表板中按金鑰、模型和時間段監控消費。
金鑰層級的限制(消費上限、模型存取、IP 白名單)均在建立或編輯金鑰時從儀表板 → API 金鑰 設定。請參閱金鑰範圍設定以取得詳細資訊。
Token 如何計算和計費?
Token 的計算方式與上游供應商完全一致:Prompt Token + 補全 Token = 總計費 Token。我們透傳每個供應商的 Token 化器,因此計數與您直接呼叫供應商時看到的數量相符。
對於多模態輸入(圖片、音訊、影片):每個供應商有其自己的公式將媒體轉換為 Token 等效值。我們透傳供應商的計算結果——您的儀表板顯示最終的 Token 數量和成本。一般來說:高解析度圖片每張約 85–170 Token(GPT),音訊約每秒 50 Token(語音轉文字)。
對於支援 Prompt 快取的模型(Claude、GPT),已快取的 Prompt Token 按供應商的折扣快取費率計費。您的使用量儀表板會區分一般與快取 Token 的消費明細。
資料隱私與安全
TokSpan 會記錄或儲存我的提示詞和補全嗎?
不會——我們不儲存您的 Prompt 或補全內容。您的資料僅即時流經我們的基礎架構,不會被持久化。我們僅記錄請求的中繼資料(模型、Token 數量、時間戳記、API 金鑰 ID),用於計費準確性和濫用防範。這是計算您的用量和保護平台所必需的。
我們絕不使用您的 Prompt 或補全內容進行模型訓練,也絕不出售或與第三方分享您的資料。
上游供應商會使用我的資料進行訓練嗎?如何防止?
這取決於供應商和您的設定:
- OpenAI——不會使用 API 呼叫進行訓練(自 2023 年 3 月起)。預設情況下,透過 API 傳送的資料不會用於模型訓練。
- Anthropic——不會使用 API 資料進行訓練。除非您明確選擇加入,否則 Claude API 資料不會用於模型改進。
- Google (Gemini)——不會使用付費 API 使用量進行訓練。免費方案的使用量可能適用不同條款。
- 其他供應商——政策各異。請查閱各供應商的條款。若此為您的關注點,我們建議您檢閱供應商的資料使用政策。
若這是您的優先考量,我們的團隊可協助您為工作負載選擇具有明確不訓練政策的供應商 — 請聯絡 support@tokspan.com。
我的 API 金鑰如何受到保護?
所有 API 金鑰皆經靜態加密(AES-256)。您可以隨時在儀表板中再次查看金鑰 — 若金鑰遺失或疑似外洩,請撤銷並產生新的金鑰。所有 API 流量在傳輸過程中皆以 TLS 1.3 加密。我們建議對 API 金鑰使用IP 白名單、模型範圍限制和每月消費上限來建立縱深防禦。每 90 天輪換金鑰是一項安全最佳實踐。
你們有哪些安全認證和合規標準?
安全性是 TokSpan 的基石。我們的基礎架構圍繞以下控制措施建構:
- TLS 1.3 — 所有傳輸中的資料全程端對端加密。
- AES-256 — API 金鑰與憑證靜態加密。
- MFA — 所有帳戶皆支援多重要素驗證。
- 符合 GDPR 的實務 — 資料最小化與隱私揭露已於我們的《隱私權政策》中說明。
企業客戶可透過 support@tokspan.com 索取我們安全態勢的更多詳細資訊。
TokSpan 是否符合 GDPR / CCPA 規範?
是的。我們的託管服務落實 GDPR 與 CCPA 要求:資料最小化(我們不儲存您的提示詞/補全內容)、目的限制(中繼資料僅用於計費與濫用防範)、依要求刪除使用者資料,以及透明的資料處理揭露。
若您有嚴格的資料駐留或合規需求,請聯絡我們的團隊 — 我們可提供 DPA(資料處理協議)並討論您的需求。請來信 support@tokspan.com。
如何刪除我的帳戶?我的餘額會怎樣?
您可以從儀表板 → 設定 → 帳戶 → 刪除帳戶刪除您的帳戶及所有相關資料。帳戶刪除為永久且不可逆。
關於您的餘額:
- 刪除時任何剩餘點數將被沒收。我們建議您在啟動刪除前先使用餘額或申請退款。
- 法律要求的計費記錄(付款收據、發票)將依法定期限保留 — 通常為 7 年。
- 所有其他帳戶資料(API 金鑰、使用記錄、電子郵件、設定)將在 30 天內永久清除。
我可以簽署 DPA(資料處理協議)嗎?
是的。DPA 適用於企業與團隊帳戶。我們提供標準 DPA,涵蓋 GDPR 資料處理者義務、子處理者揭露、跨境傳輸保障(SCC)及資料外洩通知承諾。請聯絡 support@tokspan.com 並附上您法務團隊的需求 — 一般處理時間為 2–3 個工作日。
API 與功能
API 是否完全相容 OpenAI SDK?支援哪些功能?
是的,100%。將 base_url 更改為 https://api.tokspan.com/v1,您現有的 OpenAI SDK 程式碼即可立即運作 — Python、Node.js、Go、curl 或任何 OpenAI 相容的函式庫。
支援的功能:
- Chat Completions — 完整支援,包括 system/user/assistant 訊息
- 串流 — SSE(伺服器傳送事件),使用
stream: true - Function / Tool Calling — 並行工具呼叫、strict 模式
- JSON 模式 — 使用
response_format的結構化輸出 - 視覺 / 圖片輸入 — URL 與 base64 圖片
- Embeddings — 跨多個供應商的完整支援
- 音訊 — TTS(文字轉語音)與 STT(語音轉文字)
- 圖片 — 透過領先的圖片模型生成
- Rerank — 完整支援
- 推理力度 — 在支援的模型上透過
reasoning_effort參數控制推理深度
如何控制 GPT 或 DeepSeek 等模型的推理深度?
部分推理模型接受標準的 reasoning_effort 參數來控制推理深度。TokSpan 會將此參數轉傳至上游供應商 — 是否支援取決於模型本身:
| 數值 | 效果 | 最適合 |
|---|---|---|
low | 快速、最小推理 — 成本最低 | 簡單查詢、分類 |
medium | 平衡推理(大多數模型的預設值) | 一般對話 |
high | 最大推理深度 — 最佳品質、速度較慢、成本較高 | 複雜推理、程式碼生成 |
只需在請求主體中加入即可 — 例如 "reasoning_effort": "high"。若模型不接受此參數,請省略,將使用模型的預設值。請參閱模型目錄了解各模型的支援情況。
如何在不同模型之間切換?
切換模型只需一行變更 — 在請求中將 model 欄位設為目錄中的任何模型 ID 即可:
- OpenAI 相容:請求主體中的
model: "MODEL_NAME" - Anthropic 原生:請求主體中的
model: "MODEL_NAME" - Gemini 相容:
generateContent中的model="MODEL_NAME"
您的程式碼保持不變 — 只有模型名稱會變更,且所有格式共用同一個 API 金鑰與餘額。請至 api.tokspan.com/pricing 瀏覽含即時價格的完整目錄。
TokSpan 支援 prompt caching 嗎?可以節省多少?
是的。當上游供應商支援時(Claude、GPT、Gemini),Prompt Caching 會自動套用。當您跨多次請求傳送相同的提示詞前綴時,供應商會快取計算結果,並對已快取的部分以折扣費率計費 — 通常為完整提示詞 token 價格的一折。
您無需更改程式碼。TokSpan 會傳遞供應商的快取狀態,您的儀表板會顯示已快取與未快取的 token 使用量。最大化快取命中率的方法:
- 將靜態內容(系統提示詞、上下文文件)放在提示詞的開頭
- 將動態內容(使用者訊息、最新查詢)放在結尾
- 在多次請求中重複使用相同的系統提示詞
閱讀完整最佳化指南:Prompt Caching。
如何處理 API 錯誤?
TokSpan 返回標準 HTTP 狀態碼:
| 代碼 | 說明 | 處理方式 |
|---|---|---|
400 | 請求錯誤 — 格式錯誤的酬載或無效參數 | 對照 API 參考文件檢查您的請求主體 |
401 | 無效或遺失的 API 金鑰 | 驗證您的 Authorization 標頭;檢查金鑰是否已被撤銷 |
503 | 找不到模型,或暫時超載 | 在目錄中檢查模型名稱(區分大小寫);若為超載,請以退避策略重試 |
429 | 超過速率限制,或餘額/額度不足 | 針對速率限制,實作帶有抖動的指數退避。若錯誤提及額度或餘額(例如 insufficient_user_quota),請新增點數,而非重試 |
5xx | 上游供應商錯誤或逾時 | 使用退避機制重試;若持續發生,自動容錯移轉應將請求路由至提供相同模型的備援供應商 |
我們建議對 429 和 5xx 錯誤實作帶有抖動的指數退避。請參閱錯誤代碼獲取包含錯誤回應主體的完整參考。
可靠性與效能
你們的服務正常運作時間和 SLA 是多少?
我們的託管 API 目標為99.99% 正常運作時間。我們的基礎設施跨多個可用區域水平擴展,無單點故障。
企業方案包含正式 SLA,涵蓋正常運作時間承諾、點數罰則及優先事件回應。請聯絡 support@tokspan.com 了解 SLA 條款。
當上游供應商故障時會發生什麼?
TokSpan 會自動容錯移轉至下一個健康模型。我們的系統:
- 在數秒內偵測供應商不可用狀態(5xx 錯誤、逾時)
- 跳過近期曾發生中斷的供應商(暫時冷卻視窗)
- 將請求路由至容錯移轉鏈中的下一個供應商(由 TokSpan 自動管理)
該鏈由提供相同模型的供應商組成(例如多個提供 GPT 系列的供應商),確保零請求遺失。您只需為最終處理請求的供應商付費 — 失敗的嘗試不計費。請參閱自動容錯移轉了解運作方式。
相比直接呼叫供應商,預期延遲是多少?
TokSpan 增加的路由開銷極小 — API 請求通常低於 100 毫秒。主要的延遲因素來自上游模型的生成速度(首 token 時間與每秒 token 數),這不受透過 TokSpan 路由的影響。
針對對延遲敏感的應用:
- 啟用串流(
stream: true),讓使用者在 token 生成時即可看到 - 為互動用途選擇更快或更輕量的模型 — 延遲概況請見模型目錄
- 透過 TokSpan 的全球邊緣網路路由 — 請求從離使用者最近的區域提供服務
你們有公開的狀態頁面嗎?
帳戶與 API 金鑰
如何建立和管理 API 金鑰?
登入儀表板,前往API 金鑰,點擊+ 新增金鑰。為每個金鑰取一個描述性名稱(例如「production-backend」、「mobile-app-dev」、「staging-test」)。您可以建立無限數量的金鑰。
我們強烈建議為每個環境建立獨立金鑰(開發、staging、生產)。每個金鑰擁有獨立的使用量追蹤、消費上限和模型範圍限制 — 讓您輕鬆監控每個環境或用戶端的成本。若開發金鑰遭到入侵,您的生產金鑰不受影響。
如果我的 API 金鑰洩露了怎麼辦?
從儀表板立即撤銷 — 撤銷即時生效(60 秒內完成傳播)。產生新金鑰並更新您的應用程式。刪除舊金鑰前,請監控使用記錄中是否有任何可疑活動。
防範最佳實踐:
- 使用IP 白名單限制金鑰的使用來源
- 設定每月消費上限以限制金鑰洩露時的影響範圍
- 每 90 天輪換金鑰
- 絕不將金鑰提交至版本控制 — 使用環境變數或密鑰管理器
如何設定開發、staging 和生產環境?
從儀表板為每個環境建立獨立 API 金鑰:
- 開發 — 嚴格的消費上限(例如 $10),限制使用較便宜的模型,無 IP 限制(供本機開發使用)
- Staging — 適度上限(例如 $50),使用與生產相同的模型,IP 限制為您的 staging 伺服器
- 生產 — 依需求設定較高上限,可使用所有模型,IP 限制為您的生產伺服器
每個金鑰擁有獨立的使用量儀表板、警報和活動記錄。此設定讓您獲得各環境的成本可視性,並防止開發階段的錯誤耗盡生產預算。請參閱金鑰範圍限制獲取完整設定參考。
企業方案與支援
你們提供專屬支援、SLA 或自訂部署嗎?
是的。企業方案包含:
- 專屬客戶經理 — 所有問題的單一聯絡窗口
- 優先支援 — 保證回應時間(重大問題通常 2 小時內)
- 自訂 SLA — 根據您的需求量身打造的正常運作時間承諾與點數罰則
- 合併發票 — Net-30/60 付款條件、採購訂單、多幣種計費
- 自訂速率限制 — 根據您的工作負載調整 RPM/TPM 限制
- 部署協助 — 架構審查與針對您工作負載的整合建議
請聯絡 support@tokspan.com 提供您的需求 — 我們將在 1 個工作日內提出方案。
如何聯絡支援?有哪些管道可用?
我們提供多種支援管道:
- 電子郵件 — support@tokspan.com 處理計費、帳戶及技術問題。我們在 24 小時內回覆;大多數問題在單次往來中即可解決。
- 狀態頁面 — API 狀態提供即時事件更新。訂閱以在中斷期間接收通知。
企業客戶可獲得與我們工程團隊的共享 Slack 頻道,進行即時協作。