Помощь и поддержка
FAQ
Часто задаваемые вопросы о TokSpan: начало работы, цены, использование API, конфиденциальность данных, оплата, безопасность и корпоративную поддержку.
Общее
Что такое TokSpan? Как это работает?
TokSpan — это универсальный AI API-шлюз, который предоставляет единую конечную точку, совместимую с OpenAI, для доступа к 200+ моделям от 50+ провайдеров — включая OpenAI, Anthropic, Google, Meta, DeepSeek и другие.
Вот как это работает: вы отправляете запросы к API TokSpan в стандартном формате OpenAI. TokSpan маршрутизирует ваш запрос к соответствующему upstream-провайдеру, при необходимости преобразует формат, обрабатывает ответ и возвращает его вам. С вашей точки зрения вы обращаетесь к одному API — TokSpan управляет маршрутизацией моделей, балансировкой нагрузки, лимитом запросов, автоматическим переключением и отслеживанием затрат за кулисами.
Вам нужен только аккаунт TokSpan. Мы управляем всеми отношениями с upstream-провайдерами от вашего имени — отдельные аккаунты у OpenAI, Anthropic или Google не требуются.
Зачем использовать TokSpan вместо прямого обращения к OpenAI или Anthropic?
- Один ключ — все модели — Доступ к GPT, Claude Opus, Gemini Pro и DeepSeek с одним API-ключом. Никакого управления множеством биллинговых аккаунтов у разных провайдеров.
- Никакой привязки к вендору — Переключайте модели изменением одного параметра. Ваш код остаётся неизменным независимо от того, какой провайдер обслуживает запрос.
- Автоматическое переключение — Если провайдер недоступен, трафик автоматически направляется на резервного провайдера, обслуживающего ту же модель. Ноль ручного вмешательства.
- Глобальный охват — Глобальная пограничная сеть, обслуживающая разработчиков по всему миру.
- Прозрачность затрат — Единый биллинг и отслеживание использования в реальном времени по всем моделям и провайдерам в одной панели управления.
Как начать работу? Как сделать первый API-вызов?
Начало работы занимает около 5 минут:
- Зарегистрируйтесь на api.tokspan.com/register
- Пополните баланс с помощью кредитной/дебетовой карты, Apple Pay / Google Pay или локального электронного кошелька
- Создайте API-ключ на странице Панель управления → API-ключи
- Сделайте первый вызов — просто измените
base_urlнаhttps://api.tokspan.com/v1и используйте ваш новый ключ
Если вы уже используете OpenAI SDK, вы в 30 секундах от начала. См. руководство Quickstart для примеров кода на Python, TypeScript и curl.
Есть ли бесплатная пробная версия или бесплатные модели?
Мы не предлагаем постоянный бесплатный тариф — вот почему это на самом деле хорошо для вас:
- Никакого субсидируемого ухудшения качества — Бесплатные тарифы в масштабе требуют экономии на инфраструктуре, поддержке или доступе к моделям. Мы инвестируем всё в надёжность и покрытие моделей.
- Платите только за то, что используете — Никаких минимальных обязательств. Пополняйте на любую сумму. Большинство разработчиков тратят менее $5 в первый месяц тестирования.
- Все модели, без ограничений — Ваш оплаченный баланс даёт немедленный доступ к каждой передовой модели на платформе — никаких ограничений «только для бесплатного тарифа».
Новые аккаунты могут время от времени получать промо-кредиты. Проверьте Панель управления после регистрации.
Какие модели доступны?
Мы предоставляем доступ к 200+ моделям по всем основным категориям: LLM (GPT, Claude Opus, Gemini Pro, DeepSeek, Llama, Mistral), Vision и мультимодальные, Embeddings и реранкинг, а также Speech и Audio (TTS + STT).
Ознакомьтесь с полным актуальным каталогом с текущими ценами за токен на api.tokspan.com/pricing. См. документацию по моделям для обзора категорий и сравнения возможностей.
Цены и оплата
Как работает ценообразование?
Цены TokSpan полностью прозрачны. Вы платите за потреблённые токены, и цена каждого токена каждой модели показана заранее.
Цена каждого токена модели видна в реальном времени в Model Hub до совершения вызова. Цена, которую вы видите — это цена, которую вы платите: никаких скрытых затрат, никаких неожиданных счетов.
Никакой ежемесячной подписки и минимальных обязательств. Пополните на любую сумму и сразу начинайте вызывать модели.
Какие способы оплаты вы принимаете? Есть ли комиссии?
Мы принимаем кредитные и дебетовые карты (Visa, Mastercard, American Express) безопасно через Stripe, а также Apple Pay и Google Pay. Мы также поддерживаем локальные электронные кошельки (например, Alipay и WeChat Pay) там, где они доступны в вашем регионе — точные способы оплаты, отображаемые при оформлении, зависят от вашего местоположения.
Все платежи номинированы в USD. Ваш баланс обновляется немедленно после подтверждения платежа.
Предоставляете ли вы возврат средств?
Да, со следующей политикой:
- Карты и электронные кошельки — Неиспользованные кредиты подлежат возврату в течение 7 дней с момента покупки. Платформенная сервисная комиссия (наценка сверх тарифов провайдера) не возвращается за уже потреблённые токены.
Чтобы запросить возврат, свяжитесь с support@tokspan.com, указав email аккаунта и детали платежа.
Истекает ли срок действия кредитов?
Да. Неиспользованные кредиты истекают через 12 месяцев после покупки. Эта политика позволяет нам управлять обязательствами перед провайдерами, сохраняя нашу сервисную комиссию как можно ниже. Вы получите email-уведомления за 30 дней и за 7 дней до истечения срока действия кредитов. Даты истечения видны в панели управления в разделе Биллинг → Кредиты.
Как избежать исчерпания баланса в середине запроса?
TokSpan предупреждает вас до исчерпания баланса, чтобы вы успели пополнить его:
- Установите порог уведомления о низком балансе в Панель управления → Биллинг
- Когда баланс опустится ниже порога, вы получите email-уведомление; также рекомендуем включить webhook / уведомления в приложении для оповещений в реальном времени о важных событиях
- При достижении порога просто пополните баланс картой, Apple Pay / Google Pay или локальным электронным кошельком на странице Биллинг
Для бесперебойных продакшен-нагрузок поддерживайте здоровый баланс и настраивайте оповещения, чтобы получать уведомления до исчерпания средств. Вам не нужно беспокоиться о неожиданных списаниях — при нулевом балансе запросы аккуратно останавливаются с понятной ошибкой insufficient_user_quota, а пополнить баланс можно в любой момент.
Как контролировать расходы и устанавливать лимиты?
У вас есть несколько уровней контроля расходов:
- Лимит расходов на ключ — Установите жёсткий лимит расходов на каждый API-ключ. Когда квота ключа исчерпана, запросы отклоняются, пока вы не повысите лимит или не пополните баланс.
- Лимиты платформы — лимиты RPM (запросов в минуту) и TPM (токенов в минуту) применяются к аккаунту и группе тарифа; более высокие лимиты доступны по запросу.
- Белый список моделей — Ограничьте ключ только определёнными моделями (например, разрешите только дешёвые модели для ключей разработки).
- Белый список IP — Ограничьте использование ключа конкретными IP-адресами или диапазонами.
- Панель использования в реальном времени — Отслеживайте расходы по ключам, моделям и периодам в панели управления.
Лимиты ключа (расходы, доступ к моделям, IP-белый список) настраиваются в Панель управления → API-ключи при создании или редактировании ключа. См. Key Scoping для подробностей.
Как подсчитываются и оплачиваются токены?
Токены подсчитываются точно так же, как их считает upstream-провайдер: токены промпта + токены завершения = общее количество оплачиваемых токенов. Мы используем токенизатор каждого провайдера, поэтому подсчёт совпадает с тем, что вы увидели бы при прямом обращении к провайдеру.
Для мультимодальных входных данных (изображения, аудио, видео): каждый провайдер имеет собственную формулу преобразования медиа в токен-эквиваленты. Мы используем расчёт провайдера — ваша панель управления показывает итоговое количество токенов и стоимость. Как правило: изображения высокого разрешения — ~85–170 токенов каждое (GPT), аудио — ~50 токенов в секунду (распознавание речи).
Для моделей с кэшированием промптов (Claude, GPT) кэшированные токены промпта оплачиваются по сниженному тарифу кэша провайдера. Ваша панель использования разделяет расходы на обычные и кэшированные токены.
Конфиденциальность и безопасность данных
TokSpan регистрирует или хранит мои промпты и ответы?
Нет — мы не храним ваши промпты или ответы. Ваши данные проходят через нашу инфраструктуру в реальном времени и не сохраняются. Мы регистрируем только метаданные запроса (модель, количество токенов, временная метка, ID API-ключа) для точности биллинга и предотвращения злоупотреблений. Это необходимо для расчёта вашего использования и защиты платформы.
Мы никогда не используем ваши промпты или ответы для обучения моделей и никогда не продаём и не передаём ваши данные третьим лицам.
Обучаются ли провайдеры на моих данных? Как это предотвратить?
Это зависит от провайдера и ваших настроек:
- OpenAI — Не обучается на вызовах API (с марта 2023 г.). Данные, отправленные через API, по умолчанию не используются для обучения моделей.
- Anthropic — Не обучается на данных API. Данные Claude API не используются для улучшения моделей, если вы явно не дали согласие.
- Google (Gemini) — Не обучается на платном использовании API. Использование в рамках бесплатного тарифа может регулироваться другими условиями.
- Другие провайдеры — Политики различаются. Проверяйте условия каждого провайдера. Мы рекомендуем ознакомиться с политикой использования данных провайдера, если это вызывает опасения.
Если это для вас приоритет, наша команда поможет выбрать провайдеров с чёткой политикой отказа от обучения для ваших нагрузок — свяжитесь с support@tokspan.com.
Как защищены мои API-ключи?
Все API-ключи зашифрованы при хранении (AES-256). Ключи можно просмотреть повторно в панели управления в любое время — если ключ утерян или есть подозрение на утечку, отзовите его и создайте новый. Весь API-трафик шифруется с помощью TLS 1.3 при передаче. Мы рекомендуем использовать API-ключи с IP-whitelisting, ограничением по моделям и месячными лимитами расходов для эшелонированной защиты. Ротируйте ключи каждые 90 дней в соответствии с лучшими практиками безопасности.
Какие у вас есть сертификации безопасности и стандарты соответствия?
Безопасность — основа TokSpan. Наша инфраструктура построена вокруг следующих мер контроля:
- TLS 1.3 — все передаваемые данные зашифрованы сквозным шифрованием.
- AES-256 — API-ключи и учётные данные зашифрованы при хранении.
- MFA — многофакторная аутентификация поддерживается на всех аккаунтах.
- Практики, соответствующие GDPR — минимизация данных и раскрытие информации о конфиденциальности описаны в нашей Политике конфиденциальности.
Корпоративные клиенты могут запросить дополнительные сведения о нашей безопасности по адресу support@tokspan.com.
Соответствует ли TokSpan требованиям GDPR / CCPA?
Да. Наш хостинговый сервис реализует требования GDPR и CCPA: минимизация данных (мы не храним ваши промпты и ответы), ограничение целей (метаданные используются только для биллинга и предотвращения злоупотреблений), удаление пользовательских данных по запросу и прозрачное раскрытие информации об обработке данных.
При строгих требованиях к локализации данных или соблюдению нормативных требований свяжитесь с нашей командой — мы можем предоставить DPA (Соглашение об обработке данных) и обсудить ваши потребности. Напишите на support@tokspan.com.
Как удалить аккаунт? Что произойдёт с моим балансом?
Вы можете удалить аккаунт и все связанные данные через Dashboard → Settings → Account → Delete Account. Удаление аккаунта является окончательным и необратимым.
Относительно вашего баланса:
- Любые оставшиеся кредиты на момент удаления аннулируются. Мы рекомендуем использовать баланс или запросить возврат средств до начала удаления.
- Платёжные записи, требуемые по закону (квитанции об оплате, счета-фактуры), хранятся в течение установленного законом срока — обычно 7 лет.
- Все остальные данные аккаунта (API-ключи, логи использования, email, настройки) безвозвратно удаляются в течение 30 дней.
Могу ли я подписать DPA (Соглашение об обработке данных)?
Да. DPA доступны для корпоративных и командных аккаунтов. Мы предоставляем стандартное DPA, которое охватывает обязательства обработчика данных по GDPR, раскрытие информации о субподрядчиках, гарантии трансграничной передачи данных (SCC) и обязательства по уведомлению об утечках. Свяжитесь с support@tokspan.com, указав требования вашей юридической команды — стандартный срок рассмотрения составляет 2–3 рабочих дня.
API и функции
Полностью ли API совместим с OpenAI SDK? Какие функции поддерживаются?
Да, на 100%. Измените base_url на https://api.tokspan.com/v1, и ваш существующий код с OpenAI SDK заработает мгновенно — Python, Node.js, Go, curl или любая библиотека, совместимая с OpenAI.
Поддерживаемые функции:
- Chat Completions — Полная поддержка, включая системные, пользовательские и ассистентские сообщения
- Streaming — SSE (Server-Sent Events) с
stream: true - Function / Tool Calling — Параллельные вызовы инструментов, строгий режим
- JSON Mode — Структурированный вывод с
response_format - Vision / Image Input — Изображения по URL и в base64
- Embeddings — Полная поддержка от множества провайдеров
- Audio — TTS (text-to-speech) и STT (speech-to-text)
- Images — Генерация через ведущие модели изображений
- Rerank — Полная поддержка
- Reasoning Effort — Управление глубиной рассуждения через параметр
reasoning_effortна поддерживаемых моделях
Как управлять глубиной рассуждения для моделей GPT или DeepSeek?
Некоторые модели рассуждения принимают стандартный параметр reasoning_effort для управления глубиной рассуждения. TokSpan передаёт этот параметр upstream-провайдеру — поддержка зависит от самой модели:
| Значение | Эффект | Лучше всего для |
|---|---|---|
low | Быстрое, минимальное рассуждение — самая низкая стоимость | Простые запросы, классификация |
medium | Сбалансированное рассуждение (по умолчанию для большинства моделей) | Обычные разговоры |
high | Максимальная глубина рассуждения — наилучшее качество, медленнее, выше стоимость | Сложные рассуждения, генерация кода |
Просто включите его в тело запроса — например, "reasoning_effort": "high". Если модель не принимает параметр, опустите его — будет использовано значение модели по умолчанию. Поддержку по каждой модели см. в каталоге моделей.
Как переключаться между разными моделями?
Смена модели — это изменение одной строки: просто задайте поле model в запросе, указав любой ID модели из каталога:
- OpenAI-совместимый формат:
model: "MODEL_NAME"в теле запроса - Нативный формат Anthropic:
model: "MODEL_NAME"в теле запроса - Gemini-совместимый формат:
model="MODEL_NAME"вgenerateContent
Ваш код остаётся прежним — меняется только название модели, а все форматы используют один и тот же API-ключ и баланс. Полный каталог с актуальными ценами — на api.tokspan.com/pricing.
Поддерживает ли TokSpan prompt caching? Сколько можно сэкономить?
Да. Prompt caching применяется автоматически, когда upstream-провайдер поддерживает эту функцию (Claude, GPT, Gemini). Когда вы отправляете одинаковый префикс промпта в нескольких запросах, провайдер кеширует вычисления и взимает плату по сниженному тарифу за кешированную часть — обычно скидка 90% от полной стоимости токенов промпта.
Вам не нужно менять код. TokSpan передаёт статус кеша от провайдера, и ваша панель управления показывает использование кешированных и некешированных токенов. Для максимального попадания в кеш:
- Размещайте статический контент (системные промпты, контекстные документы) в начале промпта
- Размещайте динамический контент (сообщения пользователя, последние запросы) в конце
- Используйте один и тот же системный промпт в разных запросах
Прочитайте полное руководство по оптимизации: Prompt Caching.
Как обрабатывать ошибки API?
TokSpan возвращает стандартные коды состояния HTTP:
| Код | Значение | Действие |
|---|---|---|
400 | Некорректный запрос — неверный формат данных или недействительный параметр | Проверьте тело запроса по справочнику API |
401 | Недействительный или отсутствующий API-ключ | Проверьте заголовок Authorization; убедитесь, что ключ не был отозван |
503 | Модель не найдена или временная перегрузка | Проверьте название модели в каталоге (регистр важен); при перегрузке повторите с задержкой |
429 | Превышен лимит запросов или недостаточно баланса/квоты | Для лимитов запросов реализуйте экспоненциальную задержку с jitter. Если ошибка упоминает квоту или баланс (например, insufficient_user_quota), пополните баланс вместо повторов |
5xx | Ошибка или тайм-аут upstream-провайдера | Повторите с задержкой; при постоянных сбоях автоматическое переключение должно направить запрос к резервному провайдеру, обслуживающему ту же модель |
Мы рекомендуем реализовать экспоненциальную задержку с jitter для ошибок 429 и 5xx. Полный справочник с телами ответов см. в разделе Error Codes.
Надёжность и производительность
Какое у вас время безотказной работы и SLA?
Мы стремимся к доступности 99,99% для нашего хостингового API. Наша инфраструктура горизонтально масштабируется в нескольких зонах доступности без единой точки отказа.
Корпоративные тарифы включают формальное SLA с обязательствами по доступности, штрафными санкциями и приоритетным реагированием на инциденты. Свяжитесь с support@tokspan.com для получения условий SLA.
Что происходит при сбое upstream-провайдера?
TokSpan автоматически переключается на следующую работоспособную модель. Наша система:
- Обнаруживает недоступность провайдера (ошибки 5xx, тайм-ауты) в течение секунд
- Пропускает провайдеров с недавними сбоями (временное окно ожидания)
- Направляет запрос к следующему провайдеру в цепочке переключения (автоматически управляется TokSpan)
Цепочка строится между провайдерами, обслуживающими одну и ту же модель (например, несколько провайдеров серии GPT), что обеспечивает ноль потерянных запросов. Вы платите только за провайдера, который в конечном итоге обслуживает запрос — неудачные попытки не тарифицируются. Подробнее о том, как это работает, см. в разделе Auto Failover.
Какую задержку ожидать по сравнению с прямыми вызовами провайдера?
TokSpan добавляет минимальные накладные расходы на маршрутизацию — обычно менее 100 мс для API-запросов. Основным фактором задержки является скорость генерации upstream-модели (время до первого токена и токенов в секунду), на которую маршрутизация через TokSpan не влияет.
Для приложений, чувствительных к задержке:
- Включите потоковую передачу (
stream: true), чтобы пользователи видели токены по мере генерации - Выбирайте более быструю или лёгкую модель для интерактивного использования — профили задержки см. в каталоге моделей
- Маршрутизируйте через глобальную edge-сеть TokSpan — запросы обслуживаются из региона, ближайшего к вашим пользователям
У вас есть публичная страница статуса?
Да. Проверьте страницу статуса API для отслеживания работоспособности сервиса в реальном времени, истории инцидентов и запланированных окон технического обслуживания. Подпишитесь на уведомления об инцидентах по email, Webhook, Bark или Gotify — настройка описана в разделе Webhooks.
Аккаунт и API-ключи
Как создавать и управлять API-ключами?
Войдите в панель управления, перейдите в раздел API Keys и нажмите + New Key. Дайте каждому ключу описательное имя (например, "production-backend", "mobile-app-dev", "staging-test"). Вы можете создавать неограниченное количество ключей.
Мы настоятельно рекомендуем создавать отдельные ключи для каждого окружения (development, staging, продакшен). Каждый ключ имеет независимый учёт использования, лимиты расходов и ограничение по моделям — что позволяет легко отслеживать затраты для каждого окружения или клиента. Если ключ разработки будет скомпрометирован, ваш продакшен-ключ останется незатронутым.
Что делать, если мой API-ключ скомпрометирован?
Немедленно отзовите его в панели управления — отзыв вступает в силу мгновенно (в течение 60 секунд). Создайте новый ключ и обновите приложение. Проверьте журналы использования на предмет подозрительной активности по старому ключу перед его удалением.
Лучшие практики предотвращения:
- Используйте IP-whitelisting для ограничения источников использования ключей
- Установите месячные лимиты расходов, чтобы ограничить ущерб в случае утечки ключа
- Ротируйте ключи каждые 90 дней
- Никогда не коммитьте ключи в систему контроля версий — используйте переменные окружения или менеджер секретов
Как настроить окружения разработки, staging и продакшен?
Создайте отдельный API-ключ для каждого окружения в панели управления:
- Development — Жёсткий лимит расходов (например, $10), ограничение на более дешёвые модели, без IP-ограничений (для локальной разработки)
- Staging — Умеренный лимит (например, $50), те же модели, что и в продакшене, IP-ограничение на серверы staging
- Production — Более высокий лимит по необходимости, все модели, IP-ограничение на серверы продакшена
Каждый ключ имеет собственную панель использования, оповещения и журнал активности. Такая настройка даёт вам прозрачность затрат по окружениям и предотвращает ситуацию, когда ошибка на этапе разработки расходует ваш продакшен-бюджет. Полный справочник по настройке см. в разделе Key Scoping.
Enterprise и поддержка
Предоставляете ли вы выделенную поддержку, SLA или индивидуальные развёртывания?
Да. Корпоративные тарифы включают:
- Выделенного менеджера по работе с клиентами — Единое контактное лицо для всех вопросов
- Приоритетную поддержку — Гарантированное время ответа (обычно до 2 часов для критических проблем)
- Индивидуальное SLA — Обязательства по доступности со штрафными санкциями, адаптированные под ваши нужды
- Консолидированное выставление счетов — Условия Net-30/60, заказы на покупку, мультивалютный биллинг
- Индивидуальные лимиты запросов — Лимиты RPM/TPM, масштабируемые под вашу нагрузку
- Помощь в развёртывании — Обзор архитектуры и рекомендации по интеграции для ваших нагрузок
Свяжитесь с support@tokspan.com, указав ваши требования — мы подготовим предложение в течение 1 рабочего дня.
Как связаться со службой поддержки? Какие каналы доступны?
Мы предлагаем несколько каналов поддержки:
- Email — support@tokspan.com для вопросов по биллингу, аккаунту и технических вопросов. Мы отвечаем в течение 24 часов; большинство вопросов решается в рамках одного обращения.
- Страница статуса — API Status для обновлений об инцидентах в реальном времени. Подпишитесь на уведомления во время сбоев.
Корпоративные клиенты получают выделенный Slack-канал с нашей инженерной командой для взаимодействия в реальном времени.