Ayuda y Soporte

FAQ

Preguntas frecuentes sobre TokSpan: primeros pasos, precios, uso de la API, privacidad de datos, facturación, seguridad y soporte empresarial.

General

¿Qué es TokSpan? ¿Cómo funciona?

TokSpan es un gateway unificado de API de IA que te brinda un único endpoint compatible con OpenAI para acceder a más de 200 modelos de más de 50 proveedores — incluyendo OpenAI, Anthropic, Google, Meta, DeepSeek y más.

Así funciona: tú envías solicitudes a la API de TokSpan en formato estándar de OpenAI. TokSpan enruta tu solicitud al proveedor upstream correspondiente, traduce el formato si es necesario, gestiona la respuesta y se la devuelve. Desde tu perspectiva, tú llamas a una sola API — TokSpan gestiona el enrutamiento de modelos, balanceo de carga, límites de tasa, failover automático y seguimiento de costos en segundo plano.

Solo necesitas una cuenta de TokSpan. Nosotros gestionamos todas las relaciones con los proveedores upstream en tu nombre — no se requieren cuentas separadas con OpenAI, Anthropic o Google.

¿Por qué usar TokSpan en lugar de ir directamente a OpenAI o Anthropic?
  • Una clave, todos los modelos — Acceda a GPT, Claude Opus, Gemini Pro y DeepSeek con una sola clave API. Sin gestionar múltiples cuentas de facturación en diferentes proveedores.
  • Sin dependencia de un proveedor — Cambia de modelo modificando un solo parámetro. Tu código permanece igual sin importar qué proveedor atienda la solicitud.
  • Failover automático — Si un proveedor falla, el tráfico se enruta automáticamente a un proveedor de respaldo que sirve el mismo modelo. Cero intervención manual.
  • Alcance global — Una red edge global que sirve a desarrolladores de todo el mundo.
  • Visibilidad de costos — Facturación unificada y seguimiento de uso en tiempo real de todos los modelos y proveedores en un solo panel.
¿Cómo empiezo? ¿Cómo hago mi primera llamada API?

Comenzar toma aproximadamente 5 minutos:

  1. Regístrate en api.tokspan.com/register
  2. Agrega créditos a tu cuenta mediante tarjeta de crédito/débito, Apple Pay / Google Pay o tu monedero digital local
  3. Crea una clave API desde la página Panel → API Keys
  4. Haz tu primera llamada — solo cambia base_url a https://api.tokspan.com/v1 y usa tu nueva clave

Si ya usas el SDK de OpenAI, está a 30 segundos. Consulta la guía de Inicio Rápido para ejemplos de código en Python, TypeScript y curl.

¿Hay una prueba gratuita o modelos gratuitos?

No ofrecemos un nivel gratuito permanente — por eso es realmente bueno para tú:

  • Sin degradación de calidad subsidiada — Los niveles gratuitos a escala requieren recortar en infraestructura, soporte o acceso a modelos. Nosotros invertimos todo en fiabilidad y cobertura de modelos.
  • Paga solo por lo que uses — Sin compromiso mínimo. Recargue tan poco como necesite. La mayoría de los desarrolladores gastan menos de $5 en tu primer mes de prueba.
  • Todos los modelos, sin restricciones — Tu saldo de pago le da acceso inmediato a todos los modelos de frontera en la plataforma — sin limitaciones de "solo nivel gratuito".

Las cuentas nuevas pueden recibir créditos promocionales de inicio ocasionalmente. Consulta el Panel después de registrarse.

¿Qué modelos están disponibles?

Brindamos acceso a más de 200 modelos en todas las categorías principales: LLMs (GPT, Claude Opus, Gemini Pro, DeepSeek, Llama, Mistral), Visión y Multimodal, Embeddings y Reranking, y Voz y Audio (TTS + STT).

Explore el catálogo completo en vivo con precios actuales por token en api.tokspan.com/pricing. Consulta la documentación de Modelos para resúmenes por categoría y comparaciones de capacidades.

Precios y Facturación

¿Cómo funcionan los precios?

Los precios de TokSpan son completamente transparentes. Tú pagas por los tokens que consumes, y el precio por token de cada modelo se muestra por adelantado.

El precio por token de cada modelo es visible en tiempo real en el Model Hub antes de hacer una llamada. El precio que ve es el precio que paga — sin costos ocultos, sin facturas sorpresa.

No hay suscripción mensual ni compromiso mínimo. Recargue cualquier monto y comienza a llamar modelos de inmediato.

¿Qué métodos de pago aceptan? ¿Hay comisiones?

Aceptamos tarjetas de crédito y débito (Visa, Mastercard, American Express) de forma segura a través de Stripe, además de Apple Pay y Google Pay. También admitimos monederos digitales locales (como Alipay y WeChat Pay) donde estén disponibles en tu región — los métodos exactos que aparecen al pagar dependen de tu ubicación.

Todos los pagos están denominados en USD. Tu saldo se actualiza inmediatamente después de que se confirme el pago.

¿Ofrecen reembolsos?

Sí, con la siguiente política:

  • Pagos con tarjeta y monedero digital — Los créditos no utilizados son elegibles para reembolso dentro de los 7 días posteriores a la compra. La tarifa de servicio de la plataforma (el margen que agregamos sobre las tarifas del proveedor) no es reembolsable por los tokens ya consumidos.

Para solicitar un reembolso, contacta a support@tokspan.com con el correo de tu cuenta y los detalles del pago.

¿Caducan los créditos?

Sí. Los créditos no utilizados expiran después de 12 meses de la compra. Esta política nos permite gestionar la responsabilidad del lado del proveedor manteniendo nuestra tarifa de servicio lo más baja posible. Recibirá recordatorios por correo electrónico 30 días y 7 días antes de que expire cualquier crédito. Las fechas de vencimiento son visibles en el Panel bajo Facturación → Créditos.

¿Cómo evito que se agote mi saldo a mitad de una solicitud?

TokSpan te notifica antes de que tu saldo se agote, para que puedas recargar a tiempo:

  1. Configura tu umbral de alerta de saldo bajo en Panel → Facturación
  2. Cuando tu saldo caiga por debajo de este umbral, recibirás una alerta por correo electrónico, y recomendamos habilitar la notificación webhook / en la aplicación para recibir alertas en tiempo real sobre eventos importantes
  3. Cuando alcances el umbral, simplemente recarga con tu tarjeta, Apple Pay / Google Pay o un monedero digital local en la página de Facturación

Para cargas de trabajo de producción ininterrumpidas, mantén tu saldo saludable y configura alertas para recibir notificación antes de que los fondos se agoten. No tienes que preocuparte por cargos sorpresa — cuando el saldo llega a cero, las solicitudes se detienen limpiamente con un claro error insufficient_user_quota, y puedes recargar cuando estés listo.

¿Cómo controlo los costos y establezco límites de gasto?

Tienes varios niveles de control de costos:

  • Límite de gasto por clave — Establece un límite de gasto estricto por clave API. Cuando la clave agota su cuota, las solicitudes se rechazan hasta que aumentes el límite o recargues.
  • Límites de tasa de la plataforma — Los límites de RPM (solicitudes por minuto) y TPM (tokens por minuto) se aplican a tu cuenta y grupo de plan; límites más altos disponibles bajo petición.
  • Lista blanca de modelos — Restringe una clave solo a modelos específicos (ej., solo permitas modelos económicos para claves de desarrollo).
  • Lista blanca de IP — Limita el uso de la clave a direcciones IP o rangos específicos.
  • Panel de uso en tiempo real — Monitorea el gasto por clave, modelo y período de tiempo en el Panel.

Los límites por clave (límite de gasto, acceso a modelos, lista blanca de IP) se configuran desde Panel → API Keys al crear o editar una clave. Consulta Alcance de Claves para más detalles.

¿Cómo se cuentan y facturan los tokens?

Los tokens se cuentan exactamente como los cuenta el proveedor upstream: tokens de prompt + tokens de completion = total de tokens facturables. Transmitimos el tokenizador de cada proveedor para que los conteos coincidan con lo que vería al llamar al proveedor directamente.

Para entradas multimodales (imágenes, audio, video): cada proveedor tiene tu propia fórmula para convertir medios a equivalentes de tokens. Transmitimos el cálculo del proveedor — tu panel muestra el conteo final de tokens y el costo. Generalmente: las imágenes en alta resolución son ~85–170 tokens cada una (GPT), el audio es ~50 tokens por segundo (voz a texto).

Para modelos con prompt caching (Claude, GPT), los tokens de prompt en caché se facturan a la tarifa de caché con descuento del proveedor. Tu panel de uso desglosa el gasto de tokens regulares vs. en caché.

Privacidad y Seguridad de Datos

¿TokSpan registra o almacena mis prompts y completions?

No — no almacenamos tus prompts ni completions. Tus datos pasan a través de nuestra infraestructura en tiempo real y no se persisten. Registramos solo metadatos de la solicitud (modelo, conteo de tokens, marca de tiempo, ID de clave API) para precisión de facturación y prevención de abusos. Esto es necesario para calcular tu uso y proteger la plataforma.

Nunca usamos tus prompts o completions para entrenamiento de modelos, y nunca vendemos ni compartimos tus datos con terceros.

¿Los proveedores entrenan con mis datos? ¿Cómo lo evito?

Esto depende del proveedor y tu configuración:

  • OpenAINo entrena con llamadas API (desde marzo de 2023). Los datos enviados a través de la API no se usan para entrenamiento de modelos por defecto.
  • AnthropicNo entrena con datos de API. Los datos de la API de Claude no se usan para mejorar modelos a menos que tú lo aceptes explícitamente.
  • Google (Gemini)No entrena con uso de API de pago. El uso del nivel gratuito puede estar sujeto a términos diferentes.
  • Otros proveedores — Las políticas varían. Consulta los términos de cada proveedor. Recomendamos revisar la política de uso de datos del proveedor si esto es una preocupación.

Si esto es una prioridad, nuestro equipo puede ayudarte a elegir proveedores con políticas claras de no entrenamiento para tus cargas de trabajo — contacta a support@tokspan.com.

¿Cómo están protegidas mis claves API?

Todas las claves API están cifradas en reposo (AES-256). Puedes volver a ver tus claves en cualquier momento en el Panel — si una clave se pierde o se sospecha que fue comprometida, revócala y genera una nueva. Todo el tráfico API se cifra con TLS 1.3 en tránsito. Recomendamos usar claves API con lista blanca de IP, alcance por modelo y límites de gasto mensual para una defensa en profundidad. Rote las claves cada 90 días como práctica recomendada de seguridad.

¿Qué certificaciones de seguridad y estándares de cumplimiento tienen?

La seguridad es fundamental para TokSpan. Nuestra infraestructura está construida alrededor de estos controles:

  • TLS 1.3 — todos los datos en tránsito están cifrados de extremo a extremo.
  • AES-256 — las claves API y credenciales están cifradas en reposo.
  • MFA — autenticación multifactor compatible en todas las cuentas.
  • Prácticas alineadas con GDPR — minimización de datos y divulgaciones de privacidad descritas en nuestra Política de Privacidad.

Los clientes empresariales pueden solicitar detalles adicionales sobre nuestra postura de seguridad en support@tokspan.com.

¿TokSpan cumple con GDPR / CCPA?

Sí. Nuestro servicio alojado implementa los requisitos de GDPR y CCPA: minimización de datos (no almacenamos tus prompts/completions), limitación de finalidad (los metadatos solo se usan para facturación y prevención de abusos), eliminación de datos del usuario a solicitud y divulgaciones transparentes sobre el procesamiento de datos.

Para requisitos estrictos de residencia de datos o cumplimiento, contacta a nuestro equipo: podemos proporcionar un DPA (Acuerdo de Procesamiento de Datos) y analizar tus necesidades. Escríbenos a support@tokspan.com.

¿Cómo elimino mi cuenta? ¿Qué pasa con mi saldo?

Puedes eliminar tu cuenta y todos los datos asociados desde Panel → Configuración → Cuenta → Eliminar cuenta. La eliminación de la cuenta es permanente e irreversible.

Con respecto a tu saldo:

  • Cualquier crédito restante al momento de la eliminación se pierde. Recomendamos usar tu saldo o solicitar un reembolso antes de iniciar la eliminación.
  • Los registros de facturación requeridos por ley (recibos de pago, facturas) se conservan durante el período legal establecido, generalmente 7 años.
  • Todos los demás datos de la cuenta (claves API, registros de uso, correo electrónico, configuración) se eliminan permanentemente en un plazo de 30 días.
¿Puedo firmar un DPA (Acuerdo de Procesamiento de Datos)?

Sí. Los DPA están disponibles para cuentas empresariales y de equipo. Proporcionamos un DPA estándar que cubre las obligaciones del procesador de datos según GDPR, divulgación de subprocesadores, salvaguardas para transferencias transfronterizas (SCC) y compromisos de notificación de brechas de seguridad. Contacta a support@tokspan.com con los requisitos de tu equipo legal; el tiempo de respuesta habitual es de 2 a 3 días hábiles.

API y Funciones

¿Es la API totalmente compatible con el SDK de OpenAI? ¿Qué funciones son compatibles?

Sí, 100%. Cambia base_url a https://api.tokspan.com/v1 y tu código existente del SDK de OpenAI funciona de inmediato: Python, Node.js, Go, curl o cualquier biblioteca compatible con OpenAI.

Funciones compatibles:

  • Chat Completions — Soporte completo, incluyendo mensajes de sistema/usuario/asistente
  • Streaming — SSE (Server-Sent Events) con stream: true
  • Function / Tool Calling — Llamadas a herramientas en paralelo, modo estricto
  • Modo JSON — Salida estructurada con response_format
  • Visión / Entrada de imágenes — Imágenes por URL y base64
  • Embeddings — Soporte completo en múltiples proveedores
  • Audio — TTS (texto a voz) y STT (voz a texto)
  • Imágenes — Generación mediante los principales modelos de imagen
  • Rerank — Soporte completo
  • Esfuerzo de razonamiento — Controle la profundidad de razonamiento mediante el parámetro reasoning_effort en los modelos compatibles
¿Cómo controlo el esfuerzo de razonamiento para modelos como GPT o DeepSeek?

Algunos modelos de razonamiento aceptan el parámetro estándar reasoning_effort para controlar la profundidad de razonamiento. TokSpan reenvía este parámetro al proveedor upstream — el soporte depende del propio modelo:

ValorEfectoIdeal para
lowRazonamiento rápido y mínimo — menor costoConsultas simples, clasificación
mediumRazonamiento equilibrado (predeterminado en la mayoría de los modelos)Conversación general
highProfundidad de razonamiento máxima — mejor calidad, más lento, mayor costoRazonamiento complejo, generación de código

Inclúyelo en el cuerpo de tu solicitud — p. ej. "reasoning_effort": "high". Si un modelo no acepta el parámetro, omítelo y se usará el valor predeterminado del modelo. Consulta el catálogo de modelos para conocer el soporte por modelo.

¿Cómo cambio entre diferentes modelos?

Cambiar de modelo es un cambio de una sola línea — solo tienes que configurar el campo model en tu solicitud con cualquier ID de modelo del catálogo:

  • Compatible con OpenAI: model: "MODEL_NAME" en el cuerpo de la solicitud
  • Nativo Anthropic: model: "MODEL_NAME" en el cuerpo de la solicitud
  • Compatible con Gemini: model="MODEL_NAME" en generateContent

Tu código sigue igual — solo cambia el nombre del modelo, y todos los formatos comparten la misma clave API y saldo. Explora el catálogo completo con precios en vivo en api.tokspan.com/pricing.

¿TokSpan admite prompt caching? ¿Cuánto puedo ahorrar?

Sí. El almacenamiento en caché de prompts se aplica automáticamente cuando el proveedor upstream lo admite (Claude, GPT, Gemini). Cuando envía el mismo prefijo de prompt en múltiples solicitudes, el proveedor almacena en caché el cálculo y le cobra una tarifa con descuento por la parte almacenada, generalmente 90% de descuento sobre el precio completo del token de prompt.

No necesita modificar tu código. TokSpan transmite el estado de caché del proveedor, y tu panel muestra el uso de tokens en caché frente a los no almacenados. Para maximizar los aciertos de caché:

  • Coloca el contenido estático (prompts de sistema, documentos de contexto) al inicio de tu prompt
  • Coloca el contenido dinámico (mensajes de usuario, consultas recientes) al final
  • Reutilice el mismo prompt de sistema en todas las solicitudes

Lea la guía completa de optimización: Prompt Caching.

¿Cómo debo manejar los errores de API?

TokSpan devuelve códigos de estado HTTP estándar:

CódigoSignificadoAcción
400Solicitud incorrecta: carga útil mal formada o parámetro inválidoRevisa el cuerpo de tu solicitud comparándolo con la referencia de la API
401Clave API inválida o faltanteVerifica tu encabezado Authorization; comprueba que la clave no haya sido revocada
503Modelo no encontrado, o sobrecarga temporalVerifica el nombre del modelo en el catálogo (distingue mayúsculas); ante sobrecarga, reintenta con backoff
429Límite de tasa excedido, o saldo/cuota insuficientePara límites de tasa, implementa backoff exponencial con jitter. Si el error menciona cuota o saldo (p. ej. insufficient_user_quota), recarga tu saldo en lugar de reintentar
5xxError del proveedor upstream o tiempo de espera agotadoReintenta con backoff; si persiste, el failover automático debe enrutar a un proveedor de respaldo que sirve el mismo modelo

Recomendamos implementar backoff exponencial con jitter para errores 429 y 5xx. Consulta Códigos de error para la referencia completa con los cuerpos de respuesta de error.

Fiabilidad y Rendimiento

¿Cuál es tu tiempo de actividad y SLA?

Apuntamos a un 99.99% de tiempo de actividad para nuestra API alojada. Nuestra infraestructura está escalada horizontalmente en múltiples zonas de disponibilidad, sin punto único de fallo.

Los planes empresariales incluyen un SLA formal con compromisos de tiempo de actividad, penalizaciones por crédito y respuesta prioritaria a incidentes. Contacta a support@tokspan.com para conocer los términos del SLA.

¿Qué sucede cuando un proveedor upstream se cae?

TokSpan realiza failover automáticamente al siguiente modelo saludable. Nuestro sistema:

  1. Detecta la indisponibilidad del proveedor (errores 5xx, tiempos de espera) en segundos
  2. Omite proveedores con interrupciones recientes (ventana de espera temporal)
  3. Enruta al siguiente proveedor en la cadena de failover (administrada automáticamente por TokSpan)

La cadena se construye entre proveedores que sirven el mismo modelo (por ejemplo, varios proveedores de la serie GPT), lo que garantiza cero solicitudes perdidas. Solo paga por el proveedor que finalmente atiende la solicitud; los intentos fallidos no se facturan. Consulta Failover Automático para saber cómo funciona.

¿Qué latencia debo esperar en comparación con las llamadas directas al proveedor?

TokSpan agrega una sobrecarga de enrutamiento mínima, generalmente menos de 100 ms para solicitudes API. El factor de latencia dominante es la velocidad de generación del modelo upstream (tiempo hasta el primer token y tokens por segundo), que no se ve afectada por el enrutamiento a través de TokSpan.

Para aplicaciones sensibles a la latencia:

  • Activa streaming (stream: true) para que los usuarios vean los tokens a medida que se generan
  • Elige un modelo más rápido o ligero para uso interactivo — consulta el catálogo de modelos para perfiles de latencia
  • Enruta a través de la red edge global de TokSpan: las solicitudes se atienden desde la región más cercana a tus usuarios
¿Tienen una página de estado pública?

Sí. Consulta la Página de estado de la API para conocer el estado del servicio en tiempo real, el historial de incidentes y las ventanas de mantenimiento programadas. Suscríbase a notificaciones de incidentes por correo electrónico, webhook, Bark o Gotify; consulte Webhooks para la configuración.

Cuenta y Claves API

¿Cómo creo y administro claves API?

Inicia sesión en el Panel, ve a Claves API y haz clic en + Nueva clave. Asigna a cada clave un nombre descriptivo (por ejemplo, "producción-backend", "app-movil-dev", "staging-pruebas"). Puedes crear claves ilimitadas.

Recomendamos encarecidamente crear claves separadas para cada entorno (desarrollo, staging, producción). Cada clave tiene seguimiento de uso, límites de gasto y alcance por modelo independientes, lo que facilita el monitoreo de costos por entorno o por cliente. Si una clave de desarrollo se ve comprometida, tu clave de producción no se ve afectada.

¿Qué pasa si mi clave API se ve comprometida?

Revóquela de inmediato desde el Panel: la revocación surte efecto al instante (propagación en menos de 60 segundos). Genera una nueva clave y actualiza tu aplicación. Monitoree los registros de uso para detectar cualquier actividad sospechosa en la clave anterior antes de eliminarla.

Prácticas recomendadas de prevención:

  • Usa lista blanca de IP para restringir desde dónde se pueden usar las claves
  • Establece límites de gasto mensual para limitar el radio de afectación si una clave se filtra
  • Rote las claves cada 90 días
  • Nunca incluyas claves en el control de versiones: usa variables de entorno o un gestor de secretos
¿Cómo configuro entornos de desarrollo, staging y producción?

Crea una clave API separada para cada entorno desde el Panel:

  • Desarrollo — Límite de gasto bajo (p. ej. $10), restringido a modelos económicos, sin restricción de IP (para desarrollo local)
  • Staging — Límite moderado (p. ej. $50), mismos modelos que producción, restringido por IP a tus servidores de staging
  • Producción — Límite más alto según necesidad, todos los modelos, restringido por IP a tus servidores de producción

Cada clave tiene su propio panel de uso, alertas y registro de actividad. Esta configuración te brinda visibilidad de costos por entorno y evita que un error en fase de desarrollo consuma tu presupuesto de producción. Consulta Alcance de claves para la referencia completa de configuración.

Empresa y Soporte

¿Ofrecen soporte dedicado, SLA o implementaciones personalizadas?

Sí. Los planes empresariales incluyen:

  • Gerente de cuenta dedicado — Punto de contacto único para todas las consultas
  • Soporte prioritario — Tiempos de respuesta garantizados (generalmente menos de 2 horas para problemas críticos)
  • SLA personalizado — Compromisos de tiempo de actividad con penalizaciones por crédito adaptados a tus necesidades
  • Facturación consolidada — Términos Net-30/60, órdenes de compra, facturación multidivisa
  • Límites de tasa personalizados — Límites de RPM/TPM ajustados a tu carga de trabajo
  • Asistencia en implementación — Revisión de arquitectura y orientación de integración para tus cargas de trabajo

Contacta a support@tokspan.com con tus requisitos; prepararemos una propuesta en un plazo de 1 día hábil.

¿Cómo contacto al soporte? ¿Qué canales están disponibles?

Ofrecemos múltiples canales de soporte:

  • Correo electrónicosupport@tokspan.com para consultas de facturación, cuenta y temas técnicos. Respondemos en un plazo de 24 horas; la mayoría de las consultas se resuelven en un solo intercambio.
  • Página de estadoEstado de la API para actualizaciones de incidentes en tiempo real. Suscríbase para recibir notificaciones durante interrupciones.

Los clientes empresariales reciben un canal de Slack compartido con nuestro equipo de ingeniería para colaboración en tiempo real.