Funciones Avanzadas

Enrutamiento Personalizado

TokSpan enruta automáticamente cada solicitud al proveedor upstream óptimo — por costo, capacidad o el nivel de acceso de tu cuenta. Transparente para tu código.

Cómo Funciona el Enrutamiento en TokSpan

TokSpan usa una capa de enrutamiento inteligente. Cada nombre de modelo que llamas se resuelve automáticamente al mejor proveedor y modelo para esa solicitud, sin cambios en tu código.

El enrutamiento es totalmente automático. Nunca configuras canales ni prioridades: solo llama al nombre de modelo que quieras y TokSpan elige el mejor backend.

Patrones de Enrutamiento Comunes

Enrutamiento Optimizado por Costo

Llama a un nombre de modelo genérico como gpt-4o y TokSpan lo envía al proveedor más rentable disponible.

Enrutamiento por clave

Crea claves API separadas para distintos fines, cada una limitada a los modelos y al presupuesto que necesites:

  • Cargas sensibles al costo → Una clave limitada a modelos económicos (GPT mini, Gemini Flash, DeepSeek)
  • Cargas premium → Una clave con acceso a modelos insignia (GPT, Claude Opus, Gemini Pro)
  • Aplicaciones de cara al cliente → Una clave con un límite de presupuesto por clave para mantener el gasto predecible

Enrutamiento por Capacidad

TokSpan agrupa internamente los modelos por capacidad y enruta cada carga de trabajo al modelo más adecuado:

  • Asistencia de código — Enrutada a modelos optimizados para código (Claude Opus / GPT / DeepSeek)
  • Redacción de contenido — Enrutada a modelos que equilibran calidad y velocidad (Claude Sonnet / GPT / Gemini Pro)
  • Análisis de datos — Enrutada a modelos con las ventanas de contexto más grandes
El alcance de claves te permite limitar a qué modelos accede cada clave. Consulta Autenticación — Alcance de Claves para más detalles.