Referencia API

Responses API

La Responses API compatible con OpenAI — el sucesor de Chat Completions, con herramientas integradas como la búsqueda web y la búsqueda de archivos. Úsala a través del mismo endpoint y SDK.

Endpoint

http
POST https://api.tokspan.com/v1/responses

Ejemplos Rápidos

La Responses API sigue los mismos patrones del SDK de OpenAI — solo cambia el nombre del método:

python
from openai import OpenAI

client = OpenAI(api_key="sk-your-key", base_url="https://api.tokspan.com/v1")

response = client.responses.create(
    model="MODEL_NAME",
    input="What is the capital of France?",
)

print(response.output_text)
shell
curl -X POST "https://api.tokspan.com/v1/responses" \
  -H "Authorization: Bearer sk-your-key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "MODEL_NAME",
    "input": "What is the capital of France?"
  }'
json — Response
{
  "id": "resp_abc123",
  "object": "response",
  "created_at": 1700000000,
  "status": "completed",
  "model": "MODEL_NAME",
  "output": [{
    "type": "message",
    "role": "assistant",
    "content": [{
      "type": "output_text",
      "text": "The capital of France is Paris.",
      "annotations": []
    }]
  }],
  "usage": {
    "input_tokens": 12,
    "output_tokens": 8,
    "total_tokens": 20
  }
}

Cuerpo de la Solicitud

ParámetroTipoRequeridoDescripción
modelstringID del modelo (ej., gpt-4o, claude-opus-4-8). Consulta Modelos para el catálogo completo.
inputstring / arrayLa entrada para la respuesta. Puede ser una cadena simple o un array de elementos de mensaje (ej., input_text, input_image).
instructionsstringNoInstrucciones a nivel de sistema para el modelo — el equivalente en la Responses API de un mensaje <code>system</code>.
max_output_tokensintegerNoMáximo de tokens a generar en la respuesta.
temperaturenumberNoTemperatura de muestreo (0–2). Mayor = más aleatorio.
streambooleanNoHabilitar streaming SSE. Predeterminado: false.
toolsarrayNoHerramientas que el modelo puede llamar, incluidas las herramientas integradas como web_search_preview y file_search.
tool_choicestring / objectNoControl de selección de herramienta: "auto", "none", "required", o un objeto de herramienta específico.
previous_response_idstringNoPasa el id de la respuesta anterior para continuar una conversación multi-turno con estado.
reasoningobjectNoConfiguración de razonamiento para modelos de razonamiento (ej., <code>effort</code>: <code>"low"</code> | <code>"medium"</code> | <code>"high"</code>).

Respuestas en Streaming (SSE)

Establece stream: true para recibir la respuesta de forma incremental mediante Server-Sent Events — igual que el streaming de Chat Completions.

shell
curl -X POST "https://api.tokspan.com/v1/responses" \
  -H "Authorization: Bearer sk-your-key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "MODEL_NAME",
    "input": "Tell me a story.",
    "stream": true
  }'

Herramientas Integradas

La Responses API admite herramientas integradas que no requieren definiciones de funciones personalizadas:

Búsqueda Web

json
{
  "model": "MODEL_NAME",
  "input": "What is the latest news about AI?",
  "tools": [{
    "type": "web_search_preview"
  }]
}

Búsqueda de Archivos

json
{
  "model": "MODEL_NAME",
  "input": "Summarize the Q3 report",
  "tools": [{
    "type": "file_search",
    "vector_store_ids": ["vs_abc123"]
  }]
}
Disponibilidad de herramientas integradas: La búsqueda web y la búsqueda de archivos requieren modelos y canales upstream que las admitan. La disponibilidad depende de los canales configurados en tu backend.