Referencia API
Claude Messages API
La Messages API nativa de Anthropic — usa los modelos Claude a través de su protocolo nativo, compatible con el SDK de Anthropic y Claude Code.
Endpoint
http
POST https://api.tokspan.com/v1/messagesEjemplos Rápidos
Usa el SDK de Anthropic con TokSpan como URL base — sin cambios de código más allá de la configuración:
python
from anthropic import Anthropic
client = Anthropic(
api_key="sk-your-key",
base_url="https://api.tokspan.com", # ← host root; the SDK appends /v1/messages
)
response = client.messages.create(
model="MODEL_NAME",
max_tokens=1024,
messages=[{"role": "user", "content": "Hello!"}],
)
print(response.content[0].text)shell
curl -X POST "https://api.tokspan.com/v1/messages" \
-H "x-api-key: sk-your-key" \
-H "anthropic-version: 2023-06-01" \
-H "Content-Type: application/json" \
-d '{
"model": "MODEL_NAME",
"max_tokens": 1024,
"messages": [{"role": "user", "content": "Hello!"}]
}'json — Response
{
"id": "msg_abc123",
"type": "message",
"role": "assistant",
"content": [{
"type": "text",
"text": "Hello! How can I help you today?"
}],
"model": "MODEL_NAME",
"stop_reason": "end_turn",
"usage": {
"input_tokens": 10,
"output_tokens": 12
}
}Cuerpo de la Solicitud
| Parámetro | Tipo | Requerido | Descripción |
|---|---|---|---|
| model | string | Sí | ID del modelo Claude (ej., claude-opus-4-8, claude-sonnet-4-6). |
| max_tokens | integer | Sí | Máximo de tokens a generar. <strong>Requerido</strong> para la Messages API. |
| messages | array | Sí | Array de mensajes que alternan entre los roles <code>user</code> y <code>assistant</code>. El primer mensaje debe ser del usuario. |
| system | string | No | Prompt de sistema — una cadena o un array de bloques de contenido. |
| temperature | number | No | Temperatura de muestreo (0–1). |
| stream | boolean | No | Habilitar streaming SSE. Predeterminado: <code>false</code>. |
| top_p | number | No | Muestreo por núcleo (0–1). |
| tools | array | No | Definiciones de herramientas para tool use. Consulta Tool Calling. |
| tool_choice | object | No | Control de selección de herramienta: {"type": "auto"} o una herramienta específica. |
| thinking | object | No | Configuración de pensamiento extendido: {"type": "enabled", "budget_tokens": 1024}. El presupuesto debe ser ≥1024 y menor que max_tokens. |
Prompts de Sistema
Pasa el prompt de sistema como un campo <code>system</code> de nivel superior (no como un mensaje):
json
{
"model": "MODEL_NAME",
"max_tokens": 1024,
"system": "You are a helpful assistant that always answers in French.",
"messages": [{"role": "user", "content": "What is the capital of France?"}]
}Respuestas en Streaming (SSE)
Establece stream: true para recibir eventos SSE de Anthropic (message_start, content_block_delta, message_stop, etc.).
shell
curl -X POST "https://api.tokspan.com/v1/messages" \
-H "x-api-key: sk-your-key" \
-H "anthropic-version: 2023-06-01" \
-H "Content-Type: application/json" \
-d '{
"model": "MODEL_NAME",
"max_tokens": 1024,
"messages": [{"role": "user", "content": "Tell me a story."}],
"stream": true
}'Configuración: Establece el
base_url del SDK de Anthropic como https://api.tokspan.com — el SDK añade /v1/messages por sí mismo. La autenticación acepta tanto los headers x-api-key + anthropic-version (nativo de Anthropic) como Authorization: Bearer. El SDK de Anthropic maneja esto automáticamente.