Skip to main content
POST
Create chat response
Usa este endpoint para enviar una entrada de texto plano a un modelo y recibir una respuesta de texto plano. Esta ruta nativa de Capriole no es streaming; usa Chat Completions, Responses o Messages cuando tu cliente necesite un flujo SSE. POST /v1/chat acepta openai-latest, claude-latest, google-latest y los IDs de modelo concretos públicos que devuelve GET /v1/models. Usa un alias latest para que Capriole AI elija nuestro modelo insignia recomendado para ese proveedor. Usa un ID de modelo concreto cuando importe fijar la versión. El chat web de Capriole AI y la API pública son superficies de producto distintas. En el chat web, Fable 5 y Fable 5 Thinking son los modos principales de Anthropic, mientras que Opus 5 y Opus 5 Thinking aparecen en Other Models. La API pública no expone los presets de thinking del chat web como IDs de modelo separados; para solicitudes de la Chat API de Claude, usa claude-latest o un ID público concreto de Claude como anthropic/claude-fable-5, anthropic/claude-opus-5 o anthropic/claude-sonnet-4-6. Las integraciones existentes de Opus 4.8, Opus 4.7 y Opus 4.6 siguen siendo compatibles.

Autorizaciones

Authorization
string
header
requerido

Use an API key created in the Capriole AI page. Send it as Authorization: Bearer sk-....

Cuerpo

application/json
model
enum<string>
requerido

Public model identifier or latest alias returned by GET /v1/models

Opciones disponibles:
openai-latest,
openai/gpt-5.6-terra,
openai/gpt-5.6-luna,
openai/gpt-5.5,
openai/gpt-5.4-mini,
claude-latest,
anthropic/claude-fable-5,
anthropic/claude-opus-5,
anthropic/claude-opus-4-8,
anthropic/claude-opus-4-7,
anthropic/claude-opus-4-6,
anthropic/claude-sonnet-4-6,
google-latest,
google/gemini-3.1-pro-preview,
google/gemini-3.5-flash,
xai/grok-4.5,
zai/glm-5.2,
moonshot/kimi-k3
input
string
requerido

Plain text user input

Enable provider-native web search when the selected model supports it.

temperature
number

Optional sampling temperature.

Rango requerido: x >= 0
max_output_tokens
integer

Optional maximum number of output tokens.

max_retries
integer

Optional maximum number of provider retries.

Rango requerido: x >= 0
timeout
number

Optional provider request timeout in seconds.

Respuesta

Chat completion response

id
string
requerido
model
string
requerido
result
object
requerido
usage
object
requerido
Última modificación el 18 de agosto de 2026