Skip to main content
POST
Create chat response
Use este endpoint para enviar entrada de texto simples a um modelo e receber uma resposta de texto simples. Esta rota nativa da Capriole não tem streaming; use Chat Completions, Responses ou Messages quando o cliente precisar de um stream SSE. POST /v1/chat aceita openai-latest, claude-latest, google-latest e IDs públicos de modelo concretos retornados por GET /v1/models. Use um alias latest para deixar a Capriole AI escolher o modelo principal que recomendamos para aquele provedor. Use um ID de modelo concreto quando o versionamento fixo for importante. O chat na web da Capriole AI e a API pública são superfícies de produto distintas. No chat na web, Fable 5 e Fable 5 Thinking são os modos Anthropic principais, enquanto Opus 5 e Opus 5 Thinking aparecem em Other Models. A API pública não expõe as predefinições Thinking do chat na web como IDs de modelo separados; para solicitações da Claude Chat API, use claude-latest ou um ID público concreto de modelo Claude, como anthropic/claude-fable-5, anthropic/claude-opus-5 ou anthropic/claude-sonnet-4-6. Integrações existentes de Opus 4.8, Opus 4.7 e Opus 4.6 continuam suportadas.

Autorizações

Authorization
string
header
obrigatório

Use an API key created in the Capriole AI page. Send it as Authorization: Bearer sk-....

Corpo

application/json
model
enum<string>
obrigatório

Public model identifier or latest alias returned by GET /v1/models

Opções disponíveis:
openai-latest,
openai/gpt-5.6-terra,
openai/gpt-5.6-luna,
openai/gpt-5.5,
openai/gpt-5.4-mini,
claude-latest,
anthropic/claude-fable-5,
anthropic/claude-opus-5,
anthropic/claude-opus-4-8,
anthropic/claude-opus-4-7,
anthropic/claude-opus-4-6,
anthropic/claude-sonnet-4-6,
google-latest,
google/gemini-3.1-pro-preview,
google/gemini-3.5-flash,
xai/grok-4.5,
zai/glm-5.2,
moonshot/kimi-k3
input
string
obrigatório

Plain text user input

Enable provider-native web search when the selected model supports it.

temperature
number

Optional sampling temperature.

Intervalo obrigatório: x >= 0
max_output_tokens
integer

Optional maximum number of output tokens.

max_retries
integer

Optional maximum number of provider retries.

Intervalo obrigatório: x >= 0
timeout
number

Optional provider request timeout in seconds.

Resposta

Chat completion response

id
string
obrigatório
model
string
obrigatório
result
object
obrigatório
usage
object
obrigatório
Última modificação em 18 de agosto de 2026