Skip to main content
POST
Create chat response
Verwenden Sie diesen Endpunkt, um reinen Text an ein Modell zu senden und eine reine Textantwort zu erhalten. Diese Capriole-native Route ist nicht streamingfähig; verwenden Sie Chat Completions, Responses oder Messages, wenn Ihr Client einen SSE-Stream benötigt. POST /v1/chat akzeptiert openai-latest, claude-latest, google-latest und öffentliche konkrete Modell-IDs aus GET /v1/models. Verwenden Sie einen Latest-Alias, damit Capriole AI das von uns empfohlene Flaggschiff-Modell für diesen Anbieter wählt. Verwenden Sie eine konkrete Modell-ID, wenn die Versionsfestlegung wichtig ist. Capriole AI Web-Chat und die öffentliche API sind getrennte Produktflächen. Im Web-Chat sind Fable 5 und Fable 5 Thinking die primären Anthropic-Modi, während Opus 5 und Opus 5 Thinking unter Other Models erscheinen. Die öffentliche API stellt die Thinking-Voreinstellungen des Web-Chats nicht als eigene Modell-IDs bereit; verwenden Sie für Claude Chat API-Anfragen claude-latest oder eine konkrete öffentliche Claude-Modell-ID wie anthropic/claude-fable-5, anthropic/claude-opus-5 oder anthropic/claude-sonnet-4-6. Bestehende Opus 4.8-, Opus 4.7- und Opus 4.6-Integrationen bleiben unterstützt.

Autorisierungen

Authorization
string
header
erforderlich

Use an API key created in the Capriole AI page. Send it as Authorization: Bearer sk-....

Body

application/json
model
enum<string>
erforderlich

Public model identifier or latest alias returned by GET /v1/models

Verfügbare Optionen:
openai-latest,
openai/gpt-5.6-terra,
openai/gpt-5.6-luna,
openai/gpt-5.5,
openai/gpt-5.4-mini,
claude-latest,
anthropic/claude-fable-5,
anthropic/claude-opus-5,
anthropic/claude-opus-4-8,
anthropic/claude-opus-4-7,
anthropic/claude-opus-4-6,
anthropic/claude-sonnet-4-6,
google-latest,
google/gemini-3.1-pro-preview,
google/gemini-3.5-flash,
xai/grok-4.5,
zai/glm-5.2,
moonshot/kimi-k3
input
string
erforderlich

Plain text user input

Enable provider-native web search when the selected model supports it.

temperature
number

Optional sampling temperature.

Erforderlicher Bereich: x >= 0
max_output_tokens
integer

Optional maximum number of output tokens.

max_retries
integer

Optional maximum number of provider retries.

Erforderlicher Bereich: x >= 0
timeout
number

Optional provider request timeout in seconds.

Antwort

Chat completion response

id
string
erforderlich
model
string
erforderlich
result
object
erforderlich
usage
object
erforderlich
Zuletzt geändert am 18. August 2026