Create chat response
Endpunkte
Chat
Erstellt eine Textantwort von einem Modell.
POST
Create chat response
Verwenden Sie diesen Endpunkt, um reinen Text an ein Modell zu senden und eine reine Textantwort zu erhalten. Diese Capriole-native Route ist nicht streamingfähig; verwenden Sie Chat Completions, Responses oder Messages, wenn Ihr Client einen SSE-Stream benötigt.
POST /v1/chat akzeptiert openai-latest, claude-latest, google-latest und öffentliche konkrete Modell-IDs aus GET /v1/models. Verwenden Sie einen Latest-Alias, damit Capriole AI das von uns empfohlene Flaggschiff-Modell für diesen Anbieter wählt. Verwenden Sie eine konkrete Modell-ID, wenn die Versionsfestlegung wichtig ist.
Capriole AI Web-Chat und die öffentliche API sind getrennte Produktflächen. Im Web-Chat sind Fable 5 und Fable 5 Thinking die primären Anthropic-Modi, während Opus 5 und Opus 5 Thinking unter Other Models erscheinen. Die öffentliche API stellt die Thinking-Voreinstellungen des Web-Chats nicht als eigene Modell-IDs bereit; verwenden Sie für Claude Chat API-Anfragen claude-latest oder eine konkrete öffentliche Claude-Modell-ID wie anthropic/claude-fable-5, anthropic/claude-opus-5 oder anthropic/claude-sonnet-4-6. Bestehende Opus 4.8-, Opus 4.7- und Opus 4.6-Integrationen bleiben unterstützt.Autorisierungen
Use an API key created in the Capriole AI page. Send it as Authorization: Bearer sk-....
Body
application/json
Public model identifier or latest alias returned by GET /v1/models
Verfügbare Optionen:
openai-latest, openai/gpt-5.6-terra, openai/gpt-5.6-luna, openai/gpt-5.5, openai/gpt-5.4-mini, claude-latest, anthropic/claude-fable-5, anthropic/claude-opus-5, anthropic/claude-opus-4-8, anthropic/claude-opus-4-7, anthropic/claude-opus-4-6, anthropic/claude-sonnet-4-6, google-latest, google/gemini-3.1-pro-preview, google/gemini-3.5-flash, xai/grok-4.5, zai/glm-5.2, moonshot/kimi-k3 Plain text user input
Enable provider-native web search when the selected model supports it.
Optional sampling temperature.
Erforderlicher Bereich:
x >= 0Optional maximum number of output tokens.
Optional maximum number of provider retries.
Erforderlicher Bereich:
x >= 0Optional provider request timeout in seconds.
Zuletzt geändert am 18. August 2026