> ## Documentation Index
> Fetch the complete documentation index at: https://docs.capriole.ai/llms.txt
> Use this file to discover all available pages before exploring further.

# Capriole AI が異なるモデル API をまたいで動く仕組み

> Capriole AI が OpenAI Responses、Chat Completions、Anthropic Messages、モデル エイリアス、使用量、フォールバックをどうサポートするかを技術的に見ます。

Capriole AI は、対応するモデル系統に対して 1 つのアカウントと API キーを提供します。Premium は無制限の Browser Chat に加え、毎月 500 万の課金 API トークンを含むため、同じ低コストのメンバーシップでアプリケーション、コーディング エージェント、日常チャットをカバーできます。

Capriole は 4 つの公開経路を維持します。OpenAI Responses、OpenAI 互換 Chat Completions、Anthropic Messages、シンプルな Capriole ネイティブ チャット エンドポイントです。

共有アカウントと請求レイヤーは、それらのプロトコル固有ルートの上にあります。

## これが Capriole をより有用にする理由

1 つの USD 8 Premium メンバーシップは、対応する Premium モデル群の無制限 Browser Chat、毎月 500 万の課金 API トークン、維持されている 6 つのコーディング エージェント経路をカバーします。アプリケーションはすでに使うプロトコルを維持し、ユーザーは 1 つの Capriole アカウント、キー、残高、請求ページを維持します。

これが、プロバイダー アカウントを別々に組み立てることに対する実務上の利点です。[日付付きコスト比較](/ja/articles/ai-api-cost-comparison) も、テストした各 500 万トークン ワークロードで Capriole が USD 8 であることを示します。直接の有料 Standard 価格は USD 15 から USD 90、OpenRouter は公開のクレジット購入手数料後に USD 15.83 から USD 94.95 です。

## 公開経路

| 経路                          | 想定する契約                     | 典型的な用途                           |
| --------------------------- | -------------------------- | -------------------------------- |
| `POST /v1/chat`             | Capriole ネイティブのテキスト リクエスト  | シンプルなアプリケーション呼び出し                |
| `POST /v1/chat/completions` | OpenAI 互換 Chat Completions | 互換クライアントとエージェント                  |
| `POST /v1/responses`        | OpenAI Responses           | Responses ベースのアプリケーションと Codex    |
| `POST /v1/messages`         | Anthropic Messages         | Claude ネイティブ クライアントと Claude Code |

成功してルーティングされたレスポンスとストリーミング イベントは、クライアントが要求したプロトコルのままです。Responses ペイロードは戻り路上で Chat Completions に変換されません。Anthropic Messages ストリームは OpenAI 出力として再パッケージされません。

これにより、Responses、Messages、Chat Completions クライアントが期待するプロトコル固有の動作が保持されます。

共有レイヤーはアクセスと会計を扱います。各公開ルートは、クライアントが期待するリクエストとレスポンスの契約を保持します。モデル群はルート固有の互換集合であり、階層ではありません。各契約を実装していれば、1 つのモデルが複数の対応ルートに現れる場合があります。

## エンドポイントが 1 つでは足りない理由

モデル系統の不一致は、フィールド名以上のものです。

OpenAI Responses は出力を型付きイベントとアイテムとして表します。Anthropic Messages は独自のコンテンツ ブロックとストリーミング イベントを使います。Chat Completions には別のリクエストとレスポンス形状があります。推論制御、ツール呼び出し、使用量データ、エラー、トークンカウントの動作も異なります。

浅いアダプターでも、シンプルなテキスト プロンプトは動かせます。コーディング エージェントと本番クライアントは、欠けている詳細をすぐに露出します。ストリーミングの順序、ツール結果ターン、使用量メタデータ、モデル固有の制御に依存するためです。

そのため Capriole は、1 つの認証と請求レイヤーの背後で、プロトコルを保持する複数ルートを所有します。

## 1 つのキー、明示的なモデル選択

すべての公開生成ルートは、同じ Capriole API キーとアカウント残高を使います。要求されたモデルは、それでも選択したプロトコルに属している必要があります。

たとえば、Responses 経路は維持されている OpenAI エイリアスと、対応する Responses 互換 OpenAI モデルを受け付けます。Messages 経路は維持されている Claude エイリアスと、対応する Claude Messages モデル ID を受け付けます。互換チャット経路は、より広い公開チャット モデル集合を公開できます。

モデルが選んだルートで無効な場合、リクエストは検証に失敗する必要があります。Capriole は、サポートされない廃止キーを別のものへ静かに再マップしません。

その明示的な失敗は、呼び出し元が要求していないモデルからの答えを返すより安全です。

## latest エイリアスと再現可能な ID

Capriole は、それらをサポートする公開経路で `openai-latest`、`claude-latest`、`google-latest` などの維持エイリアスを公開します。

エイリアスは上流ディスパッチの前に解決されます。使用量、クォータ、フォールバックの記録は、曖昧な「latest」バケットではなく、解決後の正規モデルに付けられます。

対応リリースに合わせて Capriole の維持デフォルトを動かしたい場合はエイリアスを使ってください。正確なバージョンが結果の一部であり、再現可能である必要がある場合は、具体的なモデル ID を使ってください。

[モデル一覧エンドポイント](/ja/api-reference/endpoint/get) が現在の公開インベントリです。Browser Chat に表示されるモデルが、すべての API プロトコルで自動的に有効だと想定しないでください。

## フォールバックはレスポンス開始前に起きる

対応ルートでは、最初のソースがレスポンス バイトを送る前に失敗した場合、Capriole は別の設定済みソースを試せます。

ストリーミング レスポンスが始まったあとソースを切り替えると、重複または矛盾する出力のリスクがあります。自動フォールバックは出力開始前だけ実行されます。すべてのプロバイダー失敗を隠すことも、レスポンスの途中でモデルを変えることもできません。

要求されたモデル キーは、対応するソース フォールバックを通じて保持されます。Capriole が変えるのは配信ソースであり、ユーザーが述べたモデル選択ではありません。

Browser Chat は別に、任意のモデル自動切り替えと [会話内の手動モデル変更](/ja/articles/switch-models-mid-chat) を提供できます。これらはワークスペースの動作であり、生の API フォールバック契約ではありません。

## 使用量は見えるまま

プログラム ワークロードは計量されます。Capriole は、対応プロトコルが提供するメタデータから使用量を記録します。使用量が利用可能な場合は、完了したストリーミング レスポンスも含みます。

Premium は現在、**毎月 500 万の課金 API トークン** を含みます。この残高では、Capriole はキャッシュなし入力と出力を 100%、キャッシュ入力を 10% で数えます。追加の token パックはトップアップとして利用できます。Premium の無制限部分は、対応する Premium モデル群の Browser Chat に適用され、API またはコーディング エージェント トラフィックには適用されません。

[課金トークンの記事](/ja/articles/charged-tokens) は、正確な計算式、丸め規則、再現可能な例を示します。

Browser Chat と自動 API ワークロードは別の許容量を使います。数百万トークンを処理するコーディング エージェントは、見える課金トークン残高から引きます。

## 統一レイヤーが実際に提供するもの

有用な共通レイヤーは、1 つのレスポンス スキーマではありません。周囲の製品契約です。

* 1 つの Capriole アカウントと API キー
* 1 つの見える API 残高
* 維持されているモデル エイリアス
* 選択したプロトコルに対する検証
* 出力開始前の対応ソース フォールバック
* 解決後モデルに対する使用量会計
* アプリケーションとコーディング エージェント向けの文書化されたセットアップ

クライアントが依存するため、プロトコルは明示的なままです。

## 互換性のテスト方法

Capriole は、プロトコル契約と代表的な実クライアント フローの両方が通ったあと、ルートを対応として文書化します。成功したテキスト プロンプトは初期確認です。ストリーミング、ツール結果ターン、エイリアス解決、使用量会計、否定的なプロトコル テストが残りの証拠になります。

2026-08-10 時点で、公開ルートとファイル変換に焦点を当てたスイートは、本番のライブ呼び出しではなく、制御された上流レスポンスに対して **68 件の自動テスト** を完了していました。モック エンドポイントでは証明できない動作は、別のローカル上流およびコーディング エージェント実行で確認します。

| テスト経路              | 検証した証拠                                                                          | 現在の境界                                                                  |
| ------------------ | ------------------------------------------------------------------------------- | ---------------------------------------------------------------------- |
| OpenAI Responses   | 非ストリーミング出力、SSE 完了、function call、ステートレスな function-result フォローアップ、`openai-latest` | OpenAI Responses モデルのみ                                                 |
| Chat Completions   | 非ストリーミング出力、SSE 完了、tool call、tool-result フォローアップ、維持されている 3 つの latest エイリアスすべて    | 選択したモデルが互換ルートをサポートしている必要がある                                            |
| Anthropic Messages | 非ストリーミング出力、Anthropic SSE、`tool_use`、`tool_result`、`claude-latest`               | Claude Messages モデルのみ                                                  |
| latest エイリアス       | エンドポイント ゲーティング、正規解決、正規使用量行、代表的なクライアント実行                                         | エイリアスは入力セレクターであり、別の使用量モデルは作らない                                         |
| Browser Chat のファイル | 画像、PDF、テキスト、DOCX、PPTX、CSV、XLS、XLSX のファイル種類検出、変換、モデル ペイロード組み立て                   | この証拠は Browser Chat ワークスペースに属する                                         |
| 公開 API 経由のファイル     | 公開されたクロスプロトコル合格はない                                                              | Capriole は Responses、Chat Completions、Messages をまたぐ 1 つの汎用ファイル契約を主張しない |

ストリーム確認は完全なレスポンスを消費し、各プロトコル独自の終端イベントを要求します。Responses は完了イベントで終わり、Chat Completions は `[DONE]` に達し、Messages は `message_stop` に達します。ツール テストはツール結果を送り返し、最終アシスタント ターンを要求します。

否定テストはプロトコル境界を見えるままにします。`google-latest` は Responses で失敗し、`openai-latest` は Messages で失敗します。Capriole はどちらのリクエストも別のエンドポイントへ移しません。

公開 API のファイル対応は、別のリリース ゲートを使います。各候補ルートには、同じ小さな画像、PDF、CSV、DOCX フィクスチャ、内容固有の答え、対応する場合のストリーミング再実行、正確な SDK、モデル ID、リクエスト形状、テスト日の記録が必要です。それらのライブ フィクスチャが通るまで、公開 API ドキュメントは共有の Capriole 添付フィールドを宣伝せず、各ネイティブ プロトコルがサポートするファイル形式に従います。

## すでに持っているクライアントから始める

アプリケーションが Chat Completions を使う場合は、[Chat Completions リファレンス](/ja/api-reference/endpoint/chat-completions) に従ってください。Responses で構築されている場合は [Responses リファレンス](/ja/api-reference/endpoint/responses) を使ってください。Claude ネイティブ クライアントは [Messages リファレンス](/ja/api-reference/endpoint/messages) を使う必要があります。

最初のリクエストは [API クイックスタート](/ja/quickstart) から始めてください。Python 開発者は [OpenAI と Anthropic の SDK ガイド](/ja/guides/openai-anthropic-sdks) に従えます。コーディング エージェント利用者は、[コーディング エージェント向けの 1 つの API](/ja/articles/coding-agent-compatibility) で、維持されているクライアント対応表を確認できます。

Capriole の仕事は、クライアントが実際に話すプロトコルを尊重しつつ、アカウントとアクセスの断片化を取り除くことです。[制限付きの無料 Browser Chat で対応旗艦モデルを試す](https://capriole.ai)。API キーを作成する準備ができたらアップグレードしてください。

**事実確認日：** 2026-08-10。
