これが Capriole をより有用にする理由
1 つの USD 8 Premium メンバーシップは、対応する Premium モデル群の無制限 Browser Chat、毎月 500 万の課金 API トークン、維持されている 6 つのコーディング エージェント経路をカバーします。アプリケーションはすでに使うプロトコルを維持し、ユーザーは 1 つの Capriole アカウント、キー、残高、請求ページを維持します。 これが、プロバイダー アカウントを別々に組み立てることに対する実務上の利点です。日付付きコスト比較 も、テストした各 500 万トークン ワークロードで Capriole が USD 8 であることを示します。直接の有料 Standard 価格は USD 15 から USD 90、OpenRouter は公開のクレジット購入手数料後に USD 15.83 から USD 94.95 です。公開経路
成功してルーティングされたレスポンスとストリーミング イベントは、クライアントが要求したプロトコルのままです。Responses ペイロードは戻り路上で Chat Completions に変換されません。Anthropic Messages ストリームは OpenAI 出力として再パッケージされません。
これにより、Responses、Messages、Chat Completions クライアントが期待するプロトコル固有の動作が保持されます。
共有レイヤーはアクセスと会計を扱います。各公開ルートは、クライアントが期待するリクエストとレスポンスの契約を保持します。モデル群はルート固有の互換集合であり、階層ではありません。各契約を実装していれば、1 つのモデルが複数の対応ルートに現れる場合があります。
エンドポイントが 1 つでは足りない理由
モデル系統の不一致は、フィールド名以上のものです。 OpenAI Responses は出力を型付きイベントとアイテムとして表します。Anthropic Messages は独自のコンテンツ ブロックとストリーミング イベントを使います。Chat Completions には別のリクエストとレスポンス形状があります。推論制御、ツール呼び出し、使用量データ、エラー、トークンカウントの動作も異なります。 浅いアダプターでも、シンプルなテキスト プロンプトは動かせます。コーディング エージェントと本番クライアントは、欠けている詳細をすぐに露出します。ストリーミングの順序、ツール結果ターン、使用量メタデータ、モデル固有の制御に依存するためです。 そのため Capriole は、1 つの認証と請求レイヤーの背後で、プロトコルを保持する複数ルートを所有します。1 つのキー、明示的なモデル選択
すべての公開生成ルートは、同じ Capriole API キーとアカウント残高を使います。要求されたモデルは、それでも選択したプロトコルに属している必要があります。 たとえば、Responses 経路は維持されている OpenAI エイリアスと、対応する Responses 互換 OpenAI モデルを受け付けます。Messages 経路は維持されている Claude エイリアスと、対応する Claude Messages モデル ID を受け付けます。互換チャット経路は、より広い公開チャット モデル集合を公開できます。 モデルが選んだルートで無効な場合、リクエストは検証に失敗する必要があります。Capriole は、サポートされない廃止キーを別のものへ静かに再マップしません。 その明示的な失敗は、呼び出し元が要求していないモデルからの答えを返すより安全です。latest エイリアスと再現可能な ID
Capriole は、それらをサポートする公開経路でopenai-latest、claude-latest、google-latest などの維持エイリアスを公開します。
エイリアスは上流ディスパッチの前に解決されます。使用量、クォータ、フォールバックの記録は、曖昧な「latest」バケットではなく、解決後の正規モデルに付けられます。
対応リリースに合わせて Capriole の維持デフォルトを動かしたい場合はエイリアスを使ってください。正確なバージョンが結果の一部であり、再現可能である必要がある場合は、具体的なモデル ID を使ってください。
モデル一覧エンドポイント が現在の公開インベントリです。Browser Chat に表示されるモデルが、すべての API プロトコルで自動的に有効だと想定しないでください。
フォールバックはレスポンス開始前に起きる
対応ルートでは、最初のソースがレスポンス バイトを送る前に失敗した場合、Capriole は別の設定済みソースを試せます。 ストリーミング レスポンスが始まったあとソースを切り替えると、重複または矛盾する出力のリスクがあります。自動フォールバックは出力開始前だけ実行されます。すべてのプロバイダー失敗を隠すことも、レスポンスの途中でモデルを変えることもできません。 要求されたモデル キーは、対応するソース フォールバックを通じて保持されます。Capriole が変えるのは配信ソースであり、ユーザーが述べたモデル選択ではありません。 Browser Chat は別に、任意のモデル自動切り替えと 会話内の手動モデル変更 を提供できます。これらはワークスペースの動作であり、生の API フォールバック契約ではありません。使用量は見えるまま
プログラム ワークロードは計量されます。Capriole は、対応プロトコルが提供するメタデータから使用量を記録します。使用量が利用可能な場合は、完了したストリーミング レスポンスも含みます。 Premium は現在、毎月 500 万の課金 API トークン を含みます。この残高では、Capriole はキャッシュなし入力と出力を 100%、キャッシュ入力を 10% で数えます。追加の token パックはトップアップとして利用できます。Premium の無制限部分は、対応する Premium モデル群の Browser Chat に適用され、API またはコーディング エージェント トラフィックには適用されません。 課金トークンの記事 は、正確な計算式、丸め規則、再現可能な例を示します。 Browser Chat と自動 API ワークロードは別の許容量を使います。数百万トークンを処理するコーディング エージェントは、見える課金トークン残高から引きます。統一レイヤーが実際に提供するもの
有用な共通レイヤーは、1 つのレスポンス スキーマではありません。周囲の製品契約です。- 1 つの Capriole アカウントと API キー
- 1 つの見える API 残高
- 維持されているモデル エイリアス
- 選択したプロトコルに対する検証
- 出力開始前の対応ソース フォールバック
- 解決後モデルに対する使用量会計
- アプリケーションとコーディング エージェント向けの文書化されたセットアップ
互換性のテスト方法
Capriole は、プロトコル契約と代表的な実クライアント フローの両方が通ったあと、ルートを対応として文書化します。成功したテキスト プロンプトは初期確認です。ストリーミング、ツール結果ターン、エイリアス解決、使用量会計、否定的なプロトコル テストが残りの証拠になります。 2026-08-10 時点で、公開ルートとファイル変換に焦点を当てたスイートは、本番のライブ呼び出しではなく、制御された上流レスポンスに対して 68 件の自動テスト を完了していました。モック エンドポイントでは証明できない動作は、別のローカル上流およびコーディング エージェント実行で確認します。
ストリーム確認は完全なレスポンスを消費し、各プロトコル独自の終端イベントを要求します。Responses は完了イベントで終わり、Chat Completions は
[DONE] に達し、Messages は message_stop に達します。ツール テストはツール結果を送り返し、最終アシスタント ターンを要求します。
否定テストはプロトコル境界を見えるままにします。google-latest は Responses で失敗し、openai-latest は Messages で失敗します。Capriole はどちらのリクエストも別のエンドポイントへ移しません。
公開 API のファイル対応は、別のリリース ゲートを使います。各候補ルートには、同じ小さな画像、PDF、CSV、DOCX フィクスチャ、内容固有の答え、対応する場合のストリーミング再実行、正確な SDK、モデル ID、リクエスト形状、テスト日の記録が必要です。それらのライブ フィクスチャが通るまで、公開 API ドキュメントは共有の Capriole 添付フィールドを宣伝せず、各ネイティブ プロトコルがサポートするファイル形式に従います。