AI API 中継とは?
中継はクライアントと上流のモデル提供元の間にあります。OpenAI または Anthropic 形式のリクエストを送ると、健全な上流チャネルを選び、転送し、応答をストリームで返します。コードは既存の SDK のまま、変えるのは Base URL とキーだけです。
中継はクライアントと上流のモデル提供元の間にあります。OpenAI または Anthropic 形式のリクエストを送ると、健全な上流チャネルを選び、転送し、応答をストリームで返します。コードは既存の SDK のまま、変えるのは Base URL とキーだけです。
価格より大切な点が 4 つあります。信頼を求めるのではなくライブのチャネル状態を公開しているか。上流が劣化したら自動で切り替えるか。請求を監査できるよう Token と費用をリクエスト単位で記録しているか。そしてすべてを chat completions に押し込むのではなく、/v1/responses と /v1/messages という本来の形式を受け付けるか。
Claude Code、Codex、GPT、Gemini、Grok を 1 つのエンドポイントの後ろにまとめ、公開のグループ状態ボード、グループ内チャネルの自動フェイルオーバー、モデル・Token・費用を示すリクエスト単位の利用ログ、日・週・月単位のプランを備えています。
実務上は同じものを指します。モデル API リクエストを上流へ転送して応答を返すサービスです。中継は単純な転送に加え、キー管理、上限、課金、ルーティングを足すのが普通です。
通常は Base URL と API Key だけです。ほとんどの OpenAI / Anthropic SDK と、Claude Code や Codex CLI のようなツールは、その設定変更だけでそのまま動きます。
チャネルグループごとにライブのステータスボードを公開しているか、フェイルオーバーの挙動を説明しているか、利用ログで各リクエストと請求額を突き合わせられるかを見てください。
Claude と Claude Code、OpenAI Codex と GPT、Google Gemini、xAI Grok。すべて同じキーとエンドポイントから、リクエストごとにモデル名を切り替えて使えます。