AIゲートウェイおすすめ10選【2026年版】マルチモデルアプリを徹底比較
マルチモデルアプリ向けAIゲートウェイ10製品を、料金、ルーティング、可観測性、ガバナンス、セルフホスト可否で比較します。LiteLLM、Vercel AI Gateway、Portkey、OpenRouterなどの選び方と、本番環境でロックインを避ける「10分で離脱」の設計を解説します。

マルチモデルアプリ向けAIゲートウェイとして、運用責任を持つプラットフォーム担当者がいるなら総合首位はLiteLLM、マネージド型の第一候補はVercel AI Gatewayです。StripeがOpenRouterを80億ドル超で買収するとの報道からも、選定時に重視すべき条件は明らかです。本番アプリには、書き直さずに迂回できるゲートウェイが必要です。
Axiosは2026年8月17日、Stripeが現金と株式による80億ドル超の条件でOpenRouterの買収に合意したと報じました。一方で、両社からのコメントはなく、正式発表もまだ見込まれている段階だとしています。この違いは重要です。ただし、取引が成立するかどうかにかかわらず、運用上の教訓は変わりません。ゲートウェイがモデルベンダーへのロックインを解消できるのは、そのゲートウェイ自体が次のロックインにならない場合だけです。
結論:どのAIゲートウェイを選ぶべきか
制御性ならLiteLLM、運用を任せる手軽さならVercel AI Gateway、エンタープライズガバナンスならPortkeyを選びます。OpenRouterは、豊富なカタログにパーセンテージ課金とベンダー依存の追加を上回る価値がある場合に限るべきです。 AIゲートウェイとは、アプリケーションとモデルプロバイダーの間でリクエストを受け持つレイヤーです。APIの差異を吸収し、認証情報を保持し、トラフィックを振り分け、失敗時に再試行し、コストを記録し、ポリシーを適用できます。
以下の料金と製品上限は、各社の公開ページで2026年8月18日に確認しました。ランキングの対象は10製品です。機能名をいくつ並べられるかではなく、導入企業が本番運用で最初に突き当たる壁を基準に評価しています。
最初に決めるべきなのは機能数ではなく、リクエスト経路を誰が所有するかです。セルフホスト型なら、プロセス、認証情報、データベース、ログ、ポリシーを自社環境に置けますが、障害対応も自社チームの責任になります。マネージド型ならその運用負担はなくなる一方、サービス停止、料金改定、買収、製品ロードマップの影響が、すべてのモデル呼び出しに及びます。
コストの境界は、各社の機能ページから受ける印象より明快です。セルフホスト型ゲートウェイの運用に、プラットフォーム担当者が毎月8時間を使い、人件費込みの単価を1時間$150と仮定します。月額運用費は$1,200になりますが、これはベンダーの提示価格ではなく、説明用の試算です。5.5%のゲートウェイ手数料が$1,200に達する月間モデル利用額は**$21,818**、5%なら**$24,000**です。

ただし、この計算が示すのは予算上の境界だけです。デプロイ境界、規制対象データの経路、プロバイダー契約、必須の監査証跡があれば、金銭的な損益分岐点を大きく下回ってもセルフホストを選ぶ理由になります。逆に、小規模なスタートアップが、エンジニア1日分にも満たない手数料を節約するために社内プラットフォーム業務を新設するべきではありません。
AIゲートウェイが予算項目であり、撤退計画でもある理由
モデルが急速に変わるからこそゲートウェイには価値があります。しかし、そのゲートウェイなしではアプリを動かせなくなった時点で、ゲートウェイはリスクに変わります。 OpenRouterの報道は、Palo Alto NetworksがPortkeyの買収を完了し、PortkeyをPrisma AIRSの中核に据えると発表してから3か月足らずで出ました。独立した2つのコントロールプレーンが、1四半期のうちに大規模プラットフォームへ移る可能性があるということです。このカテゴリーでは、所有者の変更を例外扱いせず、起こり得る前提で選ぶ必要があります。
事業上の問題は、依存先が集中することです。マルチモデルアプリでは、あるワークフローにOpenAI、別の処理にAnthropic、大量のバックグラウンドジョブにオープンモデルを使う場合があります。3つを1つのゲートウェイの背後にまとめれば、コード、請求、ポリシー、オブザーバビリティは簡素になります。一方で、1度の料金改定やポリシー変更が3つすべてに同時に及ぶ構造にもなります。
安全な構成は3層です。
- 内部モデルクライアント: テキスト生成、構造化出力、埋め込み、ツール利用など、アプリに必要な少数の操作だけを定義します。
- ゲートウェイアダプター: ゲートウェイ固有のヘッダーをコードベース全体へ漏らさず、各操作を選んだゲートウェイにマッピングします。
- プロバイダー直接接続アダプター: 通常の本番トラフィックを流さない場合でも、設定と手順書を維持します。
この構成によって、本稿でいう**「10分で離脱」**が可能になります。運用担当者は、ビジネスロジックを変更せず、設定変更と管理されたデプロイだけで、1つの本番ワークロードをゲートウェイの外へ迂回できるべきです。10分は本稿が定める運用目標であり、ベンダーのSLAではありません。ゲートウェイを迂回するためにクライアントの書き直し、新しいID設計、全モデル名の移行が必要なら、そのゲートウェイはモデルプロバイダー以上にアプリを支配しています。
自動フォールバックのような機能も、同じ理由で精査が必要です。フォールバックに価値があるのは、アプリが想定するレスポンスプロトコル、ツールスキーマ、データポリシー、コスト上限を維持できる場合だけです。別モデルからHTTP成功レスポンスが返っても、構造化出力が変わったり、ツール呼び出しに互換性がなかったりすれば、アプリとしては失敗です。
ゲートウェイの下にある推論レイヤーまで比較するなら、最安AI APIの比較でモデル料金とルーティング手数料を切り分けています。顧客向けアプリではなく開発者ツールが直近の用途なら、より対象を絞ったコーディングエージェント向けAIゲートウェイガイドで、コーディングエージェントの設定とリポジトリへの利用量帰属を解説しています。
AIゲートウェイ10製品の選定基準
このランキングではモデル数より先に、移行しやすさと運用との相性を評価しました。 数百のモデルを収めたカタログは検討段階では有用ですが、本番アプリの承認ルートが3つに固まった後は、ほとんど意味を持ちません。
各ゲートウェイを5つの基準で評価しました。
- ポータビリティ: アプリが自社のプロバイダーアカウント、モデル名、ポリシー、直接接続ルートを維持できるか。
- 決定論的な耐障害性: 運用担当者が、再試行、プロバイダーの順序、フォールバックの動作、リクエストを打ち切る条件を制御できるか。
- コストの可視性: 支出をアプリ、顧客、チーム、キーごとに帰属でき、公開料金から手数料を予測できるか。
- ガバナンス境界: 購入企業が求めるデプロイ、ID、保持期間、監査、データレジデンシーの要件を満たせるか。
- 運用成熟度: 一般提供され、サポートと監視が可能で、利用段階に見合う価格が設定されているか。
ここで行ったのは料金とドキュメントの検証であり、製品トライアルを装った評価ではありません。実環境へのデプロイ、負荷テスト、契約を行ったとは主張していません。各プラン、上限、具体的な機能はすべて2026年8月18日に開いたベンダーページに基づき、コスト比較はその入力値を使った算術です。
対象は、現在マルチモデルアプリのリクエスト経路に置ける製品に絞りました。単一クラウドのモデルカタログが最適な場合はありますが、中立なルーティングではありません。ロードマップ上にしか存在しない製品を、今すぐデプロイして料金を計算できるゲートウェイより上位にはできません。
1. LiteLLM:アプリ所有のコントロールプレーンで総合首位
運用責任者が明確な場合、LiteLLMが総合的に最も優れたAIゲートウェイです。 このオープンソースプロキシは、100+のプロバイダーを1つのOpenAI互換APIにまとめます。仮想キー、チーム、支出追跡、予算、レート制限、フォールバック、リクエスト/レスポンスログ、Prometheusメトリクスも備えています。

最適な用途: セルフホストでアプリ側が所有するゲートウェイを必要とするプロダクト企業
特長: $0のOSSプランで、幅広いプロバイダー対応、予算、キー、フォールバック、メトリクスを利用可能
料金: Open Source $0。Enterpriseは容量、アーキテクチャ、サポートに応じた年間契約の個別見積もり
無料トライアル: Enterpriseをクレジットカード不要で30日間。OSSは引き続き無料
LiteLLMの公開料金ページは、ソフトウェアの責任境界を明確にしています。Open Sourceは、本番環境でセルフホストしても無料です。Enterpriseはトークン従量制ではなく、リクエスト容量、デプロイ構成、必要なサポートに基づく年間見積もりです。Enterpriseでは、SSOとSCIM、OIDCまたはJWT認証、監査ログ、シークレットマネージャー連携、キーローテーション、マルチリージョンのコントロールプレーン、エアギャップ環境へのデプロイ、最大24/7のサポートが加わります。
$0という表示は正しいものの、それだけでは全体像を示せません。プロキシ、Postgres、シークレット、スケーリング、アップグレード、プロバイダーAPIの変更、ログ保管、ダッシュボード、インシデント対応は自社チームが所有します。1時間$150で8時間という説明用の前提では、インフラ費を除いても毎月$1,200です。月間モデル利用額が$21,818を超えると、LiteLLMは5.5%課金より金銭面で有利になります。ただし、規制対象のデプロイでは、節約より制御を優先して、はるかに早い段階で選ばれることがあります。
Dockerクイックスタートでは、curl -sSL https://docs.litellm.ai/docker-compose.yml | docker compose -f - up -dでゲートウェイとPostgresを起動し、ポート4000で管理UIを公開します。評価の入口としては便利ですが、本番設計が完成するわけではありません。同じガイドは、永続的な認証情報を追加する前に仮のLITELLM_SALT_KEYを置き換え、その後は変更しないよう警告しています。古い値で暗号化したプロバイダーキーは、新しい値では復元できないためです。
本番で突き当たる壁は、所有者が曖昧なことです。LiteLLMは優れたプラットフォーム部品ですが、片手間のサイドプロジェクトには向きません。プロキシの担当者が「追加した人」のままなら、プロバイダーの変更をきっかけに、予算、オンコール体制、アップグレード方針のないアプリケーションエンジニアがゲートウェイチームを兼ねることになります。
使い捨てられる環境から始める
ドキュメントのDocker Composeクイックスタートを本番以外のアカウントで試します。ゲートウェイとPostgresの起動を確認し、仮のシークレットを置き換え、顧客トラフィックから切り離しておきます。
名前を付けた2つのルートだけを公開する
プライマリモデルと、互換性のあるフォールバックを1つだけ追加します。アプリコードが各プロバイダーの公開モデル文字列に依存しないよう、
support-primaryやsupport-fallbackのような安定した内部エイリアスを使います。アプリケーション用の仮想キーを発行する
1つのサービスに対し、利用可能なモデル、月間予算、レート制限を個別に設定した仮想キーを作ります。LiteLLMのマスターキーをアプリケーションワークロードへ配布してはいけません。
直接接続アダプターを維持する
同じサービスからプライマリプロバイダーへ直接接続できるよう、機能フラグで設定します。通常はゲートウェイルートを使い、プロバイダールートはテスト済みの迂回路として残します。
意図的にプライマリを失敗させる
制御された状況で利用不能なルートを発生させ、ログにフォールバックが記録されることを確認します。続いて直接接続アダプターを有効にし、切り替え時間を測ります。「10分で離脱」という目標を満たせないなら、トラフィックを増やす前に抽象化を直します。
- 本番利用できるOSSライセンスが$0で、トークン単位のゲートウェイ手数料がない
- 100+のプロバイダーを1つのOpenAI互換APIに統合
- OSSで仮想キー、チーム予算、レート制限、フォールバック、ログ、Prometheusを利用可能
- セルフホストのデータ経路に加え、Enterpriseではエアギャップとマルチリージョンに対応
- Enterprise料金はモデル利用額ではなく容量に応じて決まる
- 可用性、アップグレード、データベースの健全性、シークレット、インシデント対応は購入側の責任
- Enterprise料金は非公開
- クイックスタートの手軽さによって、本番向けの堅牢化作業が見えにくくなる
- 共有プロキシが社内の新たな障害ドメインになる
2. Vercel AI Gateway:マネージド型の第一候補
トークン料金への上乗せなしで1つのエンドポイントを使いたいプロダクトチームには、Vercel AI Gatewayが最も無難なマネージド型です。 ルーティング制御には、プロバイダーの絞り込みと順序指定、モデルのフォールバック、直近の稼働率とレイテンシーを考慮したプロバイダー選択があります。

最適な用途: マネージド型を素早く導入したいスタートアップとプロダクトチーム
特長: プロバイダーの定価と同じトークン料金で、ゲートウェイ上乗せ0
料金: Freeは毎月$5のクレジット付き。Paidでは購入クレジットを使い、プロバイダーの定価で課金
無料トライアル: 対象モデルで継続利用できるFreeプラン。モデルごとの上限は低め
現在の料金ページでは、無料と有料の状態が明確に分かれています。Freeには毎月$5のクレジットが含まれます。クレジットを購入するとアカウントはPay as you goへ移行し、利用可能な全モデルが開放され、上限が上がる代わりに、毎月の$5クレジットは終了します。どちらのプランも、プロバイダーの定価を使い、トークン料金への上乗せは0です。
Bring Your Own Keyを使えるのは、アカウントがPaidへ移行した後だけです。BYOKにゲートウェイ手数料はかかりません。ただし、自社の認証情報を使ったリクエストが失敗すると、Vercelのシステム認証情報で再試行され、そのフォールバック分がゲートウェイのクレジット残高から請求される場合があります。可用性は高まりますが、すべての利用を既存のプロバイダー契約に載せるという財務上の前提には反します。調達を簡略化する目的でBYOKを使う前に、挙動を確認すべきです。
トークンには上乗せがありませんが、一部の制御機能は無料ではありません。Custom Reportingは1,000書き込みあたり$0.075、1,000件のレポートクエリあたり$5です。チーム全体のプロバイダー許可リストは、成功した1,000リクエストあたり$0.10ですが、リクエスト単位のonlyフィルターに追加料金はありません。チーム全体のゼロデータ保持も1,000リクエストあたり$0.10です。トレースドレインは1,000トレースあたり$0.05に加え、エグレス1 GBあたり$0.50です。
100万リクエストで、チーム全体の許可リスト、チーム全体のZDR、各リクエスト1件のトレースを有効にすると、$250とトレースのエグレス料金が加わります。多くのアプリではモデル利用額に比べて小さいものの、「上乗せ0」を「すべての制御機能が無料」と読み替えてはいけません。
壁になるのはデプロイの所有権です。ゲートウェイを運用するのはVercelであり、そのデータプレーンを自社クラスタ内で動かすことはできません。マネージド型の境界を受け入れられ、運用開始までの速さを重視する場合に選びます。プライベートデプロイが希望ではなく必須条件なら、LiteLLMかBifrostを選びます。
- Free、Paid、BYOKのすべてでトークン上乗せ0
- 範囲を絞った試験導入に使える毎月$5のFreeクレジット
- プロバイダーの順序指定、絞り込み、フォールバック、マネージドモデルアクセス
- ゲートウェイ運用やデータベース管理が不要
- プロバイダーとZDRをリクエスト単位で指定すれば、チーム全体の追加料金を避けられる
- ゲートウェイプロセスをセルフホストできない
- BYOKにはクレジット購入が必要
- BYOKの呼び出し失敗時に、有料のVercel認証情報へフォールバックする場合がある
- レポート、チーム全体のポリシー、トレースドレインは別メーターで課金
3. Portkey:マネージド型のエンタープライズガバナンスに最適
ポリシー、ガードレール、予算、プライベートデプロイの選択肢が購入理由になるなら、Portkeyが最も適したマネージド型です。 ユニバーサルAPIに、再試行、タイムアウト、フォールバック、負荷分散、キャッシュ、仮想キー、オブザーバビリティを組み合わせています。

最適な用途: マネージドガバナンスを導入するミッドマーケット企業とエンタープライズ
特長: 公開価格の本番プランと、プライベートクラウド/VPCホスティングに対応するEnterprise
料金: Open Sourceはセルフホスト。Developer $0、Production $49/月、Enterpriseは個別見積もり
無料トライアル: プロトタイプと評価向けのDeveloperは無期限で無料
料金ページは、各プランの境界を珍しいほど明確に示しています。Developerは毎月10,000件のログを記録し、ログを3日間、メトリクスを30日間保持しますが、本番利用には適さないと明記されています。Productionは月額$49で、100,000件の記録ログを含みます。以降は300万件まで100,000件追加ごとに$9、ログ保持30日間、メトリクス保持90日間です。
記録ログが100万件なら、Productionは月額**$130**です。内訳は基本料金$49と、$9の超過ブロック9個です。成長中のアプリにも導入しやすい水準です。一方、同じページでは、独自のセキュリティ制御やデータレジデンシー保証が必要な場合、Productionを推奨していません。該当する購入者はEnterpriseへ進みます。1,000万件以上の記録ログ、保持期間のカスタマイズ、SSO、細かな予算と制限、プライベートクラウド、VPCホスティング、データレイクへのエクスポート、高度なコンプライアンスが含まれます。
製品の壁は機能ではなく、購入範囲です。ベースURLとフォールバックだけが必要なスタートアップでは、Portkeyが提供する組織向け価値を使い切れません。複数のアプリ、承認モデルのポリシー、PII制御、監査要件を抱えるプラットフォームチームなら、同じ機能を毎週活用できます。
所有関係については、調達時に確認が必要です。Palo Alto Networksは2026年5月29日にPortkeyの買収を完了し、PortkeyをPrisma AIRSの中核AI Gatewayにすると発表しました。セキュリティ連携とエンタープライズサポートが強化される可能性がある一方、パッケージやロードマップの優先順位が変わる可能性もあります。契約書に記載される製品名、既存の独立アカウントがPrisma AIRSにどう対応するか、将来統合された場合にも残るエクスポート経路を確認してください。
- オープンソース、無料のDeveloper、公開価格$49のProduction、プライベートなEnterpriseという選択肢
- フォールバック、再試行、タイムアウト、負荷分散、キャッシュ、キー、オブザーバビリティ
- セルフサービスプランでログ件数と保持期間の上限が明確
- Enterprise向けのデプロイとコンプライアンスの選択肢
- 記録ログ100万件で$130という予測しやすい例
- Developerは本番プランではないと明記
- 独自セキュリティやレジデンシー保証にはProductionが不向き
- Enterprise料金には見積もりが必要
- 買収後の統合により、パッケージとロードマップの確認事項が増える
4. Cloudflare AI Gateway:低コストなエッジ制御に最適
Cloudflareがすでにアプリのエッジ、セキュリティ、Workersランタイムを担っているなら、低コストの第一候補はCloudflare AI Gatewayです。 コアの分析、キャッシュ、レート制限は、すべてのプランで無料です。

最適な用途: Cloudflareのネットワークとセキュリティ制御をすでに利用しているアプリ
特長: コアゲートウェイ$0、DLPスキャンも無料
料金: コア機能$0。Unified Billingのクレジット購入は5%加算。ガードレールにはWorkers AI料金を適用
無料トライアル: 期限付きではなく、コア機能を継続して無料利用可能
Cloudflareの公開料金ドキュメントには、無料枠の保存上限が具体的に記されています。Workers Freeでは、アカウント内の全ゲートウェイを合わせて100,000件のログを保存できます。Workers Paidでは、ゲートウェイごとに1,000万件です。DLPスキャンは無料ですが、Zero Trust契約のないアカウントで使える定義済みDLPプロファイルは2つだけです。ガードレールの評価はWorkers AIのトークン推論として別途課金されます。
Unified Billingでクレジットを購入すると5%の手数料がかかりますが、外部モデルの推論料金自体にトークン上乗せはありません。月間購入クレジットが$20,000なら手数料は$1,000です。この5%はUnified Billingで購入したクレジットに対するもので、$0のコアゲートウェイにかかる料金ではありません。
ローンチ前に把握すべきスループットの境界もあります。現在の上限ページによると、Unified Billingのトラフィックはゲートウェイごとに60秒あたり200リクエストまでで、超過すると429が返ります。この制限はBYOKトラフィックには適用されません。ほかにも、保存ログはゲートウェイごとに毎秒500件、キャッシュ可能なリクエストは25 MB、キャッシュTTLは1か月、カスタムメタデータは1リクエストあたり5項目に制限されます。
壁になるのは、周辺プラットフォームとの相性です。チームがCloudflareのアカウントモデル、ログ、DLP、Workers、エッジの挙動に慣れていれば有力です。一方、月額$49のゲートウェイ契約を避けるためだけに、それらの概念を新しく導入するなら魅力は薄れます。表示料金が最も安いゲートウェイでも、統合費用はかえって大きくなり得ます。
- コアの分析、キャッシュ、レート制限が$0
- すべてのプランでDLPスキャンが無料
- 既存のCloudflareエッジ/セキュリティ運用と好相性
- 有料プランのログ保存枠が大きい
- BYOKならUnified Billingのリクエストレート制限を回避可能
- Unified Billingのクレジット購入に5%加算
- Unified Billingはゲートウェイごとに60秒あたり200リクエストまで
- Freeで保存できるログはアカウント全体で100,000件まで
- ガードレールや追加のDLPプロファイルによって周辺製品の費用が生じる
5. OpenRouter:最良のモデルマーケットプレイスだが、単独ルートには不向き
モデルやプロバイダーの選択肢をまだ広く残したい段階では、OpenRouterが最も優れたゲートウェイです。 Pay as you goでは、1つのアカウントから80+のプロバイダーが提供する400+のモデルを利用できます。

最適な用途: 素早いモデル探索、プロバイダー比較、幅広いカタログへのアクセス
特長: 料金、スループット、レイテンシー、ポリシー、可用性に基づく細かなプロバイダールーティング
料金: Free $0。Pay as you goは5.5%のプラットフォーム手数料。Enterpriseは割引付きの個別見積もり
無料トライアル: 4プロバイダーの25+モデルを1日50リクエストまで使えるFreeプラン
公開料金ページには3つのプランがあります。Freeでは、4プロバイダーの25+の無料モデルを1日50リクエストまで使えます。Pay as you goでは、400+モデル、80+プロバイダー、高いグローバル上限を利用でき、最低利用額はありません。プラットフォーム手数料は5.5%です。Enterpriseは同じカタログに、手数料割引、請求書払い、SSOまたはSAML、契約上のSLA、共有SlackによるサポートSLAを加えます。
BYOKでは手数料の境界が変わります。Pay as you goは、月間$25,000相当の定価ベース推論までBYOK手数料がかからず、超過分に5%を課金します。Enterpriseではこの枠が$200,000になり、その後は5%です。プロバイダーとの直接契約がある購入者は、購入するOpenRouterクレジットとは分けて、BYOK枠を試算する必要があります。
OpenRouterの強みはルーティングの深さです。プロバイダー選択のドキュメントによると、デフォルトでは直近30秒に重大な障害があったプロバイダーを避けたうえで、安定した低コストのプロバイダーに価格の逆二乗で重みを付け、残りをフォールバックに回します。運用側で価格、スループット、レイテンシーによる並べ替え、指定プロバイダーの順序付け、フォールバックの無効化、パラメーター対応の必須化、データを収集するプロバイダーの拒否、ゼロデータ保持エンドポイントの必須化、料金上限の設定もできます。
これらの制御は、稼働率と経済性の両方を改善できます。一方で、デフォルトの挙動自体が本番契約の一部になります。アプリで構造化出力やツール利用が必要なら、同じモデルスラッグのすべてのエンドポイントが同じ動作をすると想定せず、require_parametersと許可リストを設定します。
購入クレジットが月間$20,000なら、5.5%は月額$1,100です。説明用のセルフホスト運用費$1,200はまだ下回ります。ただし、安定したセルフホストゲートウェイの運用負担が横ばいになっても、パーセンテージ手数料は増え続けます。利用額が$21,818を超える段階で、改めて比較すべきです。
Stripeとの合意報道は、依存コストを引き上げる材料ではあっても、慌てて移行する理由ではありません。OpenRouterはこのランキングで最も広範なマーケットプレイスであることに変わりはありません。堅実な対策は、プロバイダー直接接続アダプター、エクスポート可能なポリシー、テスト済みの迂回路を用意することです。OpenRouter料金の詳細分析では、手数料とBYOKの境界をさらに詳しく解説しています。
- 有料プランで400+モデル、80+プロバイダー
- プロバイダーの順序、並べ替え、ポリシー、フォールバックを細かく制御可能
- Pay as you goに最低利用額がない
- 5%の手数料が始まる前に有用なBYOK枠がある
- モデル探索の選択肢を残す最短ルート
- 購入クレジットの5.5%手数料が利用額に比例して増える
- Freeの1日50リクエストは本番向けの枠ではない
- ポリシーを明示しないと、デフォルトで複数プロバイダーにルーティングされる場合がある
- 所有者変更の報道によって、ベンダー有事への備えが増える
6. Bifrost:再試行を明示制御できるOSSの有力候補
再試行の挙動を明示的に管理し、OpenTelemetryと小さめのゲートウェイ構成を求めるチームには、Bifrostが最適なオープンソース代替です。 OSSプランは無期限で無料であり、Docker、Kubernetesワークロード、Goバイナリとして実行できます。

最適な用途: 耐障害性を明確に制御しながらセルフホストしたいプラットフォームチーム
特長: リクエスト単位のルーティング履歴を伴う、入れ子状の再試行とフォールバック
料金: OSS $0。Enterpriseは個別見積もり
無料トライアル: Enterpriseを14日間
Bifrostの料金ページによると、OSSには1,000+モデルに対応する1つのOpenAI互換API、OTelメトリクスとトレース、オブザーバビリティ、仮想キーごとの予算と制限、カスタムルーティング、自動フォールバック、キャッシュ、MCPゲートウェイが含まれます。Enterpriseでは、VPC、オンプレミス、エアギャップ環境へのデプロイ、クラスターモード、適応型負荷分散、SAMLとOIDC、Vault連携、監査ログ、RBAC、SLA付きサポートが加わります。
Bifrostの再試行とフォールバックのドキュメントは、挙動を非常に具体的に説明しています。ネットワークエラーと5xxレスポンスでは、同じプロバイダーを再試行します。レート制限やキー単位の失敗では、認証情報を切り替えられます。プライマリの再試行回数を使い切って初めて次のフォールバックへ進み、各フォールバックにはそれぞれ再試行の全枠が与えられます。
この明確さによって、別の壁も見えます。再試行回数が膨らむ可能性です。プライマリを3回再試行し、2つのフォールバックでもそれぞれ3回再試行すると、エラーを返すまで最大12回の試行が発生します。対話型アプリでは、プロバイダー障害がレイテンシー障害と請求増に変わりかねません。チェーン全体のレイテンシー上限を設定し、セキュリティやコンプライアンスのエラーではフェイルオープンせず、チェーンを止める必要があります。
Bifrostが最も直接競合するのはLiteLLMです。エコシステムの認知度と成熟したコントロールプレーンの広さではLiteLLMが優位です。Goネイティブの軽さ、明示的なルーティング履歴、再試行セマンティクスがチームの運用モデルに合うならBifrostが勝ります。どちらも、プロキシの担当者に予算が付かなければ適切ではありません。
- OSSプランが$0
- Docker、Kubernetes、Goバイナリのデプロイ方式
- OSSでOTel、予算、制限、キャッシュ、ルーティング、フォールバックを利用可能
- 再試行、キー切り替え、フォールバックのセマンティクスが具体的
- EnterpriseでプライベートデプロイとID制御を提供
- ゲートウェイとその障害ドメインは購入側が所有
- Enterprise料金は個別見積もり
- 入れ子状の再試行枠がレイテンシーと支出を増幅し得る
- LiteLLMよりエコシステムが小さい
7. Helicone:オブザーバビリティ重視なら最有力
セッションのデバッグと支出の説明がルーティングと同じくらい重要なら、Heliconeが最適です。 上乗せ0のゲートウェイに、オブザーバビリティ、キャッシュ、レート制限、自動フォールバック、プロンプト管理、リクエスト検索を統合しています。

最適な用途: 本番モデルの挙動を把握できないことが最大の課題になっているチーム
特長: ゲートウェイトラフィックが、そのままオブザーバビリティ/デバッグ製品に記録される
料金: Hobby無料、Pro $79/月、Team $799/月、Enterpriseは個別見積もり
無料トライアル: ProとTeamを7日間
料金ページでは、アップグレードが必要になる境界を把握できます。Hobbyには10,000リクエスト、1 GBのストレージ、1シート、1組織、保持期間7日間、ログ取り込み毎分10件が含まれます。Proは月額$79で、シート数は無制限、1組織、保持期間1か月、ログ取り込み毎分1,000件、API呼び出し毎分10件です。含まれるリクエスト数とストレージ量を超えると従量課金されます。
Teamは月額$799で、5組織、保持期間3か月、ログ取り込み毎分15,000件、API呼び出し毎分60件、SOC 2とHIPAA対応、専用Slackチャンネルが利用できます。Enterpriseは個別見積もりで、組織数は無制限、保持期間は無期限、ログ取り込み毎分30,000件、API呼び出し毎分1,000件、SAML SSO、オンプレミスデプロイ、独自の商用条件が加わります。
プラットフォームのドキュメントでは、2つの運用方式を説明しています。1つは100+モデルを上乗せ0のクレジットで利用する方式、もう1つはプロバイダーへの支払いを維持するチーム向けのBYOKです。どちらもリクエスト単位のオブザーバビリティを保ちます。薄いプロキシに対するHeliconeの優位性はここにあります。失敗したユーザー操作をセッション全体で追跡でき、単なるプロバイダーエラー件数に還元されません。
Hobbyではすぐに上限へ突き当たります。毎分10ログはプロトタイプの確認には十分でも、多くの本番アプリには少なすぎます。中程度のトラフィックを本番運用する現実的な境界は、毎分1,000ログのProからです。購入者はオブザーバビリティプランとゲートウェイを同時に選ぶため、ルーティングレイヤーを無料とみなさず、組み合わせた価値で比較する必要があります。
- 上乗せ0のクレジットまたはBYOK
- ゲートウェイ、フォールバック、キャッシュ、制限、オブザーバビリティを1つに統合
- プランと取り込み上限を公開
- Pro以上ではシート数無制限
- Enterpriseはオンプレミス対応
- Hobbyの毎分10ログという取り込み上限は小さい
- ProとTeamは含有量を超えると従量料金が加算
- Teamは月額$79から$799へ大きく上がる
- 単純なアプリにはオブザーバビリティ機能が過剰になり得る
8. Braintrust Gateway:評価結果でリリースを決めるチーム向け
トレースを評価、データセット、スコア、リリース判定へつなげる必要があるなら、Braintrust Gatewayが最適です。 キャッシュ、オブザーバビリティ、マルチプロバイダー対応を備えた統一APIから、OpenAI、Anthropic、Google、AWSなどのプロバイダーを利用できます。

最適な用途: 評価結果に基づいてルーティング変更を管理するAIプロダクトチーム
特長: ゲートウェイのトレースを評価プラットフォームへ直接接続
料金: Starter $0、Pro $249/月、Enterpriseは個別見積もり。Hosted Gatewayはベータ期間中無料
無料トライアル: Starterはクレジットカード不要。Gatewayはベータ期間中無料
Braintrustのプラットフォーム料金はStarter $0からです。処理データ1 GBを含み、超過分は1 GBあたり$4、スコア10,000件を含み、超過分は1,000件あたり$2.50、保持期間14日間です。ユーザー、プロジェクト、データセット、Playground、Experimentは無制限です。Proは月額$249で、処理データ5 GBを含み、超過分は1 GBあたり$3、スコア50,000件を含み、超過分は1,000件あたり$1.50、保持期間30日間です。追加保持データには1 GBあたり月額$0.50がかかります。Enterpriseは個別見積もりです。
ゲートウェイ自体は別の段階にあります。BraintrustのGatewayドキュメントでは、ホステッドエンドポイントはベータ期間中で無料、料金は一般提供前に発表予定としています。グローバルエンドポイントはDNSレイテンシールーティングとヘルスチェックを使って、ホストされたリージョンを選びます。ロギングを有効にすると、組織で設定したデータプレーンへゲートウェイトレースを書き込めます。
この統合によって、購入理由が変わります。本番トレースをサンプリングし、レスポンスを採点し、回帰データセットを作り、品質低下時にリリースを止めるチームなら、ゲートウェイによって計装の手順を省き、トラフィックに根拠をひも付けたままにできます。再試行と支出上限しか必要ないチームにとっては、月額$249のProプラットフォームを、より単純なゲートウェイより優先する根拠は弱いでしょう。
壁は将来の料金と、ベータであることです。無料ベータでも本番を想定した設計はできますが、安定した商用メーターはまだありません。プロバイダーへ直接接続する迂回路を設け、GA前に社内で許容料金の上限を決め、一時的なゲートウェイ料金$0で恒久的なアーキテクチャを決めないようにします。
- ゲートウェイトレースを評価、データセット、スコア、リリースワークフローへ接続
- 主要なプロバイダーファミリーへの統一アクセス
- ホステッドゲートウェイはベータ期間中無料
- グローバルなレイテンシールーティングとヘルスチェック
- StarterとProのプラットフォームプランはユーザー数無制限
- ホステッドゲートウェイは引き続きベータ
- 一般提供前にゲートウェイ料金が変わる
- 超過料金の前にProが月額$249
- ルーティングだけが必要なチームにはプラットフォームが過剰
9. Requesty:シンプルなパーセンテージ課金型コントロールプレーン
サブスクリプションなしでルーティング、キャッシュ、フォールバック、予算、EUデータレジデンシーを使いたい小規模チームには、Requestyが最適なパーセンテージ課金型のマネージド製品です。 Pay as you goでは、20+のプロバイダーが提供する600+のモデルを利用できます。

最適な用途: モデル利用額に直接連動する手数料を好むスタートアップ
特長: サブスクリプション、シート料金、最低利用額、コアルーティング制御の別料金がない
料金: Free $0。Pay as you goは5%加算。Enterpriseは個別見積もり
無料トライアル: 無料モデルを1日200リクエスト使える、カード不要のFreeプラン
料金ページによると、Freeでは無料モデルを1日200リクエスト利用でき、ルーティング、キャッシュ、フォールバック、支出分析、EUデータレジデンシーも含まれます。Pay as you goは基本モデル料金に5%を上乗せし、BYOK、ルーティングポリシー、キャッシュ、フォールバック、支出上限、MCP Gateway、高度なオブザーバビリティ、メールサポートを提供します。EnterpriseではSSO、RBAC、監査ログ、承認モデルのポリシー、チーム予算、ガードレール、PII検出、サービスアカウント、専任サポート、カスタムSLAが加わります。
パーセンテージ方式なので、初期の予算は簡単に計算できます。モデル利用額が$2,000なら手数料は$100、$20,000なら$1,000です。$24,000になると、説明用に置いたセルフホスト運用費の月額$1,200と同額になります。トラフィックが不確かな間はプラットフォーム開発を避け、利用量が安定した時点で判断を見直せます。
壁になるのは、そのわかりやすさと表裏一体です。ゲートウェイの運用負担が増えなくても、手数料はモデル利用額に比例して増えます。トークン支出が大きく、プラットフォームチームと既存のプロバイダー契約がある企業は、5%を無期限に受け入れる前に、RequestyのEnterprise見積もりかセルフホストプロキシと比較すべきです。
RequestyをHeliconeより下位にしたのは、差別化された本番エビデンスのループより、効率的なマネージド制御が強みだからです。それでも、深い評価機能やエンタープライズポリシーより、サブスクリプション不要で予測しやすい割合のほうが重要なら、Requestyが適切な購入になります。
- Pay as you goにサブスクリプション、シート料金、最低利用額がない
- 20+プロバイダーの600+モデル
- ルーティング、キャッシュ、フォールバック、予算、MCP、EUレジデンシー
- Freeプランはクレジットカード不要
- ID、監査、ポリシー、PII制御を備えたEnterpriseへの移行経路
- 5%の手数料がモデル利用額に直接比例して増える
- Enterprise料金は個別見積もり
- Freeのトラフィックは無料モデルで1日200リクエストまで
- プロキシを運用できるプラットフォームチームに予算が付くと魅力が下がる
10. Kong AI Gateway:既存のKong環境に最適
社内APIをすでにKongで統制し、AIトラフィックにも同じ運用モデルを引き継ぎたい場合は、Kong AI Gatewayが最適です。 PlusにはユニバーサルLLM API、最大5つの一意なプロキシ対象モデル、無制限のエージェント間トラフィック、無制限のMCPサーバープロキシ、PIIサニタイズ、ガードレール、アクセス制御、トークンレート制限、セマンティックキャッシュ、コスト分析が含まれます。

最適な用途: Kong KonnectまたはKong Gatewayをすでに運用しているエンタープライズ
特長: API、ID、ポータル、サービスガバナンスを含む広範なプラットフォーム内でAIポリシーを適用
料金: 30日間のトライアルは$0。Plusは従量課金。Enterpriseは年間の個別見積もり
無料トライアル: クレジットカード不要で30日間、ゲートウェイ上限なし
Kongの公開料金ページには、Plusの各メーターが示されています。Serverlessコントロールプレーンは月額$25、Hybridは$200、Dedicated Cloudは$500に1 GBあたり$0.15が加わります。Plusには100万APIリクエストが含まれ、以降は100万件追加ごとに$200、月間上限は1,000万件です。
AIモデルのプロキシには、一意なLLMモデルごとに月額$100が別途かかり、Plusでは最大5モデルです。したがって、Serverlessコントロールプレーン1つで4モデルを使うアプリは、モデルトークン料金の前に月額$425から始まります。内訳はコントロールプレーン$25と、4つのモデルプロキシで$400です。有料AIプラグインはPlusでは別のアドオン、Enterpriseでは含まれます。
Enterpriseではゲートウェイ数とモデル数の上限がなくなり、完全なセルフホスト型APIゲートウェイに対応します。監査ログ、SSO、専任サポート、プロフェッショナルサービス、より高いSLAも加わります。料金は個別見積もりで、年払いです。
壁になるのはプラットフォームの重さです。APIガバナンス、コントロールプレーン、ID、分析、サービスカタログ、サポートがすでに予算化されているならKongは合理的です。新規のマルチモデルアプリでは、製品側で必要性を証明する前から、コントロールプレーン、モデル、リクエスト単位の支払いという概念が増えます。Vercel、Cloudflare、Requesty、またはOSSプロキシなら、より小さな判断から始められます。
- 既存のKongによる制御とサポートの運用モデルに適合
- ポリシー、キャッシュ、ガードレール、コスト分析を備えたユニバーサルLLM API
- Serverless、Hybrid、Dedicated Cloud、Enterpriseのセルフホストという選択肢
- 公開されたPlusのメーターから基本構成の料金を計算可能
- エンタープライズ向けの強力なIDと監査の経路
- Plusではプロキシ対象モデル1つにつき$100
- Serverlessで4モデルを使う例は、推論料金の前に$425から
- PlusのAIプロキシは5モデル、トラフィックは1,000万リクエストが上限
- 新規導入の標準にするには過剰で高価
結局、どのAIゲートウェイを誰が選ぶべきか
まずローンチを止める制約から候補を絞り、その後で手数料を比較します。 どれほど高度なルーティングでも、デプロイ境界が要件と合わなければ意味がありません。料金が安くても、監査やロールバックの制御が欠けていれば同様です。
承認済みモデルが少数で、プライベートデプロイ要件のない顧客向けアプリを出すスタートアップには、Vercel AI Gatewayが向いています。Cloudflareがすでにエッジとセキュリティを担っているならCloudflareへ、プラットフォームのサブスクリプションより5%の従量手数料を予算化しやすいならRequestyへ判断が変わります。
プラットフォーム担当者がいて、コンテナとデータベースの標準を持ち、データ経路に厳格な要件があるか、前述の運用前提で月間モデル利用額が約$22,000〜$24,000を超えつつあるプロダクト企業には、LiteLLMが適しています。Bifrostの再試行セマンティクス、Goデプロイ、OTel優先の設計がチームに合うなら、Bifrostへ判断が変わります。
マネージドID、ガードレール、予算、保持期間、プライベートデプロイの選択肢、サポートを必要とするミッドマーケット/エンタープライズには、Portkeyが適しています。Kongがすでに社内APIプラットフォームであり、制御の統合にモデル単位の料金を上回る価値があるならKongを選びます。
リクエスト調査、セッションのデバッグ、支出の帰属が日常業務なら、Heliconeを選びます。同じトレースを評価とリリース判定へ流す必要があるなら、**Braintrust Gateway**です。Braintrustはベータであるため、直接接続の迂回路と社内の料金上限が必須です。
小規模な技術チームが多数のモデルを比較している間、またはプロバイダーマーケットプレイスの広さが必要な間は、OpenRouterを選びます。プロバイダーへの直接接続ルートも維持してください。アプリが少数の承認モデルに固まったら、5.5%のクレジット手数料を、Vercelのトークン上乗せ0、Requestyの5%、予算を付けたセルフホスト運用と比較します。

乗り換え条件は明快です。不足している制御や発生しているコストが、次の選択肢への移行・運用負担を上回ったときにゲートウェイを変えます。 競合の機能一覧が長いという理由だけで移行してはいけません。現在のゲートウェイが、測定済みのレイテンシー目標、デプロイ境界、監査要件、手数料上限、離脱目標を満たせなくなったときに移行します。
本番環境で単独ルートにすべきでない選択肢
商用条件や運用境界が変動中のゲートウェイを、唯一の本番ルートにするのは避けてください。 特に3製品は、それぞれ異なる理由で注意が必要です。
報道された所有者変更の最中に、OpenRouterだけを本番ルートにすることは避けます。カタログとルーティングは依然として優れており、条件が悪化すると断定できる根拠はありません。問題は依存の集中です。モデルアクセス、プロバイダーポリシー、クレジット、フォールバックの挙動が、すべて同じアカウントの背後にあります。少なくとも1つのプロバイダー直接接続キーと、テスト済みの外部アダプターを維持します。
Braintrust Gatewayがベータである間は、唯一のルートにしないでください。 Braintrustは、ホステッドゲートウェイを本番向けに設計し、稼働率を公開追跡し、ベータ期間中は無料だと説明しています。同時に、料金は一般提供前に発表予定とも述べています。$0はパイロット料金として扱い、どの料金で移行するかを事前に決め、迂回路を常に使える状態にします。
社内でKongをまだ運用していないなら、Kong AI Gatewayを新規開発の標準にすることは避けます。Serverless Plusコントロールプレーン1つで4モデルをプロキシすると、推論料金の前に月額$425から始まり、KongのコントロールプレーンとAPIプログラムの概念も導入することになります。既存のKong利用企業には優れた統合になり得ますが、新規アプリには不要なプラットフォーム負荷です。
また、複数のアプリが依存する段階になった自作パススルーも避けます。ベースURLだけのプロキシは簡単です。しかし、ストリーミング、エラーの正規化、プロバイダー固有パラメーター、フォールバック、予算、キーの分離、ログ、モデル廃止への正しい対応まで含めると、保守を要する製品になります。独自ポリシーに恒久的な運用責任を負う価値がある場合だけ自作してください。
次の月曜に行うこと:AIゲートウェイを迂回できると証明する
来週いきなり全社移行を始めてはいけません。本番を想定した1つのルートから始め、「10分で離脱」できることを実証します。 得るべき成果は、きれいなアーキテクチャ図ではなく、測定に基づく運用判断です。
1つのルートを棚卸しする
顧客向けワークフローを1つ選び、現在のプロバイダー、モデル、認証方式、月間支出、p95レイテンシー目標、構造化出力またはツールの要件、データポリシーを記録します。難所が見える程度に代表的で、ロールバックできる程度に小さいルートを選びます。
内部クライアントの背後にゲートウェイを置く
リクエスト経路へ入れるのはゲートウェイアダプターだけにします。プロバイダー固有のヘッダー、モデルエイリアス、フォールバックポリシーをビジネスロジックへ持ち込まないでください。従来の直接接続設定を、ゲートウェイ設定の隣に保存します。
プライマリ1つと互換フォールバック1つを設定する
最初からルーティングツリーを作ってはいけません。同じレスポンスプロトコル、構造化出力、ツール、データ境界に対応するフォールバックを選びます。再試行チェーン全体に総レイテンシー上限を設けます。
意図的に障害を起こす
管理された時間帯にプライマリを無効化するか、誤ったルートへ向けます。何回試行され、どれが課金され、どのプロバイダーが応答し、チェーンにどれだけ時間がかかり、アプリが期待するスキーマを受け取ったか確認します。
「10分で離脱」を実行する
設定変更と管理されたデプロイによってゲートウェイを迂回します。10分以内に直接接続ルートへ戻せない場合は、妨げた依存関係を記録し、展開範囲を広げる前に修正します。
判断を変えた制御機能だけに費用を払う
リクエストを救済した、ポリシーを適用した、支出の所有者を明らかにした、デプロイ境界を満たした、測定可能な運用費を下げた、のいずれかを実現した場合だけ導入します。誰も見ないダッシュボードは本番成果ではありません。
多くの小規模プロダクトチームでは、月曜のパイロットにVercel AI Gatewayを使い、要件が生まれるまで有料アドオンを付けないのが妥当です。厳格なプライベート境界を持つプラットフォームチームはLiteLLMを使い、トラフィックを流す前に担当者を決めます。エンタープライズガバナンスのプロジェクトでは、保持期間、ID、デプロイ、サポート、離脱条件のすべてがアーキテクチャに影響するため、調達と技術検証を並行して始めます。
買収報道は検討のきっかけであって、結論ではありません。本当に問うべきなのは、次にモデル、プロバイダー、ゲートウェイを変更するとき、書き直しや緊急予算ではなく、管理された設定変更として処理できるかどうかです。
よくある質問
最もおすすめのLLMゲートウェイはどれですか?
運用できるプラットフォーム担当者がいて、デプロイを自社で制御したいなら、総合首位はLiteLLMです。マネージド型の第一候補はVercel AI Gatewayです。マネージド型のエンタープライズガバナンスではPortkeyが優れ、幅広いモデル探索が主目的の間はOpenRouterが優れています。
AIゲートウェイにはどのような製品がありますか?
現在の例として、LiteLLM、Vercel AI Gateway、Portkey、Cloudflare AI Gateway、OpenRouter、Bifrost、Helicone、Braintrust Gateway、Requesty、Kong AI Gatewayがあります。セルフホストプロキシ、マネージドゲートウェイ、モデルマーケットプレイス、オブザーバビリティ中心のプラットフォーム、エンタープライズAPIプラットフォームという各タイプを含みます。
オープンソースで最もおすすめのAIゲートウェイはどれですか?
$0のプランで100+プロバイダー、仮想キー、予算、レート制限、フォールバック、ログ、Prometheusを利用できるため、オープンソースの第一候補はLiteLLMです。明示的な入れ子状の再試行、Goバイナリ、OpenTelemetry実装が決め手なら、Bifrostがより適しています。
スタートアップとエンタープライズでは、選ぶAIゲートウェイが違いますか?
スタートアップは通常、社内プラットフォーム業務を増やさずに済むVercel、Cloudflare、Requestyから始めるべきです。エンタープライズはガバナンスとデプロイ境界で選びます。マネージド制御ならPortkey、自社インフラならLiteLLMまたはBifrost、組織がすでにAPIトラフィックをKongへ標準化しているならKongです。
2026年9月3日







