マイクロソフトのAIゲートウェイ階層が議論を呼ぶ:統合ガバナンスの背後にある権限懸念
Microsoft
OpenAI
Anthropic
Mistral
Amazon Web Services
Google/DeepMind
Databricks
マイクロソフトは、Azure API Management AIゲートウェイ階層のパブリックプレビューを公開しました。これは、APIではなくモデル、MCPサーバー、ツールを中心に編成された新しいゲートウェイリソースです。この階層は、単一のコントロールプレーンから複数のAIプロバイダーを管理することを目的としていますが、専門家はガバナンスの境界、キーの範囲、既存のセットアップとの共存について疑問を呈しています。
マイクロソフトは、Azure API Management向けの専用AIゲートウェイ層のパブリックプレビューをリリースしました。このゲートウェイリソースは、APIではなくモデル、MCPサーバー、ツールを中心にコントロールプレーンを編成し、スタンドアロン体験として構築されていますが、クラシック層とv2層は既存のAIゲートウェイ機能を維持しています。プレビューでは、Foundryでホストされているモデル(OpenAI、Anthropic、Mistralなど)に加え、AWS Bedrock、Google Vertex AI、OpenAIのモデルも直接公開できます。すべてのOpenAI互換プロバイダーは単一のエンドポイントパスを共有し、正確なモデルフィールドの一致に基づいてルーティングされるため、各公開モデルには一意の名前が必要です。Anthropicは、Messages APIを通過するカスタムプロバイダーを介して処理されます。ポリシーは、XMLや式ではなくポータル内のカードを介して構成され、トークンとリクエストの制限、クォータ、コンテンツの安全性、モデルのフェイルオーバーをカバーします。テレメトリは、OpenTelemetryトークンメトリクスとしてApplication Insights、Datadog、Grafana、その他の顧客管理の宛先にエクスポートされ、リソースは顧客自身のサブスクリプションとEntraテナントで実行されます。ツールに関しては、ゲートウェイは3つのソースからのバックエンドを統合します:URLで接続されたリモートMCPサーバー、OpenAPI仕様、またはホスト型サーバーを必要とせずに1,000以上のSaaSアプリケーションをカバーする組み込みコネクタです。各バックエンドの操作はツールになり、チームはバックエンドごとに認証を選択できます:なし、APIキー、OAuth 2.0、またはマネージドID。意図された運用モデルは、中央管理とチームのセルフサービスを分離します:プラットフォームチームが承認されたモデルとツールを接続して公開し、アプリケーションチームは中央チームを経由せずにテストコンソールでこれらの資産を使用しますが、プラットフォームチームは引き続きガードレールと全体的な使用状況を管理します。アーキテクトとプラットフォームエンジニアは概して肯定的に応じましたが、ガバナンスの境界がどこにあるかについて疑問を提起しました。AIエンジニアのニュースレター著者であるPaolo Perrone氏は、ゲートウェイに配置されたコストガバナンスは過小評価されており、「アプリごとのパッチではなくコントロールプレーン」と呼びました。エンタープライズAIアーキテクトのAdolph White Jr.氏は、エージェントの実行が適切に終了しない場合に何が起こるかという最も鋭い未解決の質問を提起し、出力が監査用に保持されるかどうか、フェイルオーバーと再試行が発生するかどうかを尋ね、AIトラフィックのガバナンスと完全なライフサイクルのガバナンスを区別しました。発表では、エージェント出力の制御がゲートウェイに属するのか、その上のオーケストレーション層に属するのかは指定されていません。すべてのフィードバックが肯定的だったわけではありません。Aer LingusのSreenivasulu Kandakuru氏は、この層は緊急に必要であるが、AzureはAWSやDatabricksに遅れをとっていると述べ、6月のData + AI SummitのUnity AI Gatewayを挙げました。これはUnity Catalogを拡張してモデル、エージェント、MCPサービス、スキルをガバナンスし、ハードな支出上限、スマートルーティング、コンテンツガードレールを備え、Claude CodeやCodexなどの外部コーディングエージェントをルーティングします。マイクロソフトは約2年間AIゲートウェイ機能を備えているため、実際のギャップは比較が示すほど大きくありません。検討に値する設計上の決定:ランタイムアクセスキーはゲートウェイ全体にスコープされ、その上のすべてのモデルとツールにアクセスできます。マイクロソフトはアプリごとに1つのキーを推奨していますが、キーの漏洩はゲートウェイ全体に影響します。APIMサブスクリプションに依存してユーザーを一連のAPIに制限しているチームは、ここではその境界を見つけることはできません。プレビューはベストエフォートであり、SLAはなく、API、テレメトリ、制限、リージョン、価格は一般提供前に変更される可能性があります。プレビューのクォータは、モデル、ツール、ランタイムキー、スループットを制限しますが、詳細はまだ公開されていません。価格は後日提供されるため、コストガバナンスが最も不確実な部分です。重要な未回答の質問は共存です。そして混乱はすでに明らかです:AIエンジニアのRajib Mahapatro氏は、キャッシュ、コンテンツの安全性、ログ、トークン制限に言及し、4か月間本番環境で使用していると応答しましたが、これらは既存の機能です。マイクロソフトのドキュメントでは、AIゲートウェイは既存のAPI Managementゲートウェイの拡張として説明されており、スタンドアロン製品ではありません。既存のPremiumまたはStandard v2の投資が継承されるのか、並行して実行されるのか、移行されるのかについての公開ガイダンスはありません。AI Gateway層はEast US 2とSweden Centralで利用でき、プレビュー期間中は無料で、ガバナンスされたFoundryモデルの公開とトークンレート制限の監視に関する実験的なチュートリアルが提供されています。
出典: InfoQ 中国 —
原文
