米Google Cloudは、API管理サービス「Google Cloud API Gateway」において、複数のAI基盤モデルへのリクエストを動的に振り分ける「モデルルーティング」機能のパブリックプレビューを開始しました。
本機能により、開発者はクライアント側で独自プロキシを構築したり接続エンドポイントを固定コーディングすることなく、Gemini、Anthropic Claude、OpenAI互換モデル、OSSモデル間でのインテリジェントなトラフィック制御が可能になります。
標準プロトコルとしてOpenAI互換RESTインターフェースを採用し、ゲートウェイ層でGemini Enterprise Agent Platform等の特定ターゲット形式へリクエストを自動トランスコード。
OpenAPI 3.x仕様書内で専用拡張タグを記述するだけで、コスト最適化やレイテンシ低減、障害時の自動フォールバックルールを柔軟に定義できます(一次ソース:Google Cloud 公式ブログ / ドキュメント)。
