Gemini Enterprise Agent Platform の RAG Engine のデプロイモード

Gemini Enterprise Agent Platform の RAG Engine には、RAG インスタンスを運用するためのさまざまなデプロイ モードが用意されています。デプロイ モードの選択によって、データの保存場所、データの増加に伴うストレージのスケーリング方法、必要なインフラストラクチャ管理のレベルが決まります。これらのモードの動作を理解することで、プロジェクトのシンプルさ、スケーラビリティ、費用のバランスを適切に選択できます。

RAG Engine には、サーバーレスと Spanner の 2 つのデプロイモードがあります。両方のモードをシームレスに切り替えることができます。各モード内のデータは、他のモードから分離されたままになります。

利用可能なデプロイモード

このセクションでは、RAG Engine で使用できる 2 つのデプロイ モードについて説明します。

サーバーレス モード

サーバーレス モードは、RAG Engine を使い始める際におすすめの最も費用対効果の高い方法です。すべてのデータベースのプロビジョニングとスケーリングを抽象化する、フルマネージドのプラネットスケールのエンタープライズ対応データベースを提供します。

  • 最適な対象: ほとんどのユーザー、迅速なオンボーディング、インフラストラクチャ構成の管理を必要としないシームレスなスケーリング。
  • 主な機能: 階層管理は不要です。RAG Engine マネージド ベクトル検索をデフォルトのベクトル データベースとして自動的に使用し、合理化されたすぐに使用できる RAG エクスペリエンスを提供します。

サーバーレス モードでは、RAG マネージド データベースは RAG ビジネス オペレーションの管理と RAG リソースの保存に使用されます。これらのリソースには、RagCorpusRagFilesRagMetadataDataSchema などが含まれますが、これらに限定されません。ただし、埋め込みインデックス登録とベクトル検索には使用できなくなりました。

ユーザーは常に別のベクトル データベースを個別に選択する必要があります。サーバーレス モードでは、デフォルトで、RAG Engine はエンベディングのインデックス登録とベクトル検索用にプロジェクトにベクトル検索 2.0 コレクションをプロビジョニングします。Spanner モードと比較して、プロジェクトでベクトル検索 2.0 をプロビジョニングすると、ベクトル DB の使用量と費用を完全に可視化して制御できます。詳細な比較については、Spanner モードとサーバーレス モードをご覧ください。

Spanner モード

Spanner モードは、RAG Engine デプロイの基盤として機能するように、専用の Spanner インフラストラクチャを割り当てます。これは、特定のコンプライアンス機能(CMEK など)または専用の分離されたデータベース インスタンスを必要とするワークロード用に設計されています。モードの選択が明示的に選択されていない場合、Spanner モードがデフォルトとして割り当てられます。

Spanner モードを使用する場合は、パフォーマンス ティアを選択してインフラストラクチャを管理する必要があります。

  • ベーシック ティア(デフォルト): 固定された費用対効果の高い低コンピューティング ティア。テスト、小規模なデータサイズ、レイテンシの影響を受けないワークロードに適しています。
  • スケーリング ティア: 自動スケーリング機能により、本番環境規模のパフォーマンスを提供します。大量のデータを処理するワークロードやパフォーマンスが重要なワークロードに適しています。

データの分離とモードの切り替え

RAG Engine を使用すると、アクティブなデプロイ モードで進行中のオペレーションがない限り、プロジェクトのデプロイ モードを切り替えることができます。両方のモードでデータを取得できます。ただし、一度に有効にできるモードは 1 つのみで、データはデプロイ モード間で厳密に分離されます。

便利なツールとして、プロジェクトに 2 つの完全に分離されたバックエンドがあるかのように動作すると考えてください。作成したリソース(コーパス、インポートおよびアップロードされたファイル、解析されたエンベディング)は、作成時にアクティブだったデプロイモードに永続的に関連付けられます。直接または Gemini を介して行われた取得リクエストも、現在のデプロイモードで利用可能なコーパスとファイルに限定されます。2 つのモードを切り替えても、データが移動したり、他のモードのデータが削除されたりすることはありません。

/gemini-enterprise-agent-platform/images/rag-engine-deployment-modes.png

図に示すように:

  • 統合 API: まったく同じ Agent Platform RAG API を使用して、リソースを作成および管理します。API は、アクティブなデプロイモードに関連付けられたバックエンドにリクエストを自動的に転送します。
  • 可視性: サーバーレス モードが有効になっている場合、アプリケーションは RagCorpus A と B のみを認識して操作できます。Spanner モードで作成された RagCorpus C は安全に保存されますが、プロジェクトのモードを Spanner に戻すまで、アプリケーションから完全に隠され、アクセスできません。
  • データ損失なし: モードを切り替えてもデータは削除されません。API が参照する「バックエンド」を変更するだけです。

デプロイモードを管理する

デプロイモードはプロジェクト レベルの設定です。現在のモードは、GetRagEngineConfig API と UpdateRagEngineConfig API を使用して表示または変更できます。デプロイモードの切り替え方法と、Spanner モードに適した階層の選択方法については、モードの切り替えページをご覧ください。

データを削除して課金を停止する

データはモード間で分離されているため、リソースのクリーンアップと課金の停止のプロセスは、データの保存場所によって若干異なります。

  • サーバーレス データを削除するには: アクティブ モードがサーバーレスに設定されていることを確認します。ListRagCorpora API を呼び出してリソースを表示し、DeleteRagCorpus API を使用して各コーパスを手動で削除します。
  • Spanner データを削除する(プロビジョニング解除)には: アクティブ モードが Spanner に設定されていることを確認します。RagEngineConfig を更新し、Spanner 階層を Unprovisioned に設定します。これにより、専用の Spanner インスタンスと、その中に保持されているすべての RAG データが直ちに削除され、Spanner モードに関連する課金が停止します。注: プロビジョニング解除階層を使用して削除されたデータは復元できません。

Spanner モードとサーバーレス モード

機能 サーバーレス モード Spanner モード
費用
  • リソース管理とオーケストレーションは無料です。
  • ベクトル DB はユーザーの選択に応じて直接課金されます。
  • 料金は選択した階層によって異なります。リソース管理とオーケストレーションが含まれます。
  • ベクトル データベースの選択肢として RagManagedDb を使用するすべてのコーパスのベクトル DB の費用が対象となります。
  • 残りのコーパスについては、ユーザーが選択したデータベースに応じてベクトル DB の料金が直接請求されます。
スケーリング フルマネージド自動スケーリング ティアの選択を構成する必要がありますが、自動スケーリング ティアが用意されています。
分離 ストレージが分離されていない ストレージとパフォーマンスの分離を提供します。
CMEK 現時点では CMEK はありません CMEK のサポートあり
VPC Security Controls サポート対象 サポート対象
サポートされているベクトル DB
  • Managed Vector Search 2.0(デフォルト)
  • Pinecone
  • Weaviate
  • RagManagedDb(デフォルト)
  • マネージド ベクトル検索 2.0
  • ベクトル検索 1.0
  • Pinecone
  • Weaviate

次のステップ