Gemini を使用して GKE クラスタを設計、最適化する

このドキュメントでは、Gemini にプロンプトを入力して クラスタ を計画、設計する方法について説明します。

Compute Advisor は、 Google Cloud コンソールにある Gemini を搭載した AI 搭載インターフェースです。ハードウェアのオプションの評価、 デプロイ費用の見積もり、クラスタの推奨構成の表示に役立ちます。 Gemini は、推奨事項を調整するために、割り当て上限、既存の予約、確約利用割引(CUD)、デフォルトのリージョンとゾーン、リソースのロケーション制約を確認してプロジェクトを評価します。 Google CloudGemini を使用して計画を立てることで、GKE クラスタを作成または変更する前に、ワークロードの最適な構成に到達できます。

GKE クラスタの作成前または作成時に構成する必要があるコンポーネントの詳細については、GKE の概要をご覧ください。

制限事項

コンソールで Gemini にプロンプトを入力しても、Gemini を使用してリソースを作成、変更、削除することはできません。 Google Cloud

始める前に

コンソールを使用してサービスと API にアクセスする場合、認証を設定する必要はありません。 Google Cloud Google Cloud

必要なロール

Gemini にアクセスしてプロンプトを入力するために必要な権限を取得するには、プロジェクトに対するKubernetes Engine クラスタ閲覧者 roles/container.clusterViewer)IAM ロールを付与するよう管理者に依頼してください。ロールの付与については、プロジェクト、フォルダ、組織に対するアクセス権の管理をご覧ください。

この事前定義ロールには Gemini にアクセスしてプロンプトを入力するために必要な権限が含まれています。必要とされる正確な権限については、必要な権限セクションを開いてご確認ください。

必要な権限

Gemini にアクセスしてプロンプトを入力するには、次の権限が必要です。

  • クラスタの一覧を表示するには: container.clusters.list

カスタムロールや他の事前定義ロールを使用して、これらの権限を取得することもできます。

コンソールで Gemini にアクセスする Google Cloud

コンソールで Gemini にアクセスする手順は次のとおりです。 Google Cloud

  1. コンソールで、[概要] ページに移動します。 Google Cloud

    [概要] に移動

  2. [Compute Advisor でインフラストラクチャを設計] セクションで、次の情報を確認できます。

    Compute Advisor ページとその UI 要素のスクリーンショット。

    上のスクリーンショットに表示されている UI 要素は次のとおりです。

    • クイック アクション プロンプト カード: サンプル プロンプトを含むカードのセット。カードをクリックすると、 Google Cloud プロンプト ボックスにサンプル プロンプトが自動的に 入力されます。

    • プロンプト ボックス: このフィールドでは、プロンプトを入力して送信できます。プロンプトを送信するには、[プロンプトを送信] をクリックします。

    • 以前の会話を表示: この機能を使用すると、過去の会話の詳細 を表示して再開したり、不要になった会話を削除したりできます。

    • 会話履歴サイドパネル: 最近のチャットが表示されます。このパネルは、[概要] ページからプロンプトの入力を開始した後にのみ表示されます。 このパネルは次のように操作できます。

      • 新しい会話を開始するには、[新しいチャット] をクリックします。

      • 最近の会話を再開するには、[最近のチャット] セクションで会話をクリックします。

      • すべての会話の一覧を表示するには、[すべて表示] をクリックします。[マイ履歴] ページで、過去の会話の詳細を表示して再開したり、不要になった会話を削除したりできます。

Gemini に指示を出す

プロンプトを送信すると、Gemini はレスポンスの生成を開始します。 ペインが表示され、 Google Cloud 次のスクリーンショットに示すように、プロンプトに対するレスポンスが ペインに表示されます。

プロンプトを送信した後の Compute Advisor ページのスクリーンショット。

プロンプトに基づいて、レスポンス ペインには次の要素が含まれます。

  • コンテキストに基づくグラウンディング: Gemini はプロジェクトのコンテキストを自動的に評価し、割り当て上限、既存の予約、CUD、デフォルトのリージョンとゾーン、リソースのロケーション制約など、高度にカスタマイズされた推奨事項を提供します。

  • インタラクティブなコード スニペット: Gemini は gcloud コマンド、REST API メソッド、Terraform リソースを生成します。これらのコード スニペットをコピーして貼り付けるか、Cloud Shell で実行できます。

  • ビジュアル キャンバス: Gemini は、推奨事項を 構造化されたテーブルと並列比較に整理します。このビューは、プロダクト機能とアーキテクチャ アプローチを評価するのに役立ちます。また、ユースケースの実装計画も提供します。

以降のセクションでは、プロンプトを作成する際のベスト プラクティスと、 GKE クラスタを作成または変更する前に使用できるプロンプトの例について説明します。

プロンプトのベスト プラクティス

Gemini から最も正確で実用的な推奨事項を得るには、コードブロックと同じ方法でプロンプトを構造化することをおすすめします。このアプローチでは、明確なパラメータ宣言、ロール定義、具体的な指示、明示的な出力形式を使用して、生成 AI をガイドします。

Gemini にプロンプトを入力する際は、次のベスト プラクティスを検討してください。

  • 設計と計画に重点を置く: GKE クラスタのエラーのトラブルシューティングについて Gemini にプロンプトを 入力することをおすすめしません。これらのエラーを解決するには、代わりに GKE のトラブルシューティングをご覧ください。

  • ペルソナまたはロールを指定する: Gemini が採用するターゲット ロールまたはペルソナ( IT 管理者、AI 研究者、プラットフォーム エンジニアなど )を宣言します。このアプローチにより、推奨事項のトーン、深さ、専門知識のレベルがガイドされます。

  • 明示的な番号付きの指示を提供する: 目標を 具体的なステップバイステップの質問またはタスクに分割します。このアプローチにより、Gemini の推論プロセスが構造化され、Gemini がすべての要件に対応できるようになります。

  • 特定の出力形式を定義する: 推奨事項の形式(ウォークスルーの説明、Markdown 比較表、すぐに使用できる gcloud コード ブロックなど)を明示的に指定します。

  • 自動コンテキスト グラウンディングを活用する: デフォルトのリージョンまたはゾーン、利用可能な割り当て、CUD、リソースのロケーション 制約をプロンプトに含める必要はありません。Gemini は、 プロジェクト内のこの 情報にアクセスできます。 Google Cloud

  • 設計を反復的に改善する: 新しいプロンプトを送信することで、Gemini が生成したレスポンス を変更または拡張できます。たとえば、新しい会話を開始せずに、デプロイ プランにネットワークの推奨事項を追加したり、ストレージ要件を変更したりできます。

プロンプトの例

GKE クラスタの設計と最適化に役立つプロンプトの例を次に示します。

  • クラスタ トポロジとノードプール構成: ワークロードに最適な GKE モード、マシンタイプ、ノードプール構成を決定するには、次のような プロンプトを使用します。

    Act as a cloud architect. I need to design a GKE cluster topology for a
    scalable microservices application that requires both GPU nodes for AI
    inference and CPU nodes for general-purpose APIs.
    
    Please provide the following:
    1. A comparison of running this workload on GKE Autopilot versus GKE Standard.
    2. Recommendations for GKE machine types for the GPU node pool.
    3. The optimal autoscaling and auto-provisioning settings.
    
    Format the comparison as a Markdown table, and provide the cluster creation
    steps as a ready-to-use gcloud CLI command.
    
  • プロビジョニング モデルと費用最適化: プロビジョニング モデルを評価し、バッチ処理ワークロードのリソース使用率を最適化するには、 次のようなプロンプトを使用します。

    Act as an IT administrator. I need to design a cost-optimized GKE cluster
    to run large-scale batch processing workloads that are fault-tolerant.
    
    Please provide the following:
    1. A cost and reliability comparison of using Spot VMs versus standard VMs
       in GKE node pools.
    2. An explanation of how to configure Kueue for queueing training jobs.
    3. A manifest snippet configuration to deploy the workloads onto Spot VM nodes.
    
    Format the comparison as a Markdown table, and provide the manifest as a
    ready-to-use code block.
    

次のステップ