Interactions API の概要

Interactions API は、Gemini Enterprise Agent Platform でホストされている Gemini モデルとエージェントを使用して、生成 AI アプリケーションとエージェント ワークフローを構築するための統合されたステートフル インターフェースを提供します。既存の generateContent API と機能が重複していますが、generateContent API は引き続き完全にサポートされます。

Interactions API を使用する理由

Interactions API には、生成 AI アプリケーションとエージェント ワークフローを構築するうえで、次のような重要なメリットがあります。

  • モデルとエージェント用の単一の API: 標準の Gemini モデルと特殊なエージェント(Gemini Deep Research エージェントやカスタム マネージド エージェントなど)を直接呼び出すための、統合されたエンドポイントとパターン。
  • すぐに使える新機能: previous_interaction_id を使用したオプションのサーバーサイド会話状態、デバッグと UI レンダリング用のオブザーバブル実行ステップ、background=true を使用した長時間実行タスクのバックグラウンド実行などの機能。
  • 新機能のリリース場所: 今後は、新しいモデル、マルチモーダル機能、ツール、エージェント機能はすべて Interactions API でサポートされます。

Interactions API の仕組み

Interactions API は Interaction リソースを中心に構成されています。Interaction は、会話またはタスクの完全なターンを表し、実行 steps の時系列シーケンスを含むセッション レコードとして機能します。

  • user_input: ターンに提供される入力メッセージ、マルチモーダル ファイル、ツール結果。interactions.get で取得した保存済みインタラクションには、完全なコンテキストの user_input ステップが含まれます。一方、interactions.create レスポンスは、そのターンの間に生成されたステップのみを返します。
  • thought: モデルまたはエージェントがレスポンスを計画する際に生成する中間推論の要約。
  • ツール呼び出しと結果のステップ: クライアントサイドまたはサーバーサイドのツール呼び出しと出力(function_call や function_result など)。
  • model_output: モデルまたはエージェントによって生成された最終的なテキスト、構造化 JSON、またはマルチモーダル コンテンツ。

interactions.create を呼び出すと、Agent Platform は入力を処理し、構成されたサーバーサイド ツールまたはエージェント ループを実行して、結果の Interaction リソースを返します。

サポートされているモデル

次の Gemini モデルは Interactions API をサポートしています。

クリックして、サポートされているモデルを開く

上記のモデルに加えて、Interactions API は次の特殊なマルチモーダル モデルと音声生成モデルをサポートしています。

  • gemini-omni-flash-preview: 会話型動画の生成、編集、シネマティックな制御のための高性能マルチモーダル モデル。
  • lyria-3-clip-preview と lyria-3-pro-preview: 高音質の音声クリップとフルソングの作曲用の生成音楽モデル(ステートレス インタラクションでのみ store=false でサポート)。

サポートされているエージェント

Interactions API を介して次のエージェントを呼び出すには、model の代わりに agent パラメータを指定します。

  • antigravity-preview-05-2026: 複数ステップの推論、コーディング、ファイル オペレーション、ツールの使用のために設計された汎用自律エージェント。
  • deep-research-preview-04-2026: 自律型のマルチステップ ウェブ検索と合成用に設計された Gemini Deep Research エージェント。
  • Agent Platform にデプロイされたカスタム マネージド エージェント。

機能と仕様

以降のセクションでは、Interactions API のコア機能、技術仕様、運用上の考慮事項について説明します。

状態管理

デフォルトでは、Interactions API はリクエストを保存するため、previous_interaction_id を使用してサーバーサイドの状態管理機能を活用できます。store=false を設定すると、ステートレス動作を有効にできます。

サポートされているツールとグラウンディング

Interactions API の Gemini 3 モデルでは、次の組み込みツール、グラウンディング プロバイダ、検索機能がサポートされています。

  • Google 検索によるグラウンディングとWeb Grounding for Enterprise: Google 検索または Web Grounding for Enterprise のリアルタイム ウェブ情報を使用して、モデルのレスポンスをグラウンディングします。
  • Gemini Enterprise Agent Platform のエージェント検索と RAG Engine: エージェント検索と RAG Engine を使用して、非公開のエンタープライズ データストアとドキュメント リポジトリに対してモデルの回答をグラウンディングします。
  • xAI 検索: モデルをリアルタイムのソーシャル検索と知識グラウンディングに接続します。
  • 並列検索: Parallel Web Systems の検索 API によって提供されるリアルタイムの一般公開ウェブデータを使用して、モデルの回答をグラウンディングします。
  • コード実行: モデルが安全なサンドボックス環境で Python コードを生成して実行できるようにします。
  • 関数呼び出し: 構造化された関数引数を返すことで、モデルが外部ツール、API、データベースに接続できるようにします。

Interactions API は、Enterprise 向けのウェブ グラウンディングと Google 検索によるグラウンディングをサポートしています。これらの機能のご利用には、サービス固有規約も適用されます。

課金

Interactions API の使用量は、トークンの使用量に基づいて課金されます。

中断されたリクエストや未完了のリクエストの課金は、次のように処理されます。

  • 手動キャンセル: 完了前にインタラクションがキャンセルされた場合(キャンセル リクエストの送信など)、キャンセル時点までに使用されたトークンに対して課金されます。
  • 失敗したリクエスト: 内部システム エラーまたはバックエンドの障害が原因でインタラクション リクエストが失敗した場合、失敗したリクエストに対して課金されることはありません。

セキュリティとコンプライアンス

プレビュー版では、Interactions API には次のセキュリティ、コンプライアンス、データ所在地に関する考慮事項があります。

  • セキュリティとコンプライアンスの認証: Interactions API のプレビューは、FedRAMP または顧客管理の暗号鍵(CMEK)をサポートしておらず、国防総省(DoD)の影響レベル 5(IL5)または国際武器取引規則(ITAR)の要件に準拠していません。
  • VPC Service Controls: Interactions API プレビューは、API 境界を保護するための VPC Service Controls(VPC-SC)をサポートしています。
  • データ所在地: Interactions API プレビューはデータ所在地をサポートしておらず、セッション ストレージに関するコミットメントもありません。
  • エンドポイント: Interactions API プレビューでは、グローバル エンドポイント(locations/global)のみがサポートされています。

サポートされている SDK

Interactions API には、統合された Google Gen AI SDK または直接 REST 呼び出しを使用してアクセスできます。

  • Python: google-genai バージョン 2.3.0 以降
  • TypeScript / JavaScript: @google/genai バージョン 2.3.0 以降
  • Go: google.golang.org/genai
  • Java: com.google.genai:google-genai

以前の SDK(google-cloud-aiplatform、@google-cloud/vertexai、google-generativeai)は Interactions API をサポートしていません。

次のステップ