配額與限制

本文說明 Dialogflow 常見的配額和限制。如要瞭解如何查看完整的配額和限制清單,請參閱下列各節。

我們保留變更這些限制的權利,且本頁面會隨時更新,反映任何變更。

配額

「配額」是指已套用至專案的預設限制條件。使用生成功能時,每種模型和區域組合都有自己的生成配額。如果您使用付費版本,可以要求增加配額。配額會限制每個用戶端的服務負載,避免服務過載,並防止您意外使用過多資源。

Dialogflow 配額會因虛擬服務專員的版本而異。配額適用於每個專案,且使用專案的所有應用程式和 IP 位址都會共用配額。

配額時間界線詳細資料:

  • 每月配額會在太平洋時間每月 1 日的凌晨 12 點補充。
  • 每日配額會在太平洋時間凌晨 12 點重置。太平洋時間日光節約時間轉換會增加一天長度,因此 Dialogflow 會按比例增加配額。不過,如果因日光節約時間轉換而縮短一天,則不會有等值的扣除額。
  • 每分鐘配額會每 60 秒補充一次。

配額表列出的配額是常見的配額。如要查看所有配額,請前往 Google Cloud 控制台的 Dialogflow 配額頁面。

生成配額

如果服務專員使用 Dialogflow CX 生成功能,每個模型和區域的組合都有專屬配額。

配額 ID

生成配額會追蹤 Dialogflow CX 中大型語言模型 (LLM) 的權杖用量,包括下列功能:

  • 生成器。
  • 生成式備用答覆。
  • 應對手冊。
  • 資料儲存庫。

生成式 LLM 詞元用量配額的預設限制為每分鐘 600,000 個詞元。配額 ID 取決於模型和區域:

  • Gemini 2.5 模型 (gemini-2.5-flash 和 gemini-2.5-flash-lite): 使用區域 ConversationalAgentLlmTokenConsumption 配額。
  • Gemini 3 以上版本 (例如 gemini-3.1-flash-lite): 使用 ConversationalAgentMultiRegionLLMTokenConsumption 或 ConversationalAgentGlobalLLMTokenConsumption 配額,並搭配下列區域對應:
    • 美國所有區域都使用 ConversationalAgentMultiRegionLLMTokenConsumption 配額,且配額為 multi_region=us。
    • 歐洲所有區域都使用 ConversationalAgentMultiRegionLLMTokenConsumption 配額,且配額為 multi_region=eu。
    • 其他區域 (包括 global) 則使用 ConversationalAgentGlobalLLMTokenConsumption 配額。

多區域配額提高要求

對於使用 ConversationalAgentLlmTokenConsumption 配額的 gemini-2.5-flash 和 gemini-2.5-flash-lite,如果您的代理程式位於多區域 (us、eu 或 global),請為下列其中一個特定區域提交配額增加要求:

  • 如果是「美國」和「全球」多區域的代理程式,請使用「us-central1」。
  • 如果代理程式位於歐盟多區域,請使用 europe-west4。

具體來說,如果是 Gemini 3 以上模型使用的 ConversationalAgentMultiRegionLLMTokenConsumption 配額,如果 Google Cloud 控制台未顯示維度配額 (例如 ConversationalAgentMultiRegionLLMTokenConsumption、multi_region=us 和 base_model=gemini-3.1-flash-lite),表示您尚未使用此配額,或可以使用下列 gcloud 指令提交配額提高要求:

PROJECT_ID=foo-test
TARGET_TPM=1000000
MULTI_REGION=us
BASE_MODEL=gemini-3.1-flash-lite
USER_EMAIL=user@example.com
REASON="Reason for requesting higher multi-region token per minute limit"
gcloud beta quotas preferences create \
  --service=dialogflow.googleapis.com \
  --project="${PROJECT_ID}" \
  --quota-id=ConversationalAgentMultiRegionLLMTokensPerMinutePerBaseModel \
  --preferred-value=${TARGET_TPM} \
  --dimensions=multi_region=${MULTI_REGION},base_model=${BASE_MODEL} \
  --email="${USER_EMAIL}" \
  --justification="${REASON}"

以視覺化方式呈現各區域和模型的權杖用量

如要深入瞭解不同區域和模型中的 LLM 權杖用量,請按照下列步驟使用Metrics Explorer:

  1. 存取 Metrics Explorer: 開啟 Metrics Explorer。
  2. 選取指標: 選取 Conversational Agent LLM tokens quota usage 做為要分析的指標。
  3. 設定匯總和對齊器:
    • 將匯總函式設為 Sum,即可取得權杖總用量。
    • 選取 Configure Aligner 即可計算時間序列中連續資料點之間的變化。這樣一來,您就能更輕鬆地瞭解一段時間內的使用趨勢。
  4. 定義匯總維度: 如要細分權杖用量,請選取 location 和 base_model 做為匯總維度。 不同地區和模型消耗的權杖數量不同。
  5. 設定對齊器函式: 選取 Sum 做為對齊器函式,計算連續資料點之間詞元用量的總變化。

要求提高配額

如有需要,可以申請調整配額上限。

如果您使用不同的專案來處理 Dialogflow 代理程式和服務帳戶驗證,請為消費者專案申請提高配額。詳情請參閱「使用多個專案進行 Dialogflow ES 部署」或「使用多個專案進行 Dialogflow CX 部署」。

如為 Dialogflow ES 服務專員,請先將服務專員升級至 Dialogflow Essentials 版本,再申請提高配額。

配額表

說明定價和配額時,我們會使用下列字詞:

  • 要求: 要求是指對 Dialogflow CX 服務的任何 API 呼叫,無論是直接使用 API,還是間接透過整合或控制台使用。視代理程式的工作和設計而定,使用者透過 Dialogflow CX 代理程式完成工作所需的要求數量可能大相逕庭。
  • 工作階段: 工作階段是指使用者與 Dialogflow CX 代理之間的對話。 最後一項要求傳送完畢之後,工作階段會持續運作 30 分鐘,並儲存這段期間內的所有資料。工作階段可以分為「即時通訊工作階段」或「語音工作階段」。
    • 即時通訊工作階段: 即時通訊工作階段只會使用文字提出要求和生成回覆。
    • 語音工作階段: 語音工作階段會使用音訊提出要求、提供回覆,或同時執行這兩項操作。
  • 消費者專案和資源專案:如果您使用多項專案,與要求驗證相關聯的專案 (消費者專案) 不一定是與要求中的虛擬服務專員相關聯的專案 (資源專案)。在這種情況下,系統會依據消費者專案決定價格與配額。詳情請參閱「使用多個專案進行 Dialogflow ES」或「使用多個專案進行 Dialogflow CX」。

下表依代理程式類型比較各版本的配額。除非功能標示為「已納入」,否則要求使用的所有功能配額都會累計。

Dialogflow CX 代理

功能 Dialogflow CX 版本
文字
(包括所有不含音訊的 DetectIntent、StreamingDetectIntent 和 FulfillIntent 要求)
每分鐘 1,200 個要求
音訊輸入/輸出
(語音辨識、語音轉文字、STT、 語音合成、文字轉語音、TTS、電話)
每分鐘 600 次要求
使用 Chirp3 HD 語音的音訊查詢作業
(語音合成、文字轉語音、TTS、電話)
每分鐘 25 個要求 *
生成功能
(應對手冊、資料儲存庫、生成器、生成式備用答覆)
每分鐘 60 萬個權杖,請參閱生成配額
Dialogflow CX 電話閘道
包括音訊輸入和輸出。
每分鐘總通話分鐘數:100 ‡
設計階段的寫入要求
例如,建構或更新代理程式的呼叫。
每分鐘 60 個要求
設計階段讀取要求
例如,列出或取得代理程式資源的呼叫。
每分鐘 300 個要求
其他工作階段要求
例如,設定或取得工作階段實體。
每分鐘 100 個要求

Dialogflow ES 代理程式

功能 Trial Edition Essentials Edition
文字
(包括所有不含音訊的 DetectIntent 和 StreamingDetectIntent 要求)
每分鐘 180 個要求 ¶ 每分鐘 600 個要求 ¶
語音輸入
(也稱為語音辨識、 語音轉文字、STT)
每分鐘 100 個要求 †

每天 1,000 個要求 †

每月 15,000 個要求 †

每個要求最多 60 秒的音訊長度 †
每分鐘 300 個要求 †

每個要求最多 60 秒的音訊長度 †
音訊輸出
(又稱為語音合成、文字轉語音或 TTS)
與音訊輸入相同 與音訊輸入相同
知識連接器 (Beta 版) 文件總大小上限為 10 MB

每月 1000 個要求

每天 100 個要求
無限制 #
情緒分析 無法使用 無限制 #
Dialogflow ES 電話閘道
包括音訊輸入和輸出。
免付費電話號碼:不適用

每分鐘 3 分鐘通話時間,總計 ‡

每天 30 分鐘通話時間

每月 500 分鐘通話時間

電話號碼保留 30 天
每分鐘總通話分鐘數:100 ‡
超級代理人 每日 1,000 個要求 無限制 #
設計階段的寫入要求
例如,建構或更新代理程式的呼叫。
每分鐘 60 個要求 每分鐘 60 個要求
設計階段讀取要求
例如,列出或取得代理程式資源的呼叫。
每分鐘 60 個要求 每分鐘 60 個要求
其他工作階段要求
例如設定或取得工作階段實體, 或是更新/查詢內容。
每分鐘 100 個要求 每分鐘 100 個要求

Agent Assist

如果您使用 Agent Assist,則 Dialogflow CX 服務專員和 Dialogflow ES 服務專員分頁中列出的配額也適用,具體視您使用的服務專員類型而定。

功能 Trial Edition Essentials Edition
Agent Assist 對話其他作業
包含管理對話和參與者的所有要求。
無法使用 每分鐘 300 個要求
Agent Assist 分析文字/音訊作業
包括任何對話階段的所有 AnalyzeContent 或 StreamingAnalyzeContent 要求。 包括所有涉及文字、語音合成和/或語音辨識的要求。
無法使用 每分鐘 300 個要求
並行 Bidi 串流工作階段
包括任何對話階段的所有 BidiStreamingAnalyzeContent 要求。 包括所有涉及語音合成和/或語音辨識的要求。
無法使用 50 項並行要求
Agent Assist 對話摘要建議輪詢要求
包括所有取得對話摘要的要求。
無法使用 每分鐘 60 個要求
Agent Assist SearchKnowledge 要求
包括任何對話階段的所有 SearchKnowledge 要求。
無法使用 每分鐘 60 個要求

限制

限制是固定約束,無法增加。許多資源和欄位都有計數、時間長度或長度限制,這些是服務實作的固定限制。

下表列出常見的限制。功能專屬說明文件和 API 參考文件可能會提供額外限制。

數量限制

Dialogflow CX 虛擬服務專員

說明 限制
每個 Google Cloud 專案的代理數量上限 1000
每個專案的電話號碼數量上限 (global 區域除外) 5
每個專案在每個區域的電話號碼數量上限 (global 區域除外) 5
每個代理程式的流程數量上限 50
每個代理程式的實體類型數量上限 250
每個代理程式的 Webhook 數量上限 100
每個代理程式的環境數量上限 20
每個代理的測試案例數量上限 2000
每個代理程式的變更記錄數量上限 20,000
每個流程的頁數上限 250
每個流程的路徑群組數量上限 100
每個流程的版本數量上限 20
每個代理程式的意圖數量上限 10,000
每個流程的參照意圖數量上限 2000
每個意圖和每種語言的訓練詞組數量上限 (除了「預設排除意圖」) 2000
每個流程和每種語言的訓練詞組數量上限 100,000
每個意圖的參數數量上限 20
每個實體的實體項目數量上限 30,000
每個實體項目的實體同義詞數量上限 200
每個代理程式和每種語言的實體參考值和同義詞數量上限 1,000,000
每頁的參數數量上限 20
每頁的路徑數量上限 2000
每頁的事件處理常式數量上限 100
每個路徑群組的路徑數量上限 2000
每個代理的應對手冊數量上限 50
單次對話輪替中可叫用應對手冊的次數上限 3
在同一個對話回合中,每次叫用應對手冊時的 LLM 呼叫次數上限 10
每個代理的劇本範例數量上限 使用預設的範例擷取策略時,系統會根據範例與工作階段內容的關聯性,自動限制範例數量,確保範例符合所用模型的符記限制。
每個應對手冊的版本數量上限 100
每個代理程式的工具數量上限 100
每段對話的步驟數量上限 100

Dialogflow ES 服務專員

說明 限制
每個區域和每個 Google Cloud 專案的代理數量上限 ¶ 1
每個專案的電話號碼數量上限 (global 區域除外) 5
每個專案在每個區域的電話號碼數量上限 (global 區域除外) 5
意圖數量上限 2000
實體類型數量上限 250
每個意圖和每種語言的訓練詞組數量上限 2000
每個代理和每種語言的訓練詞組數量上限 100,000
實體項目數量上限 30000
每個實體項目的實體同義詞數量上限 200
每個代理程式和每種語言的實體參照值和同義字數量上限 1,000,000
每個意圖的參數數量上限 20
每個意圖的輸入情境數量上限 5
每個意圖的輸出背景資訊數量上限 30
每個意圖和每種語言的文字回覆數量上限 30
每個參數和每種語言的提示數量上限 30
每個代理程式的環境數量上限 10
每個代理程式的版本數量上限 1000

Agent Assist

如果您使用 Agent Assist,則 Dialogflow CX 虛擬服務專員和 Dialogflow ES 分頁中列出的限制也適用,視您使用的虛擬服務專員類型而定。

說明 限制
訓練模型所需的對話數量下限 30,000
每個專案可同時訓練的模型數量上限 1
每個專案的電話號碼數量上限 (global 區域除外) 5
每個專案在每個區域的電話號碼數量上限 (global 區域除外) 5
每月訓練節點 GPU 時數上限 4200
對話設定檔數量上限 100

時間限制

Dialogflow CX 虛擬服務專員

說明 限制
每個 Webhook 的逾時時間上限 30 秒
音訊輸入時間長度上限 120 秒

Dialogflow ES 服務專員

說明 限制
Webhook 超時時間上限 5 秒
電話通話時間上限 3.5 小時

長度限制

Dialogflow CX 虛擬服務專員

說明 限制
訓練詞組長度上限 768 個字元
文字回應長度上限 4,000 個字元
非生成意圖或參數比對到的偵測意圖,文字輸入長度上限 256 個字元

Dialogflow ES 服務專員

說明 限制
代理程式名稱長度下限 1 個字元
代理程式名稱長度上限 150 個字元
代理程式說明長度上限 500 個字元
意圖名稱長度上限 100 個字元
實體類型名稱長度上限 30 個字元
訓練詞組長度上限 768 個字元
動作名稱長度上限 250 個字元
背景資訊名稱長度上限 250 個字元
項目值長度上限 512 個字元
參數名稱長度上限 30 個字元
文字回應長度上限 4,000 個字元
偵測意圖文字輸入長度上限 * 256 個字元
事件名稱長度上限 150 個字元

大小限制

Dialogflow CX 虛擬服務專員

說明 限制
語音合成要求大小上限 請參閱 TTS API 內容限制。
工具規格大小上限 20KB

Dialogflow ES 服務專員

說明 限制
代理程式匯入/還原的代理程式大小上限 (未壓縮的內容) 50 MB
語音合成要求大小上限 請參閱 TTS API 內容限制。