本文档介绍了 Dialogflow 中常见的配额和限制。如需了解如何查找配额和限制的完整列表,请参阅以下部分。
我们保留更改这些限制的权利。若有任何更改,我们会相应地更新本页面,以反映这些更改。
配额
“配额”是应用于您的项目的默认限额。 使用生成功能时,每种模型和区域组合都有自己的生成配额。如果您使用的是付费版本,可以申请增加配额。配额会限制每个客户端的服务负载,从而保护服务免于过载,并保护您免于意外的资源使用。
Dialogflow 配额因代理的版本而异。配额适用于每个项目,并由使用该项目的所有应用和 IP 地址共享。
配额时间边界详情:
- 每月配额将于每月 1 日零点(美国太平洋时间)补充。
- 每日配额每天在美国太平洋时间零点补充。 当太平洋时间夏令时转换导致一天的时间变长时,Dialogflow 会按比例授予配额奖励。 不过,如果因夏令时转换而导致一天的时间变短,则不会有相应的扣减。
- 每分钟配额按每隔 60 秒刷新一次。
配额表中列出的配额是常见的配额。如需查看所有配额,请参阅 Google Cloud 控制台中的 Dialogflow 配额页面。
生成式配额
当您的客服使用 Dialogflow CX 生成式功能时,每种模型和区域组合都有独特的配额。
配额标识符
生成式配额用于跟踪 Dialogflow CX 中大语言模型 (LLM) 的令牌使用情况,涉及以下功能:
- 生成器。
- 生成式后备。
- Playbook。
- 数据存储区。
生成式 LLM token 消耗配额的默认上限为每分钟 60 万个 token。配额标识符取决于模型和区域:
- Gemini 2.5 模型(
gemini-2.5-flash和gemini-2.5-flash-lite):使用区域性ConversationalAgentLlmTokenConsumption配额。 - Gemini 3 及更高版本的模型(例如
gemini-3.1-flash-lite):使用ConversationalAgentMultiRegionLLMTokenConsumption或ConversationalAgentGlobalLLMTokenConsumption配额,并采用以下区域映射:- 美国的所有区域都使用
ConversationalAgentMultiRegionLLMTokenConsumption配额,并具有multi_region=us。 - 欧洲的所有区域都使用
ConversationalAgentMultiRegionLLMTokenConsumption配额,且值为multi_region=eu。 - 其他区域(包括
global)使用ConversationalAgentGlobalLLMTokenConsumption配额。
- 美国的所有区域都使用
多区域配额增加申请
对于使用 ConversationalAgentLlmTokenConsumption 配额的 gemini-2.5-flash 和 gemini-2.5-flash-lite,如果您的代理位于多区域(us、eu 或 global),请针对以下特定区域之一提交配额增加申请:
- 对于美国和全球多区域中的代理,请使用 us-central1。
- 对于位于欧盟多区域位置的代理,请使用 europe-west4。
对于 Gemini 3 及更高版本模型使用的 ConversationalAgentMultiRegionLLMTokenConsumption 配额,如果您在 Google Cloud 控制台中看不到维度配额(例如具有 multi_region=us 和 base_model=gemini-3.1-flash-lite 的 ConversationalAgentMultiRegionLLMTokenConsumption),则表示您尚未用过此配额,或者您可以使用以下 gcloud 命令提交配额增加请求:
PROJECT_ID=foo-test
TARGET_TPM=1000000
MULTI_REGION=us
BASE_MODEL=gemini-3.1-flash-lite
USER_EMAIL=user@example.com
REASON="Reason for requesting higher multi-region token per minute limit"
gcloud beta quotas preferences create \
--service=dialogflow.googleapis.com \
--project="${PROJECT_ID}" \
--quota-id=ConversationalAgentMultiRegionLLMTokensPerMinutePerBaseModel \
--preferred-value=${TARGET_TPM} \
--dimensions=multi_region=${MULTI_REGION},base_model=${BASE_MODEL} \
--email="${USER_EMAIL}" \
--justification="${REASON}"
直观呈现按区域和模型统计的 token 用量
如需深入了解不同区域和模型中的 LLM 令牌消耗情况,请使用 Metrics Explorer 按照以下步骤操作:
- 访问 Metrics Explorer:打开 Metrics Explorer。
- 选择指标:
选择
Conversational Agent LLM tokens quota usage作为要分析的指标。 - 配置聚合器和对齐器:
- 将聚合函数设置为
Sum,以获取令牌总用量。 - 选择
Configure Aligner可计算时序中连续数据点之间的变化。 这样,您就可以更轻松地了解一段时间内的使用情况趋势。
- 将聚合函数设置为
- 定义汇总维度:如需细分令牌用量,请选择
location和base_model作为汇总维度。 不同区域和模型的令牌消耗量各不相同。 - 设置校准器函数:选择
Sum作为校准器函数,以计算连续数据点之间 token 使用量的总变化。
申请增加配额
如有需要,您可以申请调整配额上限。
如果您使用不同的项目来处理 Dialogflow 代理和通过服务账号进行身份验证,请为消费项目申请增加配额。如需了解详情,请参阅为 Dialogflow ES 使用多个项目或为 Dialogflow CX 使用多个项目。
对于 Dialogflow ES 代理,您必须先将代理升级到 Dialogflow Essentials 版,然后才能申请增加配额。
配额表
以下术语用于说明价格和配额:
- 请求:请求是指对 Dialogflow CX 服务的任何 API 调用,无论是直接使用 API 还是间接使用集成或控制台。根据任务和代理的设计,最终用户使用 Dialogflow CX 代理完成任务所需的请求数量可能会有很大差异。
- 会话:
会话是指最终用户与 Dialogflow CX 代理之间的对话。
在会话的最后一个请求发送后的 30 分钟内,会话将保持活动状态并且其数据会被保存。
会话可以是聊天会话或语音会话。
- 聊天会话:聊天会话仅使用文本进行请求和回答。
- 语音会话:语音会话使用音频来发出请求、接收回答或同时执行这两项操作。
- 使用方项目和资源项目:如果您有多个项目,您的请求身份关联的项目(使用方项目)可能不同于请求中的代理所关联的项目(资源项目)。在这种情况下,价格和配额由使用方项目决定。 如需了解详情,请参阅为 Dialogflow ES 使用多个项目或为 Dialogflow CX 使用多个项目。
下表按代理类型比较了各个版本的配额。除非指明某项功能已包含在内,否则配额将针对请求使用的所有功能累积计算。
Dialogflow CX 代理
| 功能 | Dialogflow CX 版本 |
|---|---|
|
Text (包括不包含音频的所有 DetectIntent、StreamingDetectIntent 和 FulfillIntent 请求) |
每分钟 1200 个请求 |
|
音频输入/输出 (语音识别、语音转文字、STT、语音合成、文字转语音、TTS、电话) |
每分钟 600 个请求 |
|
使用 Chirp3 高清语音的音频查询操作 (语音合成、文字转语音、TTS、电话) |
每分钟 25 个请求 * |
|
生成式功能 (playbook、数据存储区、生成器、生成式后备) |
每分钟 60 万个 token,请参阅生成式配额 |
|
Dialogflow CX 电话网关 包括音频输入和输出。 |
总计 100 分钟的每分钟通话时长 ‡ |
|
设计时写入请求 例如,用于构建或更新代理的调用。 |
每分钟 60 个请求 |
|
设计时读取请求 例如,用于列出或获取代理资源的调用。 |
每分钟 300 个请求 |
|
其他会话请求 例如,设置或获取会话实体。 |
每分钟 100 个请求 |
| 符号 | 说明 |
|---|---|
| * | 如果超出配额,Chirp 3 高清语音可能会回退到神经语音或标准语音 |
| ‡ | “每分钟通话时长”是指每分钟内所有用户使用电话系统的通话时间总和。例如:在一个 60 秒的时间段内,第一个用户通话 60 秒,第二个用户通话 30 秒,第三个用户通话 30 秒。此例中,每分钟的通话时长将计为 2 分钟。提高每分钟的通话时长上限可允许更多用户同时使用系统。 |
Dialogflow ES 代理
| 功能 | Trial Edition | Essentials Edition |
|---|---|---|
|
Text (包括不包含音频的所有 DetectIntent 和 StreamingDetectIntent 请求) |
每分钟 180 个请求 ¶ | 每分钟 600 个请求 ¶ |
|
音频输入 (也称作语音识别、语音转文字、STT) |
每分钟 100 个请求 † 每天 1000 个请求 † 每月 15000 个请求 † 每个请求的音频长度上限为 60 秒 † |
每分钟 300 个请求 † 每个请求的音频长度上限为 60 秒 † |
|
音频输出 (也称作语音合成、文字转语音、TTS) |
与音频输入相同 | 与音频输入相同 |
| 知识连接器(Beta 版) | 文档总大小上限为 10 MB 每月 1000 个请求 每天 100 个请求 |
无限制 # |
| 情感分析 | 不可用 | 无限制 # |
|
Dialogflow ES 手机网关 包括音频输入和输出。 |
免费手机号码:无 每分钟 3 分钟手机时长(总计)‡ 每天 30 分钟手机时长 每月 500 分钟手机时长 手机号码保留 30 天 |
总计 100 分钟的每分钟通话时长 ‡ |
| 超级代理 | 每天 1000 个请求 | 无限制 # |
|
设计时写入请求 例如,用于构建或更新代理的调用。 |
每分钟 60 个请求 | 每分钟 60 个请求 |
|
设计时读取请求 例如,用于列出或获取代理资源的调用。 |
每分钟 60 个请求 | 每分钟 60 个请求 |
|
其他会话请求 例如,设置或获取会话实体或更新/查询上下文。 |
每分钟 100 个请求 | 每分钟 100 个请求 |
| 符号 | 说明 |
|---|---|
| † | 每个 StreamingDetectIntent 流都被视为单个请求,即使该流中可能包含多帧 StreamingDetectIntentRequest 音频也是如此。 |
| ‡ | “每分钟通话时长”是指每分钟内所有用户使用电话系统的通话时间总和。例如:在一个 60 秒的时间段内,第一个用户通话 60 秒,第二个用户通话 30 秒,第三个用户通话 30 秒。此例中,每分钟的通话时长将计为 2 分钟。提高每分钟的通话时长上限可允许更多用户同时使用系统。 |
| # | 标记为“无限制”的功能仍有可能因使用其他功能而受到限制。例如,即使您的版本对于知识连接器不设限额,但使用知识连接器的文本请求仍会受到文本请求配额的限制。 |
| ¶ | Google 助理的音频输入和输出被视为文本请求。 |
Agent Assist
如果您使用的是 Agent Assist,则 Dialogflow CX 代理和 Dialogflow ES 代理标签页中列出的配额也适用,具体取决于您使用的代理类型。
| 功能 | Trial Edition | Essentials Edition |
|---|---|---|
|
Agent Assist 对话其他操作 包括管理对话和参与者的所有请求。 |
不可用 | 每分钟 300 个请求 |
|
Agent Assist 分析文本/音频操作 包括针对任何对话阶段的所有 AnalyzeContent 或 StreamingAnalyzeContent 请求。 这包括所有涉及文本、语音合成和/或语音识别的此类请求。 |
不可用 | 每分钟 300 个请求 |
|
并发 Bidi 流式会话数 包括任何对话阶段的所有 BidiStreamingAnalyzeContent 请求。 这包括所有涉及语音合成和/或语音识别的此类请求。 |
不可用 | 50 个并发请求 |
|
Agent Assist 对话摘要建议轮询请求 包括获取对话摘要的所有请求。 |
不可用 | 每分钟 60 个请求 |
|
Agent Assist SearchKnowledge 请求 包含任何对话阶段的所有 SearchKnowledge 请求。 |
不可用 | 每分钟 60 个请求 |
限制
限制是无法提高的固定限制。许多资源和字段都有数量、时长或长度限制,这些限制是服务实现的固定约束。
下表列出了常见限制。特定功能的文档和 API 参考文档可能会提供其他限制。
计数限制
Dialogflow CX 代理
| 说明 | 限制 |
|---|---|
| 每个 Google Cloud 项目的代理数量上限 | 1000 |
每个项目(global 区域除外)的手机号码数量上限 |
5 |
每个项目在每个区域(global 区域除外)中的手机号码数量上限 |
5 |
| 每个代理的工作流数量上限 | 50 |
| 每个代理的实体类型数量上限 | 250 |
| 每个代理的 Webhook 数量上限 | 100 |
| 每个代理的环境数量上限 | 20 |
| 每个代理的测试用例数量上限 | 2000 |
| 每个代理的更改日志数量上限 | 20,000 |
| 每个流的页面数量上限 | 250 |
| 每个流的路由组数量上限 | 100 |
| 每个流的版本数量上限 | 20 |
| 每个代理的意图数量上限 | 10,000 |
| 每个流的引用意图数量上限 | 2000 |
| 每个意图和每种语言(“默认负意图”除外)的训练词组数量上限 | 2000 |
| 每个流和每种语言的训练词组数量上限 | 10 万 |
| 每个意图的参数数量上限 | 20 |
| 每个实体的条目数量上限 | 30000 |
| 每个实体条目的同义词数量上限 | 200 |
| 每个代理和每种语言的实体参考值和同义词数量上限 | 100 万 |
| 每个页面的参数数量上限 | 20 |
| 每个页面的路由数量上限 | 2000 |
| 每个网页的事件处理函数数量上限 | 100 |
| 每个路由组的路由数量上限 | 2000 |
| 每个代理的 playbook 数量上限 | 50 |
| 一次对话轮次中 playbook 的调用次数上限 | 3 |
| 在同一对话轮次中,每次 playbook 调用可进行的 LLM 调用次数上限 | 10 |
| 每个代理的 playbook 示例数量上限 | 使用默认的示例检索策略时,系统会根据示例与会话上下文的相关性,自动限制示例数量,以符合所用模型的 token 限制。 |
| 每个剧本的版本数上限 | 100 |
| 每个代理的工具数量上限 | 100 |
| 每次对话的步骤数上限 | 100 |
Dialogflow ES 代理
| 说明 | 限制 |
|---|---|
| 每个区域和每个 Google Cloud 项目的代理数量上限¶ | 1 |
每个项目(global 区域除外)的手机号码数量上限 |
5 |
每个项目在每个区域(global 区域除外)中的手机号码数量上限 |
5 |
| 意图数量上限 | 2000 |
| 实体类型数量上限 | 250 |
| 每个意图和每种语言的训练短语数量上限 | 2000 |
| 每个代理和每种语言的训练短语数量上限 | 10 万 |
| 实体条目数量上限 | 30000 |
| 每个实体条目的同义词数量上限 | 200 |
| 每个代理和每种语言的实体引用值和同义词数量上限 | 100 万 |
| 每个意图的参数数量上限 | 20 |
| 每个意图的输入上下文数量上限 | 5 |
| 每个意图的输出上下文数量上限 | 30 |
| 每个 intent 和每种语言的文本回答数量上限 | 30 |
| 每个形参和每种语言的提示数量上限 | 30 |
| 每个代理的环境数量上限 | 10 |
| 每个代理的版本数量上限 | 1000 |
| ¶ | 每个账号的代理数量上限取决于您可以在账号中创建的 Google 项目数量。请参阅如何申请更多项目。 |
Agent Assist
如果您使用的是 Agent Assist,则 Dialogflow CX 代理和 Dialogflow ES 标签页下列出的限制也适用,具体取决于您使用的是哪种代理类型。
| 说明 | 限制 |
|---|---|
| 模型训练所需的对话数下限 | 30000 |
| 每个项目同时训练的模型数上限 | 1 |
每个项目(global 区域除外)的手机号码数量上限 |
5 |
每个项目在每个区域(global 区域除外)中的手机号码数量上限 |
5 |
| 每月训练节点 GPU 小时数上限 | 4200 |
| 对话配置数量上限 | 100 |
时长限制
Dialogflow CX 代理
| 说明 | 限制 |
|---|---|
| 每个 Webhook 的超时时长上限 | 30 秒 |
| 音频输入时长上限 | 120 秒 |
Dialogflow ES 代理
| 说明 | 限制 |
|---|---|
| Webhook 超时时间上限 | 5 秒 |
| 电话通话时长上限 | 3.5 小时 |
字符长度限制
Dialogflow CX 代理
| 说明 | 限制 |
|---|---|
| 训练词组长度上限 | 768 个字符 |
| 文本响应长度上限 | 4000 个字符 |
| 通过非生成型 intent 或参数 检测到的 intent 的最大文本输入长度 | 256 个字符 |
Dialogflow ES 代理
| 说明 | 限制 |
|---|---|
| 代理名称长度下限 | 1 个字符 |
| 代理名称长度上限 | 150 个字符 |
| 代理描述长度上限 | 500 个字符 |
| 意图名称长度上限 | 100 个字符 |
| 实体类型名称长度上限 | 30 个字符 |
| 训练词组长度上限 | 768 个字符 |
| 操作名称长度上限 | 250 个字符 |
| 上下文名称长度上限 | 250 个字符 |
| 条目值长度上限 | 512 个字符 |
| 参数名称长度上限 | 30 个字符 |
| 文本响应长度上限 | 4000 个字符 |
| 检测意图文本输入长度上限* | 256 个字符 |
| 事件名称长度上限 | 150 个字符 |
| * | 此限制由 Dialogflow 服务实施。如果您使用集成,集成平台可能有更低的限制。请查看适用于您的集成的详情。 |
大小限制
Dialogflow CX 代理
| 说明 | 限制 |
|---|---|
| 语音合成请求大小上限 | 请参阅 TTS API 内容限制。 |
| 工具规范大小上限 | 20KB |
Dialogflow ES 代理
| 说明 | 限制 |
|---|---|
| 代理导入/恢复操作支持的代理大小上限(未压缩的内容) | 50 MB |
| 语音合成请求大小上限 | 请参阅 TTS API 内容限制。 |