Questo documento descrive le quote e i limiti più comuni per Dialogflow. Per informazioni su come trovare un elenco completo di quote e limiti, consulta le sezioni seguenti.
Ci riserviamo il diritto di modificare questi vincoli e questa pagina viene aggiornata per riflettere eventuali modifiche.
Quote
Le quote sono vincoli predefiniti applicati al tuo progetto. Quando utilizzi le funzionalità di IA generativa, ogni combinazione di modello e regione ha la propria quota generativa. Se utilizzi un'edizione a pagamento, puoi richiedere un aumento della quota. Le quote limitano il carico del servizio per client, il che protegge i servizi dal sovraccarico e ti protegge dall'utilizzo imprevisto delle risorse.
Le quote di Dialogflow variano a seconda della versione dell'agente. Le quote si applicano a ogni progetto e vengono condivise tra tutte le applicazioni e gli indirizzi IP che utilizzano un progetto.
Dettagli sui limiti di tempo delle quote:
- Le quote mensili vengono reintegrate il primo giorno di ogni mese alle ore 00:00 del fuso orario del Pacifico.
- Le quote giornaliere vengono reintegrate giornalmente alle ore 00:00 del fuso orario del Pacifico. Quando il passaggio all'ora legale del Pacifico aumenta la durata di un giorno, Dialogflow concede un bonus di quota proporzionale. Tuttavia, non esiste una detrazione equivalente quando si verifica un giorno più breve a causa del passaggio all'ora legale.
- Le quote al minuto vengono aggiornate ogni 60 secondi allo scoccare del minuto.
Le quote elencate nella tabella delle quote sono quelle più comuni. Per esaminare tutte le quote, consulta la pagina Google Cloud Quote della console Dialogflow.
Quote generative
Quando l'agente utilizza le funzionalità generative di Dialogflow CX, ogni combinazione di modello e regione ha quote uniche.
Identificatore quota
Le quote generative monitorano l'utilizzo dei token per i modelli linguistici di grandi dimensioni (LLM) in Dialogflow CX nelle seguenti funzionalità:
- Generatori.
- Fallback generativo.
- Playbook.
- Data store.
Il limite predefinito per le quote di consumo di token LLM generativi è di 600.000 token al minuto. L'identificatore della quota dipende dal modello e dalla regione:
- Modelli Gemini 2.5 (
gemini-2.5-flashegemini-2.5-flash-lite): utilizza la quota regionaleConversationalAgentLlmTokenConsumption. - Modelli Gemini 3 e successivi (ad esempio
gemini-3.1-flash-lite): Utilizza la quotaConversationalAgentMultiRegionLLMTokenConsumptionoConversationalAgentGlobalLLMTokenConsumptioncon il seguente mapping regionale:- Tutte le regioni negli Stati Uniti utilizzano la quota
ConversationalAgentMultiRegionLLMTokenConsumptionconmulti_region=us. - Tutte le regioni in Europa utilizzano la quota
ConversationalAgentMultiRegionLLMTokenConsumptionconmulti_region=eu. - Altre regioni (inclusa
global) utilizzano la quotaConversationalAgentGlobalLLMTokenConsumption.
- Tutte le regioni negli Stati Uniti utilizzano la quota
Richiesta di aumento della quota multiregionale
Per gemini-2.5-flash e gemini-2.5-flash-lite, che utilizzano la quota ConversationalAgentLlmTokenConsumption, se il tuo agente si trova in una regione multipla (us, eu o global), invia la richiesta di aumento della quota per una delle seguenti regioni specifiche:
- Per gli agenti nelle multiregioni Stati Uniti e Globale, utilizza us-central1.
- Per gli agenti nella multi-regione UE, utilizza europe-west4.
Nello specifico, per la quota ConversationalAgentMultiRegionLLMTokenConsumption
utilizzata da Gemini 3 e modelli successivi, se non vedi la quota dimensionale (ad esempio ConversationalAgentMultiRegionLLMTokenConsumption con multi_region=us
e base_model=gemini-3.1-flash-lite) nella console Google Cloud , significa che non hai ancora utilizzato questa quota oppure puoi inviare una richiesta di aumento della quota utilizzando il seguente comando gcloud:
PROJECT_ID=foo-test
TARGET_TPM=1000000
MULTI_REGION=us
BASE_MODEL=gemini-3.1-flash-lite
USER_EMAIL=user@example.com
REASON="Reason for requesting higher multi-region token per minute limit"
gcloud beta quotas preferences create \
--service=dialogflow.googleapis.com \
--project="${PROJECT_ID}" \
--quota-id=ConversationalAgentMultiRegionLLMTokensPerMinutePerBaseModel \
--preferred-value=${TARGET_TPM} \
--dimensions=multi_region=${MULTI_REGION},base_model=${BASE_MODEL} \
--email="${USER_EMAIL}" \
--justification="${REASON}"
Visualizzare l'utilizzo dei token per regione e modello
Per ottenere informazioni sul consumo di token LLM in diverse regioni e modelli, segui questi passaggi utilizzando Esplora metriche:
- Accedi a Esplora metriche: apri Esplora metriche.
- Seleziona la metrica:
seleziona
Conversational Agent LLM tokens quota usagecome metrica da analizzare. - Configura l'aggregazione e l'allineamento:
- Imposta la funzione di aggregazione su
Sumper ottenere l'utilizzo totale dei token. - Seleziona
Configure Alignerper calcolare le variazioni tra punti dati consecutivi nella serie temporale. In questo modo è più facile comprendere le tendenze di utilizzo nel tempo.
- Imposta la funzione di aggregazione su
- Definisci le dimensioni di aggregazione:per analizzare l'utilizzo dei token, seleziona
locationebase_modelcome dimensioni per l'aggregazione. Il consumo di token varia in base alle regioni e ai modelli. - Imposta funzione di allineamento:seleziona
Sumcome funzione di allineamento per calcolare la variazione totale nell'utilizzo dei token tra punti dati consecutivi.
Richiesta di aumento della quota
Se necessario, puoi richiedere un aggiustamento dell'aumento della quota.
Se utilizzi progetti diversi per gli agenti Dialogflow e per l'autenticazione con i service account, richiedi un aumento della quota per il progetto consumer. Per maggiori informazioni, vedi Utilizzare più progetti per Dialogflow ES o Utilizzare più progetti per Dialogflow CX.
Per gli agenti Dialogflow ES, devi eseguire l'upgrade dell'agente alla versione Dialogflow Essentials prima di richiedere un aumento della quota.
Tabella delle quote
I seguenti termini vengono utilizzati per descrivere prezzi e quote:
- Richiesta:Una richiesta è definita come qualsiasi chiamata API al servizio Dialogflow CX, effettuata sia direttamente tramite API che indirettamente tramite integrazione o console. A seconda dell'attività e della progettazione dell'agente, il numero di richieste necessarie a un utente finale per svolgere un'attività con un agente Dialogflow CX può variare notevolmente.
- Sessione:Una sessione è una conversazione tra un utente finale e un agente Dialogflow CX.
Una sessione rimane attiva e i suoi dati archiviati per 30 minuti
dopo l'invio dell'ultima richiesta per la sessione.
Può essere una sessione di chat o una sessione vocale.
- Sessione di chat:Una sessione di chat utilizza solo testo sia per le richieste che per le risposte.
- Sessione vocale: una sessione vocale utilizza l'audio per richieste, risposte o entrambe.
- Progetti consumer e progetti di risorse: se utilizzi più progetti, è possibile che il progetto associato all'autenticazione della richiesta (progetto consumer) non coincida con quello associato all'agente nella richiesta (progetto di risorsa). In questo caso, il progetto consumer viene utilizzato per determinare i prezzi e le quote. Per maggiori informazioni, vedi Utilizzare più progetti per Dialogflow ES o Utilizzare più progetti per Dialogflow CX.
Le tabelle seguenti forniscono un confronto delle quote per le versioni in base al tipo di agente. A meno che una funzionalità non sia indicata come inclusa, le quote sono cumulative per tutte le funzionalità utilizzate da una richiesta.
Agente Dialogflow CX
| Funzionalità | Versione di Dialogflow CX |
|---|---|
|
Testo (include tutte le richieste DetectIntent, StreamingDetectIntent e FulfillIntent che non contengono audio) |
1200 richieste al minuto |
|
Input/output audio (riconoscimento vocale, conversione della voce in testo, STT, sintesi vocale, conversione del testo in voce, TTS, telefonia) |
600 richieste al minuto |
|
Operazioni di query audio con la voce HD di Chirp3 (sintesi vocale, sintesi vocale, TTS, telefonia) |
25 richieste al minuto * |
|
Funzionalità generative (playbook, datastore, generatori, fallback generativo) |
600.000 token al minuto, vedi quote generative |
|
Dialogflow CX Phone Gateway Include input e output audio. |
100 minuti totali di conversazione telefonica al minuto‡ |
|
Richieste di scrittura in fase di progettazione Ad esempio, chiamate per creare o aggiornare un agente. |
60 richieste al minuto |
|
Richieste di lettura in fase di progettazione Ad esempio, chiamate per elencare o ottenere risorse dell'agente. |
300 richieste al minuto |
|
Altre richieste di sessione Ad esempio, impostazione o recupero di entità sessione. |
100 richieste al minuto |
| Simbolo | Descrizione |
|---|---|
| * | Se la quota viene superata, le voci in HD di Chirp 3 potrebbero tornare alle voci neurali o standard |
| ‡ | "Minuti di chiamate al minuto" è la somma totale del tempo al minuto utilizzato da tutti gli utenti che effettuano chiamate tramite il sistema telefonico. Ad esempio, in un periodo di tempo di 60 secondi, un utente è online per 60 secondi, un secondo per 30 secondi e un terzo per 30 secondi. Questo periodo è calcolato come 2 minuti al minuto. Più minuti al minuto consentono a un maggior numero di utenti di utilizzare il sistema contemporaneamente. |
Agente Dialogflow ES
| Funzionalità | Trial Edition | Essentials Edition |
|---|---|---|
|
Testo (include tutte le richieste DetectIntent e StreamingDetectIntent che non contengono audio) |
180 richieste al minuto ¶ | 600 richieste al minuto ¶ |
|
Input audio (anche denominato riconoscimento vocale, conversione della voce in testo, STT) |
100 richieste al minuto † 1000 richieste al giorno † 15.000 richieste al mese † Durata massima dell'audio di 60 secondi per richiesta † |
300 richieste al minuto † Durata massima dell'audio di 60 secondi per richiesta † |
|
Output audio (anche denominato sintesi vocale, conversione del testo in voce, TTS) |
Come per input audio | Come per input audio |
| Connettori di conoscenza (beta) | Dimensioni totali massime del documento: 10 MB 1000 richieste al mese 100 richieste al giorno |
Nessun limite # |
| Analisi del sentiment | Non disponibile | Nessun limite # |
|
Gateway telefonico Dialogflow ES Include input e output audio. |
Numero verde: non disponibile 3 minuti di chiamate al minuto ‡ 30 minuti di chiamate al giorno 500 minuti di chiamate al mese Numero di telefono riservato per 30 giorni |
100 minuti totali di conversazione telefonica al minuto‡ |
| Mega-agente | 1000 richieste al giorno | Nessun limite # |
|
Richieste di scrittura in fase di progettazione Ad esempio, chiamate per creare o aggiornare un agente. |
60 richieste al minuto | 60 richieste al minuto |
|
Richieste di lettura in fase di progettazione Ad esempio, chiamate per elencare o ottenere risorse dell'agente. |
60 richieste al minuto | 60 richieste al minuto |
|
Altre richieste di sessione Ad esempio, impostazione o recupero di entità sessione o aggiornamento/interrogazione del contesto. |
100 richieste al minuto | 100 richieste al minuto |
| Simbolo | Descrizione |
|---|---|
| † | Ogni stream StreamingDetectIntent è considerato una singola richiesta, anche se lo stream potrebbe includere più frame di audio StreamingDetectIntentRequest. |
| ‡ | "Minuti di chiamate al minuto" è la somma totale del tempo al minuto utilizzato da tutti gli utenti che effettuano chiamate tramite il sistema telefonico. Ad esempio, in un periodo di tempo di 60 secondi, un utente è online per 60 secondi, un secondo per 30 secondi e un terzo per 30 secondi. Questo periodo è calcolato come 2 minuti al minuto. Più minuti al minuto consentono a un maggior numero di utenti di utilizzare il sistema contemporaneamente. |
| # | Le funzionalità contrassegnate come illimitate sono comunque potenzialmente limitate dall'utilizzo di altre funzionalità. Ad esempio, se la tua edizione fornisce una quota illimitata per i connettori della knowledge base, una richiesta di testo che utilizza i connettori della knowledge base è comunque limitata dalla quota per le richieste di testo. |
| ¶ | L'input e l'output audio per Assistente Google sono considerati richieste di testo. |
Agent Assist
Se utilizzi Agent Assist, si applicano anche le quote elencate nelle schede Agente Dialogflow CX e Agente Dialogflow ES, a seconda del tipo di agente che utilizzi.
| Funzionalità | Trial Edition | Essentials Edition |
|---|---|---|
|
Altre operazioni di conversazione tramite Agent Assist Sono incluse tutte le richieste che gestiscono le conversazioni e i partecipanti. |
Non disponibile | 300 richieste al minuto |
|
Agent Assist analyze text/audio operations Include tutte le richieste AnalyzeContent o StreamingAnalyzeContent per qualsiasi fase della conversazione. Ciò include tutte le richieste di questo tipo che coinvolgono testo, sintesi vocale e/o riconoscimento vocale. |
Non disponibile | 300 richieste al minuto |
|
Sessioni di streaming bidirezionale simultanee Include tutte le richieste BidiStreamingAnalyzeContent per qualsiasi fase della conversazione. Sono incluse tutte le richieste di questo tipo che coinvolgono la sintesi vocale e/o il riconoscimento vocale. |
Non disponibile | 50 richieste simultanee |
|
Richieste di polling per suggerimenti di riepilogo della conversazione di Agent Assist Include tutte le richieste per ottenere riepiloghi delle conversazioni. |
Non disponibile | 60 richieste al minuto |
|
Richieste di ricerca di Agent Assist Include tutte le richieste di ricerca per qualsiasi fase della conversazione. |
Non disponibile | 60 richieste al minuto |
Limiti
I limiti sono vincoli fissi che non possono essere aumentati. Molte risorse e campi hanno limiti di conteggio, durata o lunghezza, che sono vincoli fissi per l'implementazione del servizio.
Nelle tabelle seguenti sono elencati i limiti più comuni. La documentazione specifica delle funzionalità e la documentazione di riferimento dell'API potrebbero fornire limiti aggiuntivi.
Limiti di numero
Agente Dialogflow CX
| Descrizione | Limite |
|---|---|
| Numero massimo di agenti per progetto Google Cloud | 1000 |
Numero massimo di numeri di telefono per progetto (ad eccezione della regione global) |
5 |
Numero massimo di numeri di telefono per progetto per regione (ad eccezione della regione global) |
5 |
| Numero massimo di flussi per agente | 50 |
| Numero massimo di tipi di entità per agente | 250 |
| Numero massimo di webhook per agente | 100 |
| Numero massimo di ambienti per agente | 20 |
| Numero massimo di scenari di test per agente | 2000 |
| Numero massimo di changelog per agente | 20.000 |
| Numero massimo di pagine per flusso | 250 |
| Numero massimo di gruppi di route per flusso | 100 |
| Numero massimo di versioni per flusso | 20 |
| Numero massimo di intent per agente | 10.000 |
| Numero massimo di intent di riferimento per flusso | 2000 |
| Numero massimo di frasi di addestramento per intent e per lingua (eccetto "intent negativo predefinito") | 2000 |
| Numero massimo di frasi di addestramento per flusso e per lingua | 100.000 |
| Numero massimo di parametri per intent | 20 |
| Numero massimo di voci di entità per intent | 30.000 |
| Numero massimo di sinonimi per voce di entità | 200 |
| Numero massimo di valori di riferimento e sinonimi di entità per agente e per lingua | 1.000.000 |
| Numero massimo di parametri per pagina | 20 |
| Numero massimo di route per pagina | 2000 |
| Numero massimo di gestori di eventi per pagina | 100 |
| Numero massimo di route per gruppo di route | 2000 |
| Numero massimo di playbook per agente | 50 |
| Numero massimo di chiamate di playbook in un turno conversazionale | 3 |
| Numero massimo di chiamate LLM per invocazione del playbook nello stesso turno conversazionale | 10 |
| Numero massimo di esempi di playbook per agente | Con la strategia di recupero degli esempi predefinita, il sistema limiterà automaticamente il numero di esempi per rientrare nel limite di token del modello in uso, in base alla pertinenza degli esempi per il contesto della sessione. |
| Numero massimo di versioni per playbook | 100 |
| Numero massimo di strumenti per agente | 100 |
| Numero massimo di passaggi per conversazione | 100 |
Agente Dialogflow ES
| Descrizione | Limite |
|---|---|
| Numero massimo di agenti per regione e per Google Cloud progetto ¶ | 1 |
Numero massimo di numeri di telefono per progetto (ad eccezione della regione global) |
5 |
Numero massimo di numeri di telefono per progetto per regione (ad eccezione della regione global) |
5 |
| Numero massimo di intent | 2000 |
| Numero massimo di tipi di entità | 250 |
| Numero massimo di frasi di addestramento per intent e per lingua | 2000 |
| Numero massimo di frasi di addestramento per agente e per lingua | 100.000 |
| Numero massimo di voci di entità | 30000 |
| Numero massimo di sinonimi per voce di entità | 200 |
| Numero massimo di valori e sinonimi di riferimento delle entità per agente e per lingua | 1.000.000 |
| Numero massimo di parametri per intent | 20 |
| Numero massimo di contesti di input per intent | 5 |
| Numero massimo di contesti di output per intent | 30 |
| Numero massimo di risposte di testo per intent e per lingua | 30 |
| Numero massimo di prompt per parametro e per lingua | 30 |
| Numero massimo di ambienti per agente | 10 |
| Numero massimo di versioni per agente | 1000 |
| ¶ | Il numero massimo di agenti per account dipende dal numero di progetti Google che puoi creare nel tuo account. Scopri come richiedere altri progetti. |
Agent Assist
Se utilizzi Agent Assist, si applicano anche i limiti elencati nelle schede Agente Dialogflow CX e Dialogflow ES, a seconda del tipo di agente che utilizzi.
| Descrizione | Limite |
|---|---|
| Numero minimo di conversazioni richiesto per l'addestramento del modello | 30.000 |
| Numero massimo di modelli addestrati contemporaneamente per progetto | 1 |
Numero massimo di numeri di telefono per progetto (ad eccezione della regione global) |
5 |
Numero massimo di numeri di telefono per progetto per regione (ad eccezione della regione global) |
5 |
| Numero massimo di ore GPU dei nodi di addestramento al mese | 4200 |
| Numero massimo di profili conversazione | 100 |
Limiti di durata
Agente Dialogflow CX
| Descrizione | Limite |
|---|---|
| Timeout massimo per webhook | 30 secondi |
| Durata massima dell'input audio | 120 secondi |
Agente Dialogflow ES
| Descrizione | Limite |
|---|---|
| Timeout massimo del webhook | 5 secondi |
| Durata massima per chiamate telefoniche | 3,5 ore |
Limiti di lunghezza
Agente Dialogflow CX
| Descrizione | Limite |
|---|---|
| Lunghezza massima della frase di addestramento | 768 caratteri |
| Lunghezza massima della risposta testuale | 4000 caratteri |
| Lunghezza massima dell'input di testo per il rilevamento dell'intent corrispondente a intent non generativi o parametri | 256 caratteri |
Agente Dialogflow ES
| Descrizione | Limite |
|---|---|
| Lunghezza minima nome agente | 1 carattere |
| Lunghezza massima nome agente | 150 caratteri |
| Lunghezza massima descrizione agente | 500 caratteri |
| Lunghezza massima del nome dell'intent | 100 caratteri |
| Lunghezza massima del tipo di entità | 30 caratteri |
| Lunghezza massima della frase di addestramento | 768 caratteri |
| Lunghezza massima del nome dell'azione | 250 caratteri |
| Lunghezza massima del nome del contesto | 250 caratteri |
| Lunghezza massima del valore della voce | 512 caratteri |
| Lunghezza massima del nome del parametro | 30 caratteri |
| Lunghezza massima della risposta testuale | 4000 caratteri |
| Lunghezza massima dell'input di testo per il rilevamento dell'intent* | 256 caratteri |
| Lunghezza massima del nome evento | 150 caratteri |
| * | Questo limite viene applicato dal servizio Dialogflow. Se utilizzi un'integrazione, la piattaforma di integrazione può presentare un limite inferiore. Verifica i dettagli relativi all'integrazione in uso. |
Limiti delle dimensioni
Agente Dialogflow CX
| Descrizione | Limite |
|---|---|
| Dimensione massima della richiesta di sintesi vocale | Consulta i limiti dei contenuti dell'API TTS. |
| Dimensione massima delle specifiche dello strumento | 20 kB |
Agente Dialogflow ES
| Descrizione | Limite |
|---|---|
| Dimensione massima dell'agente (contenuti decompressi) per l'importazione/il ripristino dell'agente | 50 MB |
| Dimensione massima della richiesta di sintesi vocale | Consulta i limiti dei contenuti dell'API TTS. |