Quote e limiti

Questo documento descrive le quote e i limiti più comuni per Dialogflow. Per informazioni su come trovare un elenco completo di quote e limiti, consulta le sezioni seguenti.

Ci riserviamo il diritto di modificare questi vincoli e questa pagina viene aggiornata per riflettere eventuali modifiche.

Quote

Le quote sono vincoli predefiniti applicati al tuo progetto. Quando utilizzi le funzionalità di IA generativa, ogni combinazione di modello e regione ha la propria quota generativa. Se utilizzi un'edizione a pagamento, puoi richiedere un aumento della quota. Le quote limitano il carico del servizio per client, il che protegge i servizi dal sovraccarico e ti protegge dall'utilizzo imprevisto delle risorse.

Le quote di Dialogflow variano a seconda della versione dell'agente. Le quote si applicano a ogni progetto e vengono condivise tra tutte le applicazioni e gli indirizzi IP che utilizzano un progetto.

Dettagli sui limiti di tempo delle quote:

  • Le quote mensili vengono reintegrate il primo giorno di ogni mese alle ore 00:00 del fuso orario del Pacifico.
  • Le quote giornaliere vengono reintegrate giornalmente alle ore 00:00 del fuso orario del Pacifico. Quando il passaggio all'ora legale del Pacifico aumenta la durata di un giorno, Dialogflow concede un bonus di quota proporzionale. Tuttavia, non esiste una detrazione equivalente quando si verifica un giorno più breve a causa del passaggio all'ora legale.
  • Le quote al minuto vengono aggiornate ogni 60 secondi allo scoccare del minuto.

Le quote elencate nella tabella delle quote sono quelle più comuni. Per esaminare tutte le quote, consulta la pagina Google Cloud Quote della console Dialogflow.

Quote generative

Quando l'agente utilizza le funzionalità generative di Dialogflow CX, ogni combinazione di modello e regione ha quote uniche.

Identificatore quota

Le quote generative monitorano l'utilizzo dei token per i modelli linguistici di grandi dimensioni (LLM) in Dialogflow CX nelle seguenti funzionalità:

  • Generatori.
  • Fallback generativo.
  • Playbook.
  • Data store.

Il limite predefinito per le quote di consumo di token LLM generativi è di 600.000 token al minuto. L'identificatore della quota dipende dal modello e dalla regione:

  • Modelli Gemini 2.5 (gemini-2.5-flash e gemini-2.5-flash-lite): utilizza la quota regionale ConversationalAgentLlmTokenConsumption.
  • Modelli Gemini 3 e successivi (ad esempio gemini-3.1-flash-lite): Utilizza la quota ConversationalAgentMultiRegionLLMTokenConsumption o ConversationalAgentGlobalLLMTokenConsumption con il seguente mapping regionale:
    • Tutte le regioni negli Stati Uniti utilizzano la quota ConversationalAgentMultiRegionLLMTokenConsumption con multi_region=us.
    • Tutte le regioni in Europa utilizzano la quota ConversationalAgentMultiRegionLLMTokenConsumption con multi_region=eu.
    • Altre regioni (inclusa global) utilizzano la quota ConversationalAgentGlobalLLMTokenConsumption.

Richiesta di aumento della quota multiregionale

Per gemini-2.5-flash e gemini-2.5-flash-lite, che utilizzano la quota ConversationalAgentLlmTokenConsumption, se il tuo agente si trova in una regione multipla (us, eu o global), invia la richiesta di aumento della quota per una delle seguenti regioni specifiche:

  • Per gli agenti nelle multiregioni Stati Uniti e Globale, utilizza us-central1.
  • Per gli agenti nella multi-regione UE, utilizza europe-west4.

Nello specifico, per la quota ConversationalAgentMultiRegionLLMTokenConsumption utilizzata da Gemini 3 e modelli successivi, se non vedi la quota dimensionale (ad esempio ConversationalAgentMultiRegionLLMTokenConsumption con multi_region=us e base_model=gemini-3.1-flash-lite) nella console Google Cloud , significa che non hai ancora utilizzato questa quota oppure puoi inviare una richiesta di aumento della quota utilizzando il seguente comando gcloud:

PROJECT_ID=foo-test
TARGET_TPM=1000000
MULTI_REGION=us
BASE_MODEL=gemini-3.1-flash-lite
USER_EMAIL=user@example.com
REASON="Reason for requesting higher multi-region token per minute limit"
gcloud beta quotas preferences create \
  --service=dialogflow.googleapis.com \
  --project="${PROJECT_ID}" \
  --quota-id=ConversationalAgentMultiRegionLLMTokensPerMinutePerBaseModel \
  --preferred-value=${TARGET_TPM} \
  --dimensions=multi_region=${MULTI_REGION},base_model=${BASE_MODEL} \
  --email="${USER_EMAIL}" \
  --justification="${REASON}"

Visualizzare l'utilizzo dei token per regione e modello

Per ottenere informazioni sul consumo di token LLM in diverse regioni e modelli, segui questi passaggi utilizzando Esplora metriche:

  1. Accedi a Esplora metriche: apri Esplora metriche.
  2. Seleziona la metrica: seleziona Conversational Agent LLM tokens quota usage come metrica da analizzare.
  3. Configura l'aggregazione e l'allineamento:
    • Imposta la funzione di aggregazione su Sum per ottenere l'utilizzo totale dei token.
    • Seleziona Configure Aligner per calcolare le variazioni tra punti dati consecutivi nella serie temporale. In questo modo è più facile comprendere le tendenze di utilizzo nel tempo.
  4. Definisci le dimensioni di aggregazione:per analizzare l'utilizzo dei token, seleziona location e base_model come dimensioni per l'aggregazione. Il consumo di token varia in base alle regioni e ai modelli.
  5. Imposta funzione di allineamento:seleziona Sum come funzione di allineamento per calcolare la variazione totale nell'utilizzo dei token tra punti dati consecutivi.

Richiesta di aumento della quota

Se necessario, puoi richiedere un aggiustamento dell'aumento della quota.

Se utilizzi progetti diversi per gli agenti Dialogflow e per l'autenticazione con i service account, richiedi un aumento della quota per il progetto consumer. Per maggiori informazioni, vedi Utilizzare più progetti per Dialogflow ES o Utilizzare più progetti per Dialogflow CX.

Per gli agenti Dialogflow ES, devi eseguire l'upgrade dell'agente alla versione Dialogflow Essentials prima di richiedere un aumento della quota.

Tabella delle quote

I seguenti termini vengono utilizzati per descrivere prezzi e quote:

  • Richiesta:Una richiesta è definita come qualsiasi chiamata API al servizio Dialogflow CX, effettuata sia direttamente tramite API che indirettamente tramite integrazione o console. A seconda dell'attività e della progettazione dell'agente, il numero di richieste necessarie a un utente finale per svolgere un'attività con un agente Dialogflow CX può variare notevolmente.
  • Sessione:Una sessione è una conversazione tra un utente finale e un agente Dialogflow CX. Una sessione rimane attiva e i suoi dati archiviati per 30 minuti dopo l'invio dell'ultima richiesta per la sessione. Può essere una sessione di chat o una sessione vocale.
    • Sessione di chat:Una sessione di chat utilizza solo testo sia per le richieste che per le risposte.
    • Sessione vocale: una sessione vocale utilizza l'audio per richieste, risposte o entrambe.
  • Progetti consumer e progetti di risorse: se utilizzi più progetti, è possibile che il progetto associato all'autenticazione della richiesta (progetto consumer) non coincida con quello associato all'agente nella richiesta (progetto di risorsa). In questo caso, il progetto consumer viene utilizzato per determinare i prezzi e le quote. Per maggiori informazioni, vedi Utilizzare più progetti per Dialogflow ES o Utilizzare più progetti per Dialogflow CX.

Le tabelle seguenti forniscono un confronto delle quote per le versioni in base al tipo di agente. A meno che una funzionalità non sia indicata come inclusa, le quote sono cumulative per tutte le funzionalità utilizzate da una richiesta.

Agente Dialogflow CX

Funzionalità Versione di Dialogflow CX
Testo
(include tutte le richieste DetectIntent, StreamingDetectIntent e FulfillIntent che non contengono audio)
1200 richieste al minuto
Input/output audio
(riconoscimento vocale, conversione della voce in testo, STT, sintesi vocale, conversione del testo in voce, TTS, telefonia)
600 richieste al minuto
Operazioni di query audio con la voce HD di Chirp3
(sintesi vocale, sintesi vocale, TTS, telefonia)
25 richieste al minuto *
Funzionalità generative
(playbook, datastore, generatori, fallback generativo)
600.000 token al minuto, vedi quote generative
Dialogflow CX Phone Gateway
Include input e output audio.
100 minuti totali di conversazione telefonica al minuto‡
Richieste di scrittura in fase di progettazione
Ad esempio, chiamate per creare o aggiornare un agente.
60 richieste al minuto
Richieste di lettura in fase di progettazione
Ad esempio, chiamate per elencare o ottenere risorse dell'agente.
300 richieste al minuto
Altre richieste di sessione
Ad esempio, impostazione o recupero di entità sessione.
100 richieste al minuto

Agente Dialogflow ES

Funzionalità Trial Edition Essentials Edition
Testo
(include tutte le richieste DetectIntent e StreamingDetectIntent che non contengono audio)
180 richieste al minuto ¶ 600 richieste al minuto ¶
Input audio
(anche denominato riconoscimento vocale, conversione della voce in testo, STT)
100 richieste al minuto †

1000 richieste al giorno †

15.000 richieste al mese †

Durata massima dell'audio di 60 secondi per richiesta †
300 richieste al minuto †

Durata massima dell'audio di 60 secondi per richiesta †
Output audio
(anche denominato sintesi vocale, conversione del testo in voce, TTS)
Come per input audio Come per input audio
Connettori di conoscenza (beta) Dimensioni totali massime del documento: 10 MB

1000 richieste al mese

100 richieste al giorno
Nessun limite #
Analisi del sentiment Non disponibile Nessun limite #
Gateway telefonico Dialogflow ES
Include input e output audio.
Numero verde: non disponibile

3 minuti di chiamate al minuto ‡

30 minuti di chiamate al giorno

500 minuti di chiamate al mese

Numero di telefono riservato per 30 giorni
100 minuti totali di conversazione telefonica al minuto‡
Mega-agente 1000 richieste al giorno Nessun limite #
Richieste di scrittura in fase di progettazione
Ad esempio, chiamate per creare o aggiornare un agente.
60 richieste al minuto 60 richieste al minuto
Richieste di lettura in fase di progettazione
Ad esempio, chiamate per elencare o ottenere risorse dell'agente.
60 richieste al minuto 60 richieste al minuto
Altre richieste di sessione
Ad esempio, impostazione o recupero di entità sessione o aggiornamento/interrogazione del contesto.
100 richieste al minuto 100 richieste al minuto

Agent Assist

Se utilizzi Agent Assist, si applicano anche le quote elencate nelle schede Agente Dialogflow CX e Agente Dialogflow ES, a seconda del tipo di agente che utilizzi.

Funzionalità Trial Edition Essentials Edition
Altre operazioni di conversazione tramite Agent Assist
Sono incluse tutte le richieste che gestiscono le conversazioni e i partecipanti.
Non disponibile 300 richieste al minuto
Agent Assist analyze text/audio operations
Include tutte le richieste AnalyzeContent o StreamingAnalyzeContent per qualsiasi fase della conversazione. Ciò include tutte le richieste di questo tipo che coinvolgono testo, sintesi vocale e/o riconoscimento vocale.
Non disponibile 300 richieste al minuto
Sessioni di streaming bidirezionale simultanee
Include tutte le richieste BidiStreamingAnalyzeContent per qualsiasi fase della conversazione. Sono incluse tutte le richieste di questo tipo che coinvolgono la sintesi vocale e/o il riconoscimento vocale.
Non disponibile 50 richieste simultanee
Richieste di polling per suggerimenti di riepilogo della conversazione di Agent Assist
Include tutte le richieste per ottenere riepiloghi delle conversazioni.
Non disponibile 60 richieste al minuto
Richieste di ricerca di Agent Assist
Include tutte le richieste di ricerca per qualsiasi fase della conversazione.
Non disponibile 60 richieste al minuto

Limiti

I limiti sono vincoli fissi che non possono essere aumentati. Molte risorse e campi hanno limiti di conteggio, durata o lunghezza, che sono vincoli fissi per l'implementazione del servizio.

Nelle tabelle seguenti sono elencati i limiti più comuni. La documentazione specifica delle funzionalità e la documentazione di riferimento dell'API potrebbero fornire limiti aggiuntivi.

Limiti di numero

Agente Dialogflow CX

Descrizione Limite
Numero massimo di agenti per progetto Google Cloud 1000
Numero massimo di numeri di telefono per progetto (ad eccezione della regione global) 5
Numero massimo di numeri di telefono per progetto per regione (ad eccezione della regione global) 5
Numero massimo di flussi per agente 50
Numero massimo di tipi di entità per agente 250
Numero massimo di webhook per agente 100
Numero massimo di ambienti per agente 20
Numero massimo di scenari di test per agente 2000
Numero massimo di changelog per agente 20.000
Numero massimo di pagine per flusso 250
Numero massimo di gruppi di route per flusso 100
Numero massimo di versioni per flusso 20
Numero massimo di intent per agente 10.000
Numero massimo di intent di riferimento per flusso 2000
Numero massimo di frasi di addestramento per intent e per lingua (eccetto "intent negativo predefinito") 2000
Numero massimo di frasi di addestramento per flusso e per lingua 100.000
Numero massimo di parametri per intent 20
Numero massimo di voci di entità per intent 30.000
Numero massimo di sinonimi per voce di entità 200
Numero massimo di valori di riferimento e sinonimi di entità per agente e per lingua 1.000.000
Numero massimo di parametri per pagina 20
Numero massimo di route per pagina 2000
Numero massimo di gestori di eventi per pagina 100
Numero massimo di route per gruppo di route 2000
Numero massimo di playbook per agente 50
Numero massimo di chiamate di playbook in un turno conversazionale 3
Numero massimo di chiamate LLM per invocazione del playbook nello stesso turno conversazionale 10
Numero massimo di esempi di playbook per agente Con la strategia di recupero degli esempi predefinita, il sistema limiterà automaticamente il numero di esempi per rientrare nel limite di token del modello in uso, in base alla pertinenza degli esempi per il contesto della sessione.
Numero massimo di versioni per playbook 100
Numero massimo di strumenti per agente 100
Numero massimo di passaggi per conversazione 100

Agente Dialogflow ES

Descrizione Limite
Numero massimo di agenti per regione e per Google Cloud progetto ¶ 1
Numero massimo di numeri di telefono per progetto (ad eccezione della regione global) 5
Numero massimo di numeri di telefono per progetto per regione (ad eccezione della regione global) 5
Numero massimo di intent 2000
Numero massimo di tipi di entità 250
Numero massimo di frasi di addestramento per intent e per lingua 2000
Numero massimo di frasi di addestramento per agente e per lingua 100.000
Numero massimo di voci di entità 30000
Numero massimo di sinonimi per voce di entità 200
Numero massimo di valori e sinonimi di riferimento delle entità per agente e per lingua 1.000.000
Numero massimo di parametri per intent 20
Numero massimo di contesti di input per intent 5
Numero massimo di contesti di output per intent 30
Numero massimo di risposte di testo per intent e per lingua 30
Numero massimo di prompt per parametro e per lingua 30
Numero massimo di ambienti per agente 10
Numero massimo di versioni per agente 1000

Agent Assist

Se utilizzi Agent Assist, si applicano anche i limiti elencati nelle schede Agente Dialogflow CX e Dialogflow ES, a seconda del tipo di agente che utilizzi.

Descrizione Limite
Numero minimo di conversazioni richiesto per l'addestramento del modello 30.000
Numero massimo di modelli addestrati contemporaneamente per progetto 1
Numero massimo di numeri di telefono per progetto (ad eccezione della regione global) 5
Numero massimo di numeri di telefono per progetto per regione (ad eccezione della regione global) 5
Numero massimo di ore GPU dei nodi di addestramento al mese 4200
Numero massimo di profili conversazione 100

Limiti di durata

Agente Dialogflow CX

Descrizione Limite
Timeout massimo per webhook 30 secondi
Durata massima dell'input audio 120 secondi

Agente Dialogflow ES

Descrizione Limite
Timeout massimo del webhook 5 secondi
Durata massima per chiamate telefoniche 3,5 ore

Limiti di lunghezza

Agente Dialogflow CX

Descrizione Limite
Lunghezza massima della frase di addestramento 768 caratteri
Lunghezza massima della risposta testuale 4000 caratteri
Lunghezza massima dell'input di testo per il rilevamento dell'intent corrispondente a intent non generativi o parametri 256 caratteri

Agente Dialogflow ES

Descrizione Limite
Lunghezza minima nome agente 1 carattere
Lunghezza massima nome agente 150 caratteri
Lunghezza massima descrizione agente 500 caratteri
Lunghezza massima del nome dell'intent 100 caratteri
Lunghezza massima del tipo di entità 30 caratteri
Lunghezza massima della frase di addestramento 768 caratteri
Lunghezza massima del nome dell'azione 250 caratteri
Lunghezza massima del nome del contesto 250 caratteri
Lunghezza massima del valore della voce 512 caratteri
Lunghezza massima del nome del parametro 30 caratteri
Lunghezza massima della risposta testuale 4000 caratteri
Lunghezza massima dell'input di testo per il rilevamento dell'intent* 256 caratteri
Lunghezza massima del nome evento 150 caratteri

Limiti delle dimensioni

Agente Dialogflow CX

Descrizione Limite
Dimensione massima della richiesta di sintesi vocale Consulta i limiti dei contenuti dell'API TTS.
Dimensione massima delle specifiche dello strumento 20 kB

Agente Dialogflow ES

Descrizione Limite
Dimensione massima dell'agente (contenuti decompressi) per l'importazione/il ripristino dell'agente 50 MB
Dimensione massima della richiesta di sintesi vocale Consulta i limiti dei contenuti dell'API TTS.