Questo documento elenca le quote e i limiti di sistema che si applicano a Model Armor.
- Le quote hanno valori predefiniti, ma in genere puoi richiedere degli adeguamenti.
- I limiti di sistema sono valori fissi che non possono essere modificati.
Google Cloud utilizza le quote per garantire l'equità e ridurre i picchi di utilizzo e disponibilità delle risorse. Una quota limita la quantità di una Google Cloud risorsa che Google Cloud il progetto può utilizzare. Le quote si applicano a una serie di tipi di risorse, inclusi hardware, software e componenti di rete. Ad esempio, le quote possono limitare il numero di chiamate API a un servizio, il numero di bilanciatori del carico utilizzati contemporaneamente dal tuo progetto o il numero di progetti che puoi creare. Le quote proteggono la community degli utentiGoogle Cloud impedendo il sovraccarico dei servizi. Le quote ti aiutano inoltre a gestire le tue Google Cloud risorse.
Il sistema delle quote di Cloud esegue le seguenti operazioni:
- Monitora il tuo consumo di Google Cloud prodotti e servizi
- Limita il consumo di queste risorse
- Fornisce un modo per richiedere modifiche al valore della quota e automatizzare gli aggiustamenti della quota
Nella maggior parte dei casi, quando provi a utilizzare una risorsa per un volume maggiore di quello consentito dalla quota, il sistema blocca l'accesso alla risorsa e l'attività che stai tentando di eseguire non va a buon fine.
In genere, le quote si applicano a livello di Google Cloud progetto. L'utilizzo di una risorsa in un progetto non influisce sulla quota disponibile in un altro progetto. All'interno di un progetto Google Cloud , le quote vengono condivise tra tutte le applicazioni e gli indirizzi IP.
Per saperne di più, consulta Panoramica delle quote di Cloud.
Quote API Model Armor
La tabella seguente specifica le quote per l'API Model Armor.
| Quota | Valore |
|---|---|
| Query API | 1200 query al minuto (QPM) per progetto |
| Richieste a ExternalProcessor | 600 QPM per progetto 1 |
Puoi applicare un valore compreso tra 0 e 1200 QPM per progetto. Per richiedere un aggiustamento, consulta Richiedi un aggiustamento delle quote. Se hai bisogno di una quota superiore a quella predefinita, contatta l'assistenza clienti Google Cloud.
Per informazioni sulle quote relative alle integrazioni di Model Armor con altri servizi, consulta Gestisci quota.
1 Rilevante se integri Model Armor con altri Google Cloud servizi.
Limite di sistema per le dimensioni dei file
La tabella seguente specifica il limite di sistema per le dimensioni dei file di input e delle immagini. Se un file o un'immagine supera questo limite, Model Armor ne salta la scansione.
| Limite di sistema | Valore |
|---|---|
| Tutti i file supportati e le immagini | 4 MB |
Limiti del sistema di token
Model Armor ha limiti di sistema variabili per i token a seconda del filtro specifico. Questi limiti si applicano al testo diretto nei prompt e nelle risposte, nonché al testo estratto dai file supportati. Model Armor esamina il testo fino a 65.536 token (circa 262.144 caratteri) per il rilevamento di prompt injection e jailbreak, AI responsabile e filtri per il materiale pedopornografico. Un token equivale a circa 4 caratteri. Per ulteriori informazioni su come vengono conteggiati i token, consulta la guida ai token dell'API Gemini.
I limiti del sistema di token non si applicano al rilevamento di URL dannosi. Model Armor impone invece un limite al numero di URL scansionati. Model Armor estrae gli URL fino a raggiungere 256 URL o la fine del payload e analizza solo i primi 256 URL trovati nei prompt e nelle risposte.
| Filtro | Limite di sistema |
|---|---|
| Rilevamento di prompt injection e jailbreaking | 65.536 |
| AI responsabile | 65.536 |
| Materiale pedopornografico | 65.536 |
| Sensitive Data Protection | 130.000 |
Se un filtro rileva una corrispondenza, restituisce
MATCH_FOUND. Se un filtro non rileva una corrispondenza, il valore restituito dipende
dal fatto che il prompt o la risposta superi il limite di token del filtro:
- Se il prompt o la risposta rientra nel limite di token del filtro, il filtro
restituisce
NO_MATCH_FOUND. - Se il prompt o la risposta supera il limite di token del filtro, il filtro restituisce
EXECUTION_SKIPPED.
Token illimitati per la modalità di streaming in tempo reale
Quando sanitizzi lo streaming di testo in modalità in tempo reale, Model Armor supporta un numero illimitato di token. Al contrario, la modalità di streaming con buffer è soggetta ai limiti dei token elencati nella tabella precedente.
Recuperare i nomi delle metriche relative a quote e limiti di sistema
Le quote e i limiti di sistema hanno due tipi di nomi: nomi visualizzati e nomi delle metriche. I nomi visualizzati hanno spazi e maiuscole che ne facilitano la lettura. I nomi delle metriche sono più spesso in minuscolo e delimitati da trattini bassi anziché spazi; il formato esatto dipende dal servizio.
Le seguenti istruzioni mostrano come ottenere i nomi delle metriche per le quote e i limiti di sistema utilizzando la console Google Cloud o gcloud CLI.
Console
Nella console Google Cloud , vai alla pagina IAM e amministrazione > Quote e limiti di sistema:
Vai a Quote e Limiti di sistema
La tabella in questa pagina mostra le quote e i limiti di sistema che hanno un utilizzo o valori modificati, nonché una voce di riferimento per le altre quote. La voce di riferimento contiene la parola "predefinito" tra parentesi alla fine dell'elenco nella colonna Nome. Ad esempio,
SetIAMPolicy requests per minute per region (default)è la voce di riferimento per la quotaSetIamPolicyRequestsPerMinutePerProject.Se non vedi la colonna Metrica, segui questi passaggi.
- Fai clic su Opzioni di visualizzazione delle colonne.
- Seleziona Metrica.
- Fai clic su OK. Nella tabella viene visualizzata la colonna Metrica.
La colonna Metrica mostra i nomi delle metriche. Per filtrare i risultati, inserisci il nome o il valore di una proprietà nel campo accanto a Filtro.
gcloud
Per ottenere i nomi delle metriche per un servizio Google Cloud utilizzando gcloud CLI, esegui il comando quotas info list. Per ignorare le righe che non elencano i nomi delle metriche, passa l'output a un comando come grep con metric: come termine di ricerca oppure utilizza il flag gcloud CLI --format:
gcloud beta quotas info list --project=PROJECT_ID_OR_NUMBER \
--service=SERVICE_NAME --format="value(metric)"
Sostituisci quanto segue:
PROJECT_ID_OR_NUMBER: l'ID progetto o il numero progetto.SERVICE_NAME: il nome del servizio di cui vuoi visualizzare le metriche di quota. Ad esempio, il nome del servizio per Compute Engine ècompute.googleapis.com. Includi la partegoogleapis.comdel nome del servizio.