Model Armor filtra i prompt e le risposte per le tue applicazioni di AI. La dashboard di monitoraggio fornisce i dati, le metriche e le visualizzazioni generate da questo processo di screening. Utilizza queste informazioni per capire in che modo Model Armor protegge le tue applicazioni di AI e identifica i tentativi di prompt injection o altre attività dannose.
Prima di iniziare
Ruolo richiesto
Per ottenere le autorizzazioni necessarie per accedere alla dashboard di monitoraggio, chiedi all'amministratore di concederti il ruolo IAM Monitoring Viewer (roles/monitoring.viewer) sul progetto.
Per saperne di più sulla concessione dei ruoli, consulta Gestisci l'accesso a progetti, cartelle e organizzazioni.
Questo ruolo predefinito contiene le autorizzazioni necessarie per accedere alla dashboard di monitoraggio. Per vedere quali sono esattamente le autorizzazioni richieste, espandi la sezione Autorizzazioni obbligatorie:
Autorizzazioni obbligatorie
Per accedere alla dashboard di monitoraggio sono necessarie le seguenti autorizzazioni:
-
monitoring.monitoredResourceDescriptors.list -
monitoring.metricDescriptors.list
Potresti anche ottenere queste autorizzazioni con ruoli personalizzati o altri ruoli predefiniti.
Visualizzare la dashboard di monitoraggio
Nella Google Cloud console, vai alla pagina Model Armor.
Verifica di visualizzare il progetto su cui hai attivato Model Armor.
Vai alla scheda Monitoraggio.
Monitorare l'utilizzo e le prestazioni di Model Armor
Per monitorare in dettaglio l'utilizzo e le prestazioni di Model Armor, puoi utilizzare i tipi di metriche specifici disponibili in Cloud Monitoring. Sono disponibili i seguenti tipi di metriche:
modelarmor.googleapis.com/template/request_count: numero di richieste SanitizeAPImodelarmor.googleapis.com/template/pi_jb_request_count: numero di filtri per prompt injection e jailbreakmodelarmor.googleapis.com/template/rai_request_count: numero di filtri AI responsabilemodelarmor.googleapis.com/template/sdp_request_count: numero di filtri Sensitive Data Protectionmodelarmor.googleapis.com/template/malicious_uri_request_count: numero di filtri URI dannosimodelarmor.googleapis.com/template/used_token_count: conteggio dei token
Per saperne di più, consulta Tipi di metriche di Model Armor.
Visualizzare il numero di interazioni segnalate o bloccate
Nella dashboard di monitoraggio, visualizza il numero di interazioni, incluse quelle segnalate e bloccate. La dashboard di monitoraggio mostra le seguenti metriche:
- Interazioni totali: il numero totale di prompt e risposte analizzati da Model Armor.
- Interazioni segnalate: il numero di interazioni che hanno violato una policy configurata nel modello Model Armor o nelle impostazioni di base.
- Interazioni bloccate: il numero di interazioni bloccate se hai
configurato Model Armor in
INSPECT_AND_BLOCKmodalità. Queste interazioni bloccate hanno violato le impostazioni di base o i modelli.
Monitorare le violazioni della sicurezza dei contenuti
Nel grafico Violazioni nel tempo, monitora il numero di violazioni rilevate nel tempo.
Le violazioni rilevate sono classificate nelle seguenti aree:
- Prompt injection e jailbreak: violazioni dei contenuti che indicano la presenza di prompt che contengono comandi dannosi o tentativi di jailbreak. Per saperne di più, consulta Rilevamento di prompt injection e jailbreak.
- URL dannoso: violazioni dei contenuti che indicano la presenza di URL dannosi. Per saperne di più, consulta Rilevamento di URL dannosi.
- AI responsabile: violazioni dei contenuti rilevate dai filtri di sicurezza, come molestie e incitamento all'odio. Per un elenco completo delle categorie di AI responsabile, consulta Filtro di sicurezza AI responsabile.
- Dati sensibili: violazioni dei contenuti che riguardano la presenza di tipi di informazioni sensibili o tipi di informazioni personalizzate che definisci. Per saperne di più, consulta Sensitive Data Protection.
Per saperne di più su questi rilevatori, consulta Filtri di Model Armor.
Applicare filtri alle visualizzazioni
Quando applichi questi filtri alla dashboard di monitoraggio, tutte le visualizzazioni della dashboard vengono filtrate in base ai criteri selezionati:
- Modelli/Impostazioni di base: filtra le visualizzazioni in base al modello o alle impostazioni di base associati.
- Punti di integrazione: filtra le visualizzazioni in base alle integrazioni di Model Armor.
- Località: filtra le visualizzazioni in base alla località in cui è stata elaborata un'interazione.
- Tipi di input: filtra le visualizzazioni in base al tipo di input valutato: prompt o risposta.
Ispeziona i log correlati
Per esplorare le voci di log correlate ai dati nella dashboard di monitoraggio, attiva la registrazione nei modelli o nelle impostazioni di base. Per visualizzare i log , devi disporre dei ruoli IAMrichiesti.
Per ispezionare i log per il periodo selezionato, nella dashboard di monitoraggio fai clic su Altre opzioni del grafico > Ispeziona i log correlati.
Scaricare i dati delle violazioni in un file PNG o CSV
Per scaricare i dati delle violazioni in un file PNG o CSV, svolgi i seguenti passaggi:
- Nella visualizzazione Violazioni nel tempo della dashboard di monitoraggio, seleziona il periodo per il quale vuoi scaricare i dati.
- Fai clic su Altre opzioni del grafico > Scarica.
- Fai clic su Scarica PNG o Scarica CSV per scaricare i dati nel formato che preferisci.
Passaggi successivi
- Scopri di più sulla registrazione degli audit log di Model Armor.
- Configura la registrazione per Model Armor
- Risolvi i problemi di Model Armor.