I guardrail sono un insieme di controlli ed equilibri che contribuiscono a proteggere e mantenere sicure le applicazioni dell'agente. Forniscono limitazioni dei contenuti sia per l'input che per l'output del modello. Ogni applicazione agente viene fornita con guardrail predefiniti, che puoi modificare in base alle tue esigenze. Per accedere ai sistemi di protezione per l'applicazione dell'agente, fai clic sul pulsante dei sistemi di protezione sul lato destro del generatore di agenti.
Protezione prompt
Prompt Guard fornisce una protezione di base contro gli attacchi basati sui prompt come "ignora le tue istruzioni e ...". Sono disponibili le seguenti impostazioni:
- Attiva la protezione dei prompt: Attiva o disattiva la scheda dei prompt.
- Risultati:
Controlla cosa succede se viene attivata una protezione del prompt
utilizzando i seguenti controlli dei risultati:
- Di' esattamente: Fornisci la risposta esatta dell'agente.
- Trasferimento a un agente: Trasferisci il controllo a un agente specifico.
- Genera una risposta: fornisci istruzioni per generare una risposta.
- Personalizzato: Fornisci un prompt di sicurezza personalizzato per le query di screening.
Lista bloccata
Le liste bloccate impediscono agli utenti e al tuo agente di utilizzare determinate parole e frasi. Quando crei un elenco, sono disponibili le seguenti impostazioni:
- In che modo l'agente deve abbinare i contenuti bloccati?
In questo modo, puoi scegliere il metodo di corrispondenza:
- Parole intere: corrispondenze per parole intere.
- Qualsiasi menzione: corrisponde ai contenuti che contengono parole e frasi.
- Pattern regex: corrisponde alle espressioni regolari.
- Parole e frasi bloccate: L'elenco di parole e frasi bloccate, in cui ogni voce è separata da una virgola.
- Contenuti bloccati da:
Blocca i contenuti da uno o entrambi i seguenti elementi:
- In base all'input utente
- In base alla risposta dell'agente
- Risultato:
Controlla cosa succede se viene attivato un blocco
utilizzando i seguenti controlli del risultato:
- Di' esattamente: Fornisci la risposta esatta dell'agente.
- Trasferimento a un agente: Trasferisci il controllo a un agente specifico.
- Genera una risposta: fornisci istruzioni per generare una risposta.
- Dettagli: Fornisci un nome e una descrizione facoltativi per questa lista bloccata.
Sicurezza
Si tratta di misure di salvaguardia che applicano le pratiche di AI responsabile. Sono disponibili le seguenti impostazioni:
- Livello di sicurezza:
Seleziona il livello di sicurezza:
- Rilassata: Dai la priorità alla generazione flessibile e alla bassa latenza. Non interagire mai con prompt illeciti o dannosi. Blocca sempre i contenuti esplicitamente dannosi.
- Bilanciato: Dai la priorità a interazioni sicure e naturali con i clienti. Bloccare sempre i contenuti non sicuri. Non interagire mai con prompt dannosi.
- Rigoroso: assegna la priorità al filtraggio dei contenuti dannosi. Non consentire mai contenuti generati con elementi sensibili. Respingi sempre i prompt dannosi.
- Risultati:
Controlla cosa succede se viene attivata una barriera di sicurezza
utilizzando i seguenti controlli dei risultati:
- Di' esattamente: Fornisci la risposta esatta dell'agente.
- Trasferimento a un agente: Trasferisci il controllo a un agente specifico.
- Genera una risposta: fornisci istruzioni per generare una risposta.
- Personalizzato: Regola o disattiva singolarmente i livelli di sicurezza di specifiche barriere di protezione.
Regole
Crea le tue barriere protettive utilizzando le regole. Sono disponibili le seguenti impostazioni:
- Comportamento:
Seleziona una delle seguenti opzioni per definire la regola:
- Naturale: Fornisci istruzioni in linguaggio naturale.
- Codice:
Fornisci il codice per un
after_model_callbackcallback.
- Risultati:
Controlla cosa succede se viene attivata una regola
utilizzando i seguenti controlli dei risultati:
- Di' esattamente: Fornisci la risposta esatta dell'agente.
- Trasferimento a un agente: Trasferisci il controllo a un agente specifico.
- Genera una risposta: fornisci istruzioni per generare una risposta.
- Dettagli: Fornisci un nome e una descrizione facoltativi per questa regola.