Strumento di datastore di Cloud Storage

Questo strumento viene utilizzato per cercare e recuperare informazioni da documenti non strutturati o contenuti delle domande frequenti collegandosi a un datastore popolato con i tuoi file.

Quando crei lo strumento per la prima volta, fornisci:

  • Nome: un nome descrittivo che aiuta l'AI a comprendere il compito dello strumento. I nomi devono iniziare con un verbo (ad esempio search_internal_docs o query_product_manuals).
  • Descrizione: (facoltativo) una spiegazione di cosa fa lo strumento e quando l'AI deve utilizzarlo. Questo aiuta il modello a decidere se questo datastore specifico contiene la risposta al prompt di un utente.
  • Risposta simulata dello strumento: una configurazione facoltativa utilizzata per simulare l'output dello strumento a scopo di test prima che i dati vengano indicizzati completamente.
  • Località: la regione in cui è ospitato il datastore (ad esempio, globale).
  • Tipo di dati: il formato dei contenuti che stai importando:

    • Dati non strutturati: ideale per documenti come PDF, file HTML o file di testo.
    • Domande frequenti: ideale per coppie di domande e risposte strutturate.
  • Seleziona una cartella o un file: il percorso dei dati in Google Cloud Storage (gs://*). Puoi scegliere di importare un singolo file o un'intera cartella.

  • Frequenza di sincronizzazione: la frequenza con cui lo strumento verifica la presenza di aggiornamenti nei file di origine.

    • Una tantum: una singola importazione dei dati attuali.
    • Periodica: aggiorna automaticamente il datastore quando i file di origine cambiano (questa impostazione non può essere modificata dopo la creazione).

Datastore delle domande frequenti

I datastore delle domande frequenti possono contenere risposte alle domande frequenti. Quando le domande degli utenti corrispondono con un'alta probabilità a una domanda caricata, l'agente restituisce la risposta a quella domanda senza alcuna modifica. Puoi fornire un titolo e un URL per ogni coppia di domande e risposte visualizzata dall'agente.

I dati devono essere caricati nel datastore in formato CSV. Ogni file deve avere una riga di intestazione che descrive le colonne.

Ad esempio:

"question","answer","title","url"
"Why is the sky blue?","The sky is blue because of Rayleigh scattering.","Rayleigh scattering","https://en.wikipedia.org/wiki/Rayleigh_scattering"
"What is the meaning of life?","42","",""

Le colonne title e url sono facoltative e possono essere omesse:

"answer","question"
"42","What is the meaning of life?"

Durante la procedura di caricamento, puoi selezionare una cartella in cui ogni file viene trattato come file CSV indipendentemente dall'estensione.

Limitazioni:

  • Un carattere di spazio aggiuntivo dopo , causa un errore.
  • Le righe vuote (anche alla fine del file) causano un errore.

Datastore di dati non strutturati

I datastore di dati non strutturati possono contenere contenuti nei seguenti formati:

  • HTML
  • PDF
  • TXT
  • CSV

È possibile (ma raro) importare file dal bucket Cloud Storage di un altro progetto. Per farlo, devi concedere l'accesso esplicito alla procedura di importazione. Segui le istruzioni riportate nel messaggio di errore, che conterrà il nome dell'utente che deve avere l'accesso in lettura al bucket per eseguire l'importazione.

Limitazioni:

  • La dimensione massima del file è di 2,5 MB per i formati basati su testo e di 100 MB per gli altri formati.

Vedi anche Importa da Cloud Storage.