Esta herramienta se usa para buscar y recuperar información de documentos no estructurados o contenido de preguntas frecuentes conectándose a un almacén de datos que se completa con tus propios archivos.
Cuando creas la herramienta por primera vez, proporcionas lo siguiente:
- Nombre: Un nombre descriptivo que ayuda a la IA a comprender el trabajo de la herramienta. Los nombres deben comenzar con un verbo (por ejemplo,
search_internal_docsoquery_product_manuals). - Descripción: (Opcional) Una explicación de lo que hace la herramienta y cuándo debe usarla la IA. Esto ayuda al modelo a decidir si este almacén de datos específico contiene la respuesta a la instrucción de un usuario.
- Respuesta de la herramienta simulada: Una configuración opcional que se usa para simular el resultado de la herramienta con fines de prueba antes de que los datos se indexen por completo.
- Ubicación: La región en la que se aloja el almacén de datos (por ejemplo, global).
Tipo de datos: El formato del contenido que importas:
- Datos no estructurados: Es la mejor opción para documentos como archivos PDF, HTML o de texto.
- Preguntas frecuentes: Es la mejor opción para pares de preguntas y respuestas estructurados.
Selecciona una carpeta o un archivo: La ruta de acceso a tus datos en Google Cloud Storage (
gs://*). Puedes importar un solo archivo o una carpeta completa.Frecuencia de sincronización: La frecuencia con la que la herramienta busca actualizaciones en tus archivos fuente.
- Una vez: Una sola importación de los datos actuales.
- Periódica: Actualiza automáticamente el almacén de datos cuando cambian los archivos fuente (esta configuración no se puede cambiar después de la creación).
Almacén de datos de preguntas frecuentes
Los almacenes de datos de preguntas frecuentes pueden contener respuestas a preguntas frecuentes. Cuando las preguntas de los usuarios coinciden con un alto nivel de confianza con una pregunta subida, el agente devuelve la respuesta a esa pregunta sin ninguna modificación. Puedes proporcionar un título y una URL para cada par de pregunta y respuesta que muestra el agente.
Los datos se deben subir al almacén de datos en formato CSV. Cada archivo debe tener una fila de encabezado que describa las columnas.
Por ejemplo:
"question","answer","title","url"
"Why is the sky blue?","The sky is blue because of Rayleigh scattering.","Rayleigh scattering","https://en.wikipedia.org/wiki/Rayleigh_scattering"
"What is the meaning of life?","42","",""
Las columnas title y url son opcionales y se pueden omitir:
"answer","question"
"42","What is the meaning of life?"
Durante el proceso de carga, puedes seleccionar una carpeta en la que cada archivo se trate como un archivo CSV, independientemente de la extensión.
Limitaciones:
- Un carácter de espacio adicional después de
,provoca un error. - Las líneas en blanco (incluso al final del archivo) provocan un error.
Almacén de datos no estructurados
Los almacenes de datos no estructurados pueden contener contenido en los siguientes formatos:
HTMLPDFTXTCSV
Es posible (pero poco común) importar archivos del bucket de Cloud Storage de otro proyecto. Para ello, debes otorgar acceso explícito al proceso de importación. Sigue las instrucciones del mensaje de error, que contendrá el nombre del usuario que necesita acceso de lectura al bucket para realizar la importación.
Limitaciones:
- El tamaño máximo del archivo es de 2.5 MB para formatos basados en texto y de 100 MB para otros formatos.
Consulta también Importar desde Cloud Storage.