Parámetros de ajuste
Los siguientes parámetros de índice y marcas de base de datos se usan juntos para encontrar el equilibrio adecuado de recuperación y QPS.
| Parámetro de ajuste | Descripción | Tipo de opción |
|---|---|---|
max_num_levels |
Es la cantidad máxima de niveles de centroides del árbol de agrupamiento en clústeres de K-means.
|
Creación de índices (opcional) |
num_leaves |
Es la cantidad de particiones que se aplicarán a este índice. La cantidad de particiones que aplicas cuando creas un índice afecta el rendimiento del índice. Si aumentas las particiones para una cantidad determinada de vectores, creas un índice más detallado, lo que mejora la recuperación y el rendimiento de las consultas. Sin embargo, esto tiene el costo de tiempos de creación de índices más largos. Como los árboles de tres niveles se compilan más rápido que los de dos niveles, puedes aumentar el num_leaves_value cuando creas un índice de árbol de tres niveles para lograr un mejor rendimiento.
|
Creación de índices (obligatorio) |
quantizer |
Es el tipo de cuantizador que deseas usar para el árbol de K-means. El valor predeterminado se establece en SQ8 lo que proporciona un mejor rendimiento de las consultas con una pérdida mínima de recuperación (por lo general, menos del 1 o 2%).Establécelo en FLAT si se requiere una recuperación del 99% o más. |
Creación de índices (opcional) |
scann.enable_inline_filtering |
Habilita la compatibilidad con el filtrado intercalado que consulta tus datos y aplica filtros directamente dentro de una operación de búsqueda de similitud de vectores. Estas consultas de similitud de vectores usan filtros en las mismas tablas de la base de datos y completan la evaluación de filtros mientras calculan la distancia para la identificación del vecino más cercano. Esta opción está inhabilitada de forma predeterminada. Para habilitar el filtrado intercalado, establece este parámetro en true. Si observas un deterioro en el rendimiento, establécelo en false.Esta opción está disponible en la vista previa. |
Tiempo de ejecución de la consulta (opcional) |
scann.enable_pca |
Habilita el análisis de componentes principales (PCA), que es una técnica de reducción de dimensiones que se usa para reducir automáticamente
el tamaño de la incorporación cuando es posible. Esta opción está habilitada de forma predeterminada. Establécelo en false si observas un deterioro en la recuperación. |
Creación de índices (opcional) |
scann.num_leaves_to_search |
Esta marca de base de datos controla la cantidad absoluta de hojas o particiones para buscar, lo que te permite compensar la recuperación y la QPS. El valor predeterminado es el 1% del valor establecido en num_leaves. Un valor más alto generará una mejor recuperación, pero una QPS más baja. Del mismo modo, un valor más bajo generará una recuperación más baja, pero una QPS más alta. |
Tiempo de ejecución de la consulta (opcional) |
scann.pre_reordering_num_neighbors |
Cuando se establece, la marca de base de datos especifica la cantidad de vecinos candidatos que se deben considerar durante las etapas de reordenamiento después de que la búsqueda inicial identifica un conjunto de candidatos. Establece este parámetro en un valor superior a la cantidad de vecinos que deseas que muestre la consulta. Un valor más alto genera una mejor recuperación, pero una QPS más baja. Establece este valor en 0 para inhabilitar el reordenamiento. El valor predeterminado es 0 si PCA no está habilitado durante la creación del índice. De lo contrario, el valor predeterminado es 50 x K, donde K es el límite especificado en la consulta. |
Tiempo de ejecución de la consulta (opcional) |
scann.num_search_threads |
Es la cantidad de subprocesos de búsqueda para la búsqueda de varios subprocesos. Esto puede ayudar a reducir la latencia de una sola consulta mediante el uso de más de un subproceso para la búsqueda de ANN de ScaNN en aplicaciones sensibles a la latencia. Esta configuración no mejora la latencia de una sola consulta si la base de datos ya está vinculada a la CPU. El valor predeterminado es 2. |
Tiempo de ejecución de la consulta (opcional) |