En este documento, se responden las preguntas frecuentes sobre Google Cloud Knowledge Catalog (anteriormente Dataplex Universal Catalog).
Para obtener más información sobre Knowledge Catalog, consulta Descripción general de Knowledge Catalog.
Conceptos generales
Explora las preguntas frecuentes sobre las funciones de Knowledge Catalog y su relación con Data Catalog.
¿Qué es Knowledge Catalog?
Google Knowledge Catalog es una solución de administración inteligente para los recursos de datos y de IA en Google Cloud. Proporciona un inventario centralizado en el que puedes descubrir, administrar y controlar tus datos en Google Cloud fuentes de datos como BigQuery, Cloud Storage, Pub/Sub y Spanner.
Knowledge Catalog usa IA para automatizar el descubrimiento de datos, el enriquecimiento de metadatos y la calidad de los datos. A través de su catálogo de datos administrado, Knowledge Catalog proporciona la base esencial que los agentes de IA necesitan para generar contenido de alta calidad.
¿Qué es Data Catalog?
Data Catalog era el nombre original del servicio de metadatos de Google Cloud's. Con el tiempo, evolucionó a Dataplex Universal Catalog y, ahora, se cambió su nombre y evolucionó a Knowledge Catalog.
Si bien el término "Data Catalog" aún se usa para describir este tipo de indexación de datos, en el contexto de Google Cloud, se refiere a nuestro producto heredado. Usa Knowledge Catalog para todos los proyectos nuevos para aprovechar las funciones potenciadas por IA y la administración mejorada.
¿Knowledge Catalog es diferente de Data Catalog?
Sí, Knowledge Catalog es la plataforma de administración de datos potenciada por IA que, finalmente, reemplazará al Data Catalog existente. Si bien comparten conceptos similares, Knowledge Catalog proporciona varias mejoras:
Contexto potenciado por IA: A diferencia de Data Catalog, Knowledge Catalog usa Gemini para extraer automáticamente el contexto empresarial, generar descripciones en lenguaje natural y proporcionar "consultas de oro" de SQL para fundamentar los agentes de IA.
Compatibilidad con metadatos enriquecidos: Knowledge Catalog admite tipos de metadatos más complejos, como arrays, mapas y registros anidados.
Acceso de agente: Los agentes de IA pueden descubrir y usar de forma adaptativa las herramientas de Knowledge Catalog a través de un servidor MCP local o remoto.
Descubrimiento de datos: Knowledge Catalog puede transferir automáticamente metadatos de un conjunto más grande de Google Cloud servicios y fuentes de datos externas.
Administración a gran escala: Ofrece capacidades mejoradas para la creación de perfiles de datos, la calidad de los datos automática y la administración centralizada.
¿Para qué se usa Knowledge Catalog?
Google Knowledge Catalog resuelve el problema del "inicio en frío de datos", es decir, el tiempo perdido tratando de encontrar, comprender y confiar en los datos antes de que puedas usarlos. Sus usos principales incluyen lo siguiente:
Descubrimiento de datos acelerado: En lugar de navegar por silos organizacionales complejos para ubicar datos, puedes usar la búsqueda en lenguaje natural (por ejemplo, "Muéstrame los datos más recientes de abandono de clientes") para encontrar recursos en todos los Google Cloud recursos al instante, lo que aumenta la productividad de los consumidores de datos.
Fundamentación de agentes de IA: Actúa como la "fuente de verdad" para la IA generativa o el ADK. Al vincular los datos físicos a las definiciones empresariales, se garantiza que los agentes de IA (como los que se compilan en Vertex AI) usen datos de alta calidad, lo que reduce significativamente las alucinaciones de la IA y mejora la confianza en las estadísticas generadas por la IA.
Administración de datos automatizada: Analiza automáticamente tus datos para identificar información sensible (es decir, PII), realiza un seguimiento de la procedencia de los datos (linaje) y supervisa su exactitud (calidad de los datos automática). Estas capacidades ayudan a mejorar la confianza, la seguridad y el cumplimiento de los datos con menos esfuerzo manual.
Descubrimiento de "datos oscuros": Puede analizar archivos no estructurados (por ejemplo, archivos PDF o imágenes en Cloud Storage), extraer la información que contienen y hacer que se puedan buscar y consultar en BigQuery, lo que te ayuda a desbloquear estadísticas de datos a los que no se podía acceder anteriormente.
Para comenzar a usar estos casos prácticos, consulta Casos de uso de Knowledge Catalog.
¿Qué tipos de metadatos almacena Knowledge Catalog?
Knowledge Catalog almacena tres tipos de metadatos:
Metadatos técnicos: Esquemas, nombres de tablas y propiedades del sistema recopilados automáticamente.
Metadatos empresariales: Contexto definido por el usuario, como descripciones empresariales, términos del glosario y propiedad.
Metadatos de tiempo de ejecución: Información sobre el linaje de datos, las puntuaciones de calidad de los datos y las estadísticas de creación de perfiles de datos.
Migración desde Data Catalog
Explora las preguntas frecuentes sobre los cronogramas de transición, los detalles del impacto y la orientación para trasladar los flujos de trabajo de metadatos de Data Catalog a Knowledge Catalog.
¿Cómo migro desde Data Catalog?
La transición a Knowledge Catalog está diseñada para ser fluida, sin necesidad de mover datos de forma manual. Según tu uso actual, el proceso implica dos fases principales:
Fase preparatoria: Si tienes metadatos personalizados (por ejemplo, etiquetas, plantillas de etiquetas o entradas personalizadas), este contenido se transferirá automáticamente a Knowledge Catalog como de solo lectura. Durante esta fase, realizarás tareas de configuración para que el contenido existente de Data Catalog esté disponible de forma simultánea en la nueva interfaz.
Fase de transferencia: Una vez preparado, transfieres el estado activo de tus metadatos para que sean de lectura y escritura en Knowledge Catalog. Debes coordinar este paso con la actualización de cualquier carga de trabajo programática (APIs, bibliotecas cliente o módulos de Terraform) para que apunten a los nuevos extremos de Knowledge Catalog.
Si no tienes metadatos personalizados o eres nuevo en la plataforma, puedes completar la transición configurando Knowledge Catalog como tu experiencia de IU predeterminada en la Google Cloud consola.
Para obtener más información, consulta Transición de Data Catalog a Knowledge Catalog.
Facturación de estadísticas de datos
Explora las preguntas frecuentes sobre la facturación basada en tokens, la medición del uso y los controles administrativos para la función de estadísticas de datos en Knowledge Catalog.
¿Cuándo comenzaré a recibir facturas por usar estadísticas de datos?
La facturación activa de las estadísticas de datos comienza el 27 de octubre de 2026.
¿Cómo se factura el uso de estadísticas de datos?
El uso se mide en tokens de datos. Los tokens de datos representan las unidades básicas de texto y metadatos procesados por el modelo de Gemini. Estos tokens se dividen en dos categorías:
- Tokens de entrada: El contexto, las instrucciones y el historial enviados al modelo.
- Tokens de salida: Las descripciones, las relaciones y las consultas en lenguaje natural generadas que devuelve el modelo.
Para obtener más información, consulta los precios de Data Cloud Agent.
¿Las cuentas de servicio reciben una cuota gratuita para las estadísticas de datos?
No. Las cuentas de servicio no reciben una asignación de cuota gratuita por usuario. Sin embargo, su uso se mide de la misma manera que los usuarios estándar.
¿Cómo puedo evitar el cobro automático de las estadísticas de datos?
Para evitar que se apliquen cargos, verifica tus análisis en curso y deja de activar análisis nuevos. Los administradores también pueden desactivar la capacidad de estadísticas de datos inhabilitando la API de Dataplex en el proyecto respectivo.
¿Cómo puedo saber cuánto se me cobrará por las estadísticas de datos?
Google Cloud proporciona la medición de los tokens de datos. Esta medición permite a los administradores y a los propietarios de agentes supervisar su consumo de tokens. Esta capacidad de medición está disponible antes de que comience la facturación activa en octubre de 2026.